Sentence Transformers 支持多模态嵌入与重排
教程Hugging Face2026年4月9日8 分钟阅读
Sentence Transformers v5.4 更新后,现在能用同一套 API 编码和比对文本、图像、音频和视频。多模态嵌入模型将不同模态的输入映射到共享向量空间,多模态重排模型则能对混合模态对进行相关性评分。
觉得有用?分享给更多人
觉得有用?分享给更多人
Matt Pocock 介绍了他新发布的 /wayfinder Skill,针对项目规划阶段“迷雾重重”的场景,通过地图、门票等概念拆分任务,让 Agent 自主完成规划、原型和研究。他强调术语一致性的重要性,并建议在单体会话能完成的小任务上使用原有的 grill-me Skill。
文章指出,Token 优化是一个系统性问题,重点在于工作流重构而非单纯压缩提示词。通过引入语义缓存、上下文预算、模型路由等架构组件,可以显著减少重复计算,降低成本与延迟。