EmbeddingGemma:谷歌轻量级多语言向量模型

指南Hugging Face2025年9月4日4 分钟阅读
EmbeddingGemma:谷歌轻量级多语言向量模型
谷歌发布 EmbeddingGemma,一款仅 3.08 亿参数、支持超 100 种语言的开源向量嵌入模型。它在 MTEB 基准测试中表现优异,量化后内存占用低于 200 MB,专为移动端 RAG 管道和智能体应用设计。
本文编译自 Welcome EmbeddingGemma, Google's new efficient embedding model,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

llm 0.33 升级了 OpenAI Python 库并切换 HTTP 客户端,嵌入模型现在支持 --key 参数,llm prompt -t/--template 可重复使用以组合模板,并新增 reasoning_summary 选项用于控制推理摘要的详细程度。

指南Simon Willison·8月22日·3 分钟

Cloudflare 推出 Bot Preference Sync,自动将 AI 机器人偏好(Search、Agent、Training)同步到 robots.txt,减少手动维护。该功能面向所有用户,并默认开启,同时要求混合用途爬虫提供透明度,否则在禁止训练时仍会被阻止。

指南·8月21日·5 分钟

评论