Kev:跳过生成环节,让 Agent 决策不再烧 Token

深度The New Stack2026年9月21日5 分钟阅读
Kev:跳过生成环节,让 Agent 决策不再烧 Token
AI Agent 沿路的许多决策根本不需要写成文字,却仍被送进生成模型,白白烧掉算力和 Token。基于 Qwen 3.5 的新开源模型家族 Kev 采用纯 prefill 路线,单次前向传播就选出答案,完全不生成文本。
本文编译自 Your AI agent is burning tokens on choices that don’t need words,版权归原作者所有。

觉得有用?分享给更多人

获取每周 AI 工具精选

工具推荐、实战教程和生态洞察,每周更新。

相关文章

智能体在收集上下文时会读取工作目录里的文件,包括被忽视的 .env、云凭证和 SSH 配置,一旦这些内容随提示词发往外部模型,密钥就可能进入模型提供商日志和提示历史。传统的提交、PR、CI 检查点无法拦截提交前的泄露,因此需要把确定性的密钥检测前移到智能体读取文件和提交提示词的环节。

深度The New Stack·9月22日·6 分钟

TypeSafe 发布 System One 模型 Jev,专为软件内部决策设计,输出带校准概率的类型化结果,不做对话式生成。创始人 Diogo Almeida 认为顺序生成的 LLM 对计算机“完全没用”,Jev 在 Vercel AI Gateway 上线 24 小时内成为采用最快的模型。开发者测试显示它在非擅长的图像识别任务上仍显著超过随机猜测。

深度The New Stack·9月21日·6 分钟

评论