Nvidia 眼中的 Agent:大语言模型加执行框架
深度The New Stack2026年6月21日7 分钟阅读

Nvidia 开发者技术总监 Nader Khalil 详解公司对 OpenClaw 的支持、Agent 蓝图战略,以及企业如何构建专用 AI 智能体。Khalil 认为,Agent 的本质就是大语言模型(LLM)加执行框架(Harness),每个循环都应让目标更近一步。
觉得有用?分享给更多人

觉得有用?分享给更多人
Claude Opus 5.5 价格更低,但思考控制、强制工具调用、思考块路由与对话历史、计算机使用工具集四个方面都有破坏性变更。另有叙述性文字变成思考块、安全分类器更宽泛等变化不会报错,却会悄悄改变 Agent 行为。Anthropic 建议先在开发环境测试再切生产流量。
OpenAI 发布 GPT-6 Sol 和 Luna,API 价格较 GPT-5.6 同级下降 50%(Luna 输出 Token 降 58%)。新模型默认缓存命中率更高,且调整推理强度或工具可用性时不会破坏缓存,还新增 Prompt Caching Dashboard 供开发者监控缓存表现。GitHub 反馈称这些改进让需重新处理的 prompt token 占比下降超过 50%。