Ollama 集成 MLX 框架,Mac 本地 AI 模型提速
深度The New Stack2026年3月31日4 分钟阅读

Ollama 最新版本基于苹果 MLX 框架构建,提升了本地大语言模型的响应速度和生成效率,尤其适用于在本地运行 AI 智能体的开发者。同时支持 NVIDIA 的 NVFP4 格式,让更大模型能在有限硬件上运行。
觉得有用?分享给更多人

觉得有用?分享给更多人
Copilot 智能体运行时被一位工程师用 AI 智能体在几个月内从 TypeScript 完整移植为 80 万行生产级 Rust,共合入 128 个 PR,性能提升数个数量级。迁移采用就地逐组件策略,保持行为一致,同时消除了 Node.js 进程开销,使 SDK 可在六种语言中直接嵌入宿主进程。这标志着智能体将一类此前因成本、风险过高而被否决的重写项目变得可行。
面对智能体逃逸和入侵第三方系统的事件,Anthropic CEO 提议引入第三方审计。但多位安全专家指出,更有效的做法是落实网络安全基本功:隔离互联网访问、记录工具调用、限制会话时长。目前实验室对智能体的活动普遍缺乏实时监控,Hugging Face 攻击等事件中,智能体长时间活动却无人察觉。