资讯
AI Agent Skills 生态的最新动态、教程和深度分析
共 1186 篇文章
AI Agent Skills 生态的最新动态、教程和深度分析
共 1186 篇文章
谷歌宣布 Gemini 2.5 Flash 和 Pro 模型正式发布,可供生产环境使用。同时推出预览版 Gemini 2.5 Flash-Lite,在编码、数学、科学等基准测试上全面优于 2.0 Flash-Lite,且延迟更低。新模型已在 Google AI Studio 和 Vertex AI 上线。
Gemini 2.5 Pro 和 Flash 现已稳定可用,新增 Flash-Lite 预览版提供更低成本选项。Flash 模型价格调整,输入 token 涨价、输出 token 降价,并取消思考与非思考价格差异。Pro 模型需求增长最快,被 Cursor、GitHub 等顶级开发者工具采用。
本文介绍了如何使用 Together 的开源模型和代码解释器,从零构建一个数据科学家智能体。智能体遵循 ReAct 和 CodeAct 模式,通过安全沙箱执行 Python 代码,实现端到端的数据分析任务自动化。
Together AI 批量 API 针对大规模非实时 LLM 任务设计,成本降低 50%,支持 DeepSeek、Llama 等 15 款模型。开发者通过 JSONL 文件提交请求,24 小时内获取结果,不影响实时 API 额度。
Gemini 2.5 原生支持音频模态,实现低延迟、高表现力的实时对话,并可通过自然语言提示精确控制文本转语音的风格、情感和多语言输出。所有音频输出均嵌入 SynthID 水印以确保透明度。
Mixture-of-Agents Alignment(MoAA)是一种利用开源大语言模型集体智慧的后训练方法。它通过智能体混合生成高质量合成数据用于监督微调,并作为奖励模型进行直接偏好优化,让小模型达到接近大模型 10 倍的性能。
CrewAI 通过持续增加原生工具、扩展框架互操作性、支持平台集成、跟进最新模型以及加速发布节奏,旨在为智能体 AI 生态构建一个协作中心。文章详细介绍了其最新进展,包括新增的 Stagehand 浏览器自动化工具、对 LlamaIndex 和 LangChain 工具的支持,以及与 Comet Optik 等平台的集成。
CrewAI 企业版通过智能体仓库、CrewAI Studio v2 可视化工具和企业连接器,支持零代码构建智能体工作流。该平台还集成 CopilotKit,可一键生成交互式 Web 界面,帮助组织规模化部署智能体应用。
CrewAI 在发布周第二天展示了其向企业级智能体平台的演进。平台新增了 MCP 双向支持、私有工具仓库、可编程安全护栏、事件总线与 Webhook,以及面向检索增强生成(RAG)的智能体化功能。这些升级旨在让企业能规模化部署和管理复杂的智能体工作流。
Gemini 2.5 通过模型硬化增强内在安全性,降低间接提示注入攻击成功率。团队强调防御需多层结合,包括模型硬化、输入输出检查和系统护栏。安全是持续过程,需不断评估和改进。
Gemini 2.5 Pro 在 WebDev Arena 和 LMArena 等排行榜上取得领先,并新增实验性 Deep Think 模式以提升复杂数学和编码任务的推理能力。2.5 Flash 在多个基准测试中表现提升,同时 token 使用量减少 20-30%。模型家族新增了原生音频输出、计算机使用能力和更强的安全防护。开发者体验方面,引入了思维摘要、扩展了思考预算至 2.5 Pro,并在 Gemini API 和 SDK 中增加了对 MCP 工具的原生支持。
Gemma 3n 是 Google 推出的移动优先开源 AI 模型,基于与高通、联发科等合作的新架构,内存占用低至 2-3GB,支持音频转录、翻译等多模态功能。开发者可通过 Google AI Studio 和 Google AI Edge 进行预览。
Together Code Interpreter(TCI)是一个 API,可安全执行 LLM 生成的代码,输出结果。它支持智能体工作流闭环迭代,并已用于强化学习训练,显著提升效率。
CrewAI 发布 CrewAI Factory,支持在企业自有数据中心或私有云中部署智能体 AI 平台。该方案与 NVIDIA AI Enterprise 集成,提供 NVIDIA NeMo 等模型工具,帮助企业规模化部署智能体工作流,实现业务转型。
AlphaEvolve 是一个基于 Gemini 大语言模型的进化编码智能体,通过自动评估和进化框架发现并优化算法。它已成功应用于谷歌数据中心(回收 0.7% 计算资源)、TPU 芯片设计(优化 Verilog 电路)和 AI 训练(加速矩阵乘法内核 23%),并在数学问题上取得了进展,如在 11 维空间改进了“接吻数问题”的下界。
Together AI 通过定制推测解码优化 DeepSeek-R1 推理效率。在文档提取、社交聊天助手和简历筛选三个真实场景中,定制推测器比基础版提速 1.23-1.45 倍,GPU 成本降低 23%-26%。仅需 20M 训练 token 即可实现 >1.10 倍加速。
Gemini 2.5 Pro 预览版更新,前端开发性能在 WebDev Arena 排行榜位列第一。模型支持视频理解生成代码、简化功能开发流程,并能快速将概念转化为完整应用。开发者可通过 Google AI Studio 或 Vertex AI 使用该模型。
Gemini 2.5 Pro 更新版提前发布,编码能力大幅提升,尤其适合构建交互式网页应用。该模型在 WebDev Arena Leaderboard 上表现优异,视频理解能力达到业界领先水平。开发者可通过 Google AI Studio 和 Vertex AI 开始使用。