资讯
AI Agent Skills 生态的最新动态、教程和深度分析
找到 538 篇文章
AI Agent Skills 生态的最新动态、教程和深度分析
找到 538 篇文章
Supersimple 是轻量级 OpenCode 配置文件,提供精简的智能体集、基于编排器的默认入口、本地技能和命令,以及 Conductor 工作流支持。适合日常开发中的规划、实现、调试、文档和任务追踪。
OpenAI发布Codex for Work,将其定位为面向所有人的计算机任务代理,并提升42%的计算机使用速度。Anthropic推出Claude Security代码审计工具,并新增对Blender、Adobe等创意软件的支持。GPT-5.5在英国AI安全研究所的多步骤网络攻击模拟中达到与Claude Mythos Preview相近的水平。
Link 是 Stripe 推出的数字钱包,支持多种支付方式和管理订阅,并内置 AI 智能体支付功能。用户通过 OAuth 授权智能体,审批每次交易,未来还将支持支出限额和无需审批的模式。开发者可直接集成 Link 钱包。
Cloudflare 和 Stripe 合作,允许编码 Agent 自动创建 Cloudflare 账户、购买域名、获取 API token,并部署应用到生产环境。新协议包含服务发现、身份验证和支付 token 化,使 Agent 能自主完成零到生产的全流程。目前 Stripe Projects 已开放公测。
本文介绍了 AWS 开源 Agent 框架 Strands Agents 的实践案例。通过将 API 端点工具替换为基于意图的工具,并将工具部署到远程 MCP 服务器并启用语义搜索,开发者成功将一次查询的 token 消耗从 52K 降至 2K,效果显著。核心原则是限制 Agent 可用的工具数量,使其更专注于特定任务。
Anaconda 收购 Outerbounds,将 Metaflow 的生产级编排与 Python 依赖栈整合,为企业提供从安全环境到生产级编排的统一平台。AI 生成代码缺陷率高、依赖风险大,治理成为瓶颈,此次收购直指这一痛点。
Anthropic 的 Managed Agents 平台提供沙箱、持久记忆、检查点等基础设施 API,意图成为 AI Agent 时代的 AWS。实测上手快但很快需要编码,更适合企业级部署而非个人开发者。
SAS 发布 Viya MCP Server,通过 Model Context Protocol 将分析能力开放给 Claude、Copilot 等任意 AI Agent。同时推出的还有 Agentic AI Accelerator、营销多智能体系统及供应链智能体,背后是行业专有模型和治理平台 AI Navigator。
Seer Agent 是 Sentry 旗下第二款 AI 调试工具,与 Autofix 互补。它不需要 Sentry 已经检测到的问题,开发者可以直接描述症状,Agent 会遍历错误、追踪、日志和代码数据来定位根因。
Nemotron 3 Nano Omni 是 NVIDIA 最新的全模态模型,采用混合 Mamba-Transformer MoE 架构,支持动态分辨率图像处理和 Conv3D 视频压缩,在文档、音频、视频等基准测试中取得领先成绩。
OpenAI与AWS合作,在Amazon Bedrock上提供GPT-5.5等模型、Codex编码工具和托管智能体。企业可在AWS环境中安全使用这些能力,Codex用户超400万,托管智能体支持复杂业务工作流。
Paper Compute Company 从可观测性和沙箱执行入手,构建 AI Agent 底层基础设施。团队汇集了 GitHub、AWS 和 CNCF 背景的资深工程师,希望通过开源方式为企业提供生产级 Agent 管理方案。
本文分享了KubeStellar Console项目使用AI编码Agent的实践经验,提出了一个五层AI代码库成熟度模型:辅助、指令、测量、自适应和自维持。核心观点是,Agent的智能不在于模型本身,而在于代码库围绕它构建的测量与反馈回路。通过编写指令文件、建立测试信任层、优先测量后自动化等步骤,项目最终实现了81%的PR通过率和快速的社区问题响应。
Cursor 3 的智能体窗口在调试测试中表现出色,无需额外提示即可修复两个漏洞,且修复覆盖范围更广。Claude Code 则更快,并主动清理了代码中的 FIXME 注释。两者都能显著简化调试流程,但 Cursor 直接执行,Claude Code 则请求许可,这反映了不同的人机协作哲学。
Anthropic 进行了一项实验,让 69 名员工用 AI 代理在分类市场上交易真实物品。实验发现,使用更先进模型的代理能获得客观更好的交易结果,但用户并未察觉这种差距。
Jaeger v2 重构核心架构,原生集成 OpenTelemetry Collector,统一收集指标、日志和追踪。项目还采用 MCP、ACP 和 AG-UI 协议,使 Jaeger 能够作为交互式工作空间,支持工程师与 AI 智能体协作分析分布式系统故障。
Cursor 与 Chainguard 合作,使 Cursor 的 AI Agent 在选依赖时可从 Chainguard 的可信制品库拉取,而非原始公共仓库,从而降低软件供应链被投毒的风险。
DeepSeek-V4 发布了两款 MoE 模型,拥有百万 token 上下文窗口,通过 CSA/HCA 混合注意力机制大幅降低长序列推理成本和内存占用。论文还介绍了针对 Agent 的思考保留机制、专用工具调用格式以及 RL 训练沙箱 DSec,使 Agent 基准测试成绩达到前沿闭源模型水平。