资讯
AI Agent Skills 生态的最新动态、教程和深度分析
找到 538 篇文章
AI Agent Skills 生态的最新动态、教程和深度分析
找到 538 篇文章
Gusto Cofounder 是一个能主动帮助小企业处理薪资、HR、福利等后端事务的 AI 智能体。它通过文本或 Slack 与用户交互,具备清晰的许可框架来保护敏感数据,并能连接第三方系统如 Google Sheets。整个平台由 5 人团队用 Claude Code 在 8 周内构建完成。
基于 Elasticsearch 构建持久化智能体记忆层:将记忆分为情景、语义、程序三类,分别存储在不同索引中;通过 BM25 + 稠密向量混合检索(RRF 融合)和交叉编码器重排序实现高精度召回;支持版本替换、衰减和基于 DLS 的多用户隔离。QA 评测 R@10 平均 0.89,无跨租户泄漏。
MosaicLeaks 基准测试包含 1001 条多跳研究链,每条链交替使用本地和网络信息,旨在诱发隐私泄露。实验表明,仅优化任务性能会使泄露率上升,而 PA-DR 方法通过情景化任务奖励和学习型隐私奖励,在保持任务成功率的同时大幅降低泄露。
Hugging Face 团队开发了一套用于评估开源模型在智能体任务中表现的基准测试框架。该框架不只看最终答案,还追踪回答过程中的代价:耗时、Token 用量、调用次数、失误率等。以 transformers 库为案例,团队设计了 bare、clone、skill 三种测试层级,并运行在 Hugging Face Jobs 上以确保硬件一致。
Cloudflare 将 Agents SDK 作为运行时层开放,Flue 成为首个基于它构建的框架。文章介绍了代理生产的三个层次:框架(Flue)、执行框架(Pi/Project Think)和运行时(Agents SDK),并重点说明了 SDK 提供的持久执行(Fibers)、代码执行(@cloudflare/codemode)和虚拟文件系统(@cloudflare/shell)等原语。
AWS Context 自动构建企业知识图谱,为 AI 代理提供运行时上下文。它基于 Amazon Quick 技术,支持身份感知访问和连续学习,帮助代理做出更准确的决策。
AWS 在纽约峰会上发布了 Kiro iOS 应用,支持手机端启动、审查和审批编码任务。该应用提供 Chat、Spec、Autonomous 三种模式,并强调 spec-driven 开发作为 AI 编码的核心工作流。
Vercel 发布开源框架 eve,将 agent 视为文件目录,支持 MCP、子 agent、人工审批和 OpenTelemetry 追踪。内部已有 100+ agent 运行,平台 29% 的部署由 agent 触发。
Block 在其开源框架 Goose 之上构建了 BuilderBot,通过 Slack 的 @builderbot 标签管理 AI 编码代理集群。系统可跨仓库工作,处理 Linear/Jira 工单、创建分支、提 PR、监控 CI 并迭代反馈。目前每天执行 20 万次操作,每周合并约 1500 个 PR,将原本数月的工作缩短至数天。
Chainguard 升级 Agent Skills,提供超 1000 个硬化社区技能、私有注册表及定制硬化服务。支持 Claude Code、Cursor 等工具,通过持续流水线确保技能安全,并为企业内部技能提供版本管理和访问控制。
Tailscale 升级 Aperture 平台,新增聊天界面、MCP 和 API 数据连接器以及沙箱支持,旨在为企业提供基于身份的 AI 访问控制和编排层。CEO 强调“代理需要无聊的基础设施”,即稳健的身份管理、有限访问控制、详细日志和沙箱。
Cloudflare 发布了 Cloudflare One Stack,这是一组 Agent Skills,可让 AI 代理解读并自动化零信任环境的搭建、迁移和运维。该工具包基于 Cloudflare 数千次客户迁移经验,包含产品配置、供应商迁移、网络图分析等能力,并支持与 Cloudflare API 对接。
Strands Robots SDK 将 LeRobot 的演示录制、策略推理等功能封装为 AgentTools,开发者可在一个代理内完成从模拟录制、数据集上传、策略运行到实体机器人部署的全流程。模拟与硬件共享同一数据集格式,代码只需修改一个参数即可切换环境。
ARD 规范定义了静态清单和动态注册 API,让 Agent 通过自然语言搜索发现工具和技能。Hugging Face 的 Discover Tool 是其参考实现,支持搜索 MCP 服务器、技能等资源。开发者可通过 CLI 或 REST API 使用。
DeepMind 发布 AI 控制路线图,基于“纵深防御”理念,将不完美对齐的智能体视为内部威胁,通过威胁建模、异步/同步监控和分级响应机制保障安全。框架已用于分析百万级编码智能体轨迹,并应用于 Gemini Spark 等实际系统。
AWS FinOps Agent 进入公开预览,可通过自然语言查询成本、自动调查异常并创建 Jira 工单或 Slack 通知。权限以只读为主,构建于 Bedrock 之上,目前仅在美国东部区域可用。
Anthropic 暂停了 Claude Agent SDK 的计费变更,该变更原定于 6 月 15 日生效,旨在将 Agent SDK 使用量从通用订阅额度中分离出来并单独计费。此举是在美国政府要求 Anthropic 撤下 Fable 5 和 Mythos 5 模型之后做出的,意在安抚开发者群体。
Datasette Agent 0.3a0 引入 `execute_write_sql` 工具,写入操作需用户批准;CLI 模式新增 `--yes` 和 `--unsafe` 选项,支持自动批准。