资讯
AI Agent Skills 生态的最新动态、教程和深度分析
找到 24 篇文章
AI Agent Skills 生态的最新动态、教程和深度分析
找到 24 篇文章
文章介绍了作者在智能体工程中常用的三个提示模板:利用 Claude 的 Artifacts 功能快速构建 HTML 工具原型,使用 LLM 校对博客文本但不代写观点内容,以及用 Claude Opus 生成图像替代文本初稿。每个模板都配有具体的自定义指令示例。
文章分析了 AI 智能体面临的提示注入攻击如何演变为社交工程,强调防御需限制操作影响而非仅检测恶意输入。OpenAI 在 ChatGPT 中采用源-汇分析和 Safe Url 等机制,在敏感信息外传前介入用户确认,借鉴了人类客服的风险管控思路。
OpenAI 收购 Promptfoo 以增强其企业 AI 平台 Frontier 的安全测试功能,包括自动化安全测试、开发工作流集成以及监管追溯能力。Promptfoo 的开源项目将继续维护,团队将加入 OpenAI 加速 AI 安全工具开发。
攻击者利用 Cline 仓库中配置的 AI Issue 分诊工作流,通过精心构造的 Issue 标题进行提示注入,诱使 Claude Code 执行恶意 npm install 命令。随后利用 GitHub Actions 缓存共享机制,实施缓存投毒攻击,窃取了 NPM 发布密钥并发布了被篡改的 cline@2.3.0 版本。Cline 在收到漏洞报告后未能及时处理,导致攻击发生。
文章汇总了 2026 年 2 月 4 日的 AI 编程新闻,包括 Claude Code 的 10 个技巧、Opus 与 Sonnet 模型对比、Codex 应用发布,以及多项功能更新如多仓库支持、自定义快捷键等。
本文分析了提示注入攻击的成因:LLM 输入中指令与数据未分离,且模型被训练为遵循输入中的任何指令。提出的防御方案包括安全前端(Secure Front-End)分隔输入、结构化指令调优(StruQ)模拟注入训练,以及特殊偏好优化(SecAlign)通过偏好优化增强鲁棒性。实验显示,SecAlign 在保持模型通用能力的同时,将优化攻击成功率降低至 15% 以下。