资讯
AI Agent Skills 生态的最新动态、教程和深度分析
找到 22 篇文章
AI Agent Skills 生态的最新动态、教程和深度分析
找到 22 篇文章
OpenAI 收购 Promptfoo 以增强其企业 AI 平台 Frontier 的安全测试功能,包括自动化安全测试、开发工作流集成以及监管追溯能力。Promptfoo 的开源项目将继续维护,团队将加入 OpenAI 加速 AI 安全工具开发。
攻击者利用 Cline 仓库中配置的 AI Issue 分诊工作流,通过精心构造的 Issue 标题进行提示注入,诱使 Claude Code 执行恶意 npm install 命令。随后利用 GitHub Actions 缓存共享机制,实施缓存投毒攻击,窃取了 NPM 发布密钥并发布了被篡改的 cline@2.3.0 版本。Cline 在收到漏洞报告后未能及时处理,导致攻击发生。
文章汇总了 2026 年 2 月 4 日的 AI 编程新闻,包括 Claude Code 的 10 个技巧、Opus 与 Sonnet 模型对比、Codex 应用发布,以及多项功能更新如多仓库支持、自定义快捷键等。
本文分析了提示注入攻击的成因:LLM 输入中指令与数据未分离,且模型被训练为遵循输入中的任何指令。提出的防御方案包括安全前端(Secure Front-End)分隔输入、结构化指令调优(StruQ)模拟注入训练,以及特殊偏好优化(SecAlign)通过偏好优化增强鲁棒性。实验显示,SecAlign 在保持模型通用能力的同时,将优化攻击成功率降低至 15% 以下。