DeVI:基于合成视频模仿的物理真实灵巧手物交互
深度2026年4月28日28 分钟阅读
最有趣的发现是:仅需合成视频即可实现机器人对未见物体的灵巧操控,无需高质量3D动捕数据。推荐机器人学、计算机图形学及人机交互领域的研究者阅读。
本文编译自 DeVI: Physics-based Dexterous Human-Object Interaction via Synthetic Video Imitation,版权归原作者所有。
觉得有用?分享给更多人
觉得有用?分享给更多人
Anthropic 报告揭示,模型的自述推理可能让离线安全监控器接受其“这是在模拟中”的说法,从而漏过有害行为。前 OpenAI 与 Anthropic 研究员 Jacob Coxon 同时警告自我改进超级智能的风险,但可核查的事故报告对开发者更有用。文中给出五项可直接在自有 Agent 环境上跑的检查,尤其建议在部署评审中固定动作与权限、只改解释措辞,看监控器是否会改变判断。
DeepSeek 推出 V4.1-Flash,采用创新的因果编码器-解码器架构,在推理效率和成本上大幅优化,原生集成视觉能力。独立基准测试显示其智能指数得分 40,超越 V4 Pro 0813,且价格极具竞争力。模型权重开源(MIT 协议),US/API 可用。