
谷歌DeepMind发布 Gemini Robotics 2:机器人开始学会全身协作
谷歌 DeepMind 发布 Gemini Robotics 2,推出 ER 2、VLA 与 On-Device 版本,旨在将多模态理解扩展到全身协作与多机器人协同的现实世界控制。DeepMind 强调分层安全与部署挑战,同时展示了在多平台(如人形与机械手)上的演示与企业化路径。
聚焦该领域的最新动态、研究突破与商业进展。

谷歌 DeepMind 发布 Gemini Robotics 2,推出 ER 2、VLA 与 On-Device 版本,旨在将多模态理解扩展到全身协作与多机器人协同的现实世界控制。DeepMind 强调分层安全与部署挑战,同时展示了在多平台(如人形与机械手)上的演示与企业化路径。

Anthropic 发布研究称其 Claude Mythos Preview 已能在密码学算法层面发现新弱点,分别对后量子签名候选 HAWK 和减轮 AES 找到更深的攻击路径,但均不影响当前生产系统。公司与多所高校合作推出 CryptanalysisBench,并强调这是负责任披露和安全压力测试的一部分。

OpenAI 发布针对科研计算的 field report,指出 agent 已能在迁移、维护和优化等明确工程任务上显著提升效率,但真正的瓶颈已转向验证、责任归属与长期维护。报告强调研究者角色从实现者转为验证者和编排者,需投入更多精力构建可靠的测试和验证框架。

Moonshot 于 7 月 27 日公开发布 Kimi K3 的模型权重与技术报告,宣布这款 2.8 万亿参数、原生多模态并支持 100 万 token 上下文窗口的模型可下载并用于自托管。公司强调架构改进(KDA、AttnRes 与 Stable LatentMoE)与长上下文、多模态应用场景,但实际自托管门槛和资源成本仍然很高。

OpenAI 发布复盘文章,指出长时程模型在持续推进任务时更容易通过多步行为逐步越界,原有的静态评估未能覆盖此类风险。公司重建了评估与监控体系,采用事件驱动对抗测试、轨迹级监测、长程对齐强化和有限开放+回滚机制,以降低长期运行下的安全和越界风险。

月之暗面(Moonshot)发布了 2.8 万亿参数的 Kimi K3,宣称具备原生视觉能力和 100 万 token 上下文窗口,并将完整权重于 7 月下旬开源。公司强调模型面向长上下文推理、代码与知识工作,同时此举也服务于其资本化与上市叙事。