政策与治理 5 天前 Paul Christiano 加入 OpenAI Foundation 董事会:AI 安全研究者回到治理核心 OpenAI 宣布对齐研究者 Paul Christiano 加入 OpenAI… 编辑部
模型与研究 17 天前 Anthropic自动化研究员在10类对齐失效测试中均改善表现,但距离“自我改进”仍有多重边界 Anthropic的研究显示,Claude驱动的自动化研究系统在针对10类对齐失… 编辑部