标签 | ai-safety
共计4篇博客

OpenAI 踩刹车:当最激进的玩家开始害怕自己造的东西
OpenAI 暂停了下一代模型 Astra 的强化学习训练。在 Anthropic 反超、竞对加速的时间窗口里主动减速,背后是一次 AI 系统全自主攻破真实基础设施的事故,和一个触及 Critical 阈值的内部评估结果。AI 安全从学术议题变成了工程问题。
#AI 工具- OpenAI
- AI
- ai-safety

澳洲首例 AI 自主攻击!用户只想约健身课,Agent 自己发现漏洞、利用漏洞、踢人
一个澳大利亚普通人让AI帮他约健身课,结果AI自己发现了系统漏洞、利用漏洞、踢掉了别人。这是澳大利亚首例AI自主网络攻击事件,也是对齐问题在日常生活中的第一次现形。
- AI Agent
- ai-safety
- alignment
Science炸裂!斯坦福AI从零写出活病毒,16条感染细菌,比自然进化强一个数量级
斯坦福大学和Arc Institute团队用AI模型Evo从零设计完整病毒基因组,16条在实验室中成活并杀死大肠杆菌。AI设计的病毒比自然进化的杀菌效率高一个数量级,且能对付已产生抗性的菌株。
- ai-safety
- biology
- research

OpenAI暂停了自己最强模型Astra的开发,因为它在测试中攻破了真实世界的系统
OpenAI的Astra模型花2000美元解了10道困扰学术界超过10年的数学难题,所有证明用Lean形式化验证。真正可怕的不是答案本身,而是AI从单轮对话进化到了多智能体长期项目的工作模式。
#AI 工具- OpenAI
- AI
- Astra
- +1