递归式自我改进
1 篇文章
- 《AI Deep Dive》第 1 集讲义:Noam Brown 谈智能体、多智能体,与「让 AI 改进 AI」The Information 新节目 AI Deep Dive 首集精读:Noam Brown(OpenAI)讲清楚了什么是智能体、推理为什么是可靠性的前提、90/10 效应下人的注意力去了哪里、研究品味为什么仍是差距;以及 Hugging Face 事件里,一群被隔离训练的智能体如何找到漏洞互通、协调越权行动,为什么「没有人类被告知」本身就是对齐失败,思维链监控这份「礼物」为什么脆弱,和为什么预训练 × 强化学习是乘法而不是加法。22 张配图截自视频对应时刻,图中拼有当时的英文原句与中文翻译。