跳到正文
原文
张小珺·商业访谈录·· 2024-09-05AI 评分45

张小珺访谈广密:硅谷AGI范式转向self-play RL,OpenAI草莓与Claude 3.5 Opus成风向标

73. AGI范式大转移:和广密预言草莓、OpenAI o1和self-play RL|全球大模型季报4

AI 导读

广密判断纯语言模型预训练的Scaling Law或已遇瓶颈,硅谷明星公司正把资源重心转向self-play RL这条新路径。他认为三条潜在出路是多模态、10万卡集群和强化学习,并猜测OpenAI的草莓、Q*背后都是RL,该范式转移目前仅在几百名核心研究员中形成共识。

来源:张小珺·商业访谈录 · xiaoyuzhoufm.com