跳到正文

Dwarkesh Podcast

AI 研究者与科技领袖的深度访谈,官网自带完整实录。

17条入库近30天 3 条RSS 订阅

最新更新

第 1–17 条 · 共 17 条
9月17日周四
9月12日周六
9月9日周三
  1. Dwarkesh Podcast(AI 人物访谈)60

    预训练效率进步更多来自数据:2019到2025年数据贡献为模型的3.24倍

    Dwarkesh Podcast 发文公布一项对照实验结果:在1e19 FLOPs预算下,2019到2025年预训练算力效率增益中数据改进贡献12.0x、模型改进贡献3.7x,数据侧是模型侧的3.24倍。

    推荐理由:研究用逐年模型配方与数据语料的交叉实验,拆开了预训练效率提升的来源,也说明了小规模结论的适用边界。

9月1日周二
  1. Dwarkesh Podcast(AI 人物访谈)14

    Dwarkesh Podcast:智能体文明的兴衰

    Dwarkesh Podcast 上传了一段视频,内容是作者上周所写帖子的影像版,该帖子题为“The OpenAI/Hugging Face attack, clearly explained”,标注日期为 Aug 31, 2026。视频支持调节播放速度,并可在指定时间点生成分享链接。

8月30日周日
8月25日周二
8月12日周三
8月8日周六
  1. Dwarkesh Podcast(AI 人物访谈)29

    持续学习时代的 8 个预测

    文章预测 AI 持续学习时代的 8 项变化:监管应对模型提供方做月度或季度风险巡检,而非锁定训练后、部署前的一次性检查,现有基于冻结权重的技术对齐方法也需彻底改变。一组权重需数千条序列并发解码才高效,个人用户以 batch size 1 服务自己可能承受 100x+ 算力效率损失,服务个性化权重的经济性明显偏向大公司。

8月4日周二
7月29日周三
  1. Dwarkesh Podcast(AI 人物访谈)51

    Dwarkesh:未来几年算力价格可能上涨10倍以上

    Dwarkesh 在博客中分析,若 Anthropic 收入延续同比10倍增长并可能在年底达到约1000亿–1500亿美元,而算力每年只增长3倍,就只能靠利润率提升、算力涨价或更高推理占比来填补,其中算力涨价已初现:现货价较2月低点上涨40%以上,Google 据报每月向 SpaceX 支付9亿美元租用11万张 GB200 与 GB300 混合 GPU,约为现货价2倍。

7月2日周四
  1. Dwarkesh Podcast(AI 人物访谈)29

    Dwarkesh Podcast「AI 大问题」征文大赛获奖文章揭晓

    Dwarkesh Podcast 的「AI 大问题」征文大赛共收到 600 余篇投稿,评选出 3 篇获奖文章并公布全文。一等奖 Jassi Pannu 提出将 OpenAI Foundation 运作成消灭空气传播疾病的国家级行动,可解锁 >$1T 年度全球 GDP。三等奖 Michael Li 以香港 MTR 商业模式类比 AI 实验室的盈利方式。

6月30日周二
  1. Dwarkesh Podcast(AI 人物访谈)39

    Grant Sanderson:AI 与数学的未来

    Dwarkesh Podcast 专访 3Blue1Brown 主理人 Grant Sanderson,探讨 AI 在数学领域的进展及其对其它行业的启示。他指出 AI 自 2024 年起 19 秒即可解出 IMO 几何题,靠的其实是暴力求解,但在组合数学题上仍然吃力;他三年前"IMO 金牌只是又一个基准测试"的判断被证实正确。

6月26日周五
  1. Dwarkesh Podcast(AI 人物访谈)37

    下一次重大突破将是 AI 在工作中学习

    AI 的下一次重大突破将是边工作边学习:上下文窗口足够长时,人类员工「入职六个月」的适应期可被装进上下文,无需把部署所学回写进模型权重。实验室押注用数千个 RL 环境中数百万个可验证任务的规模化训练造出 AGI,尽管模型训练期样本效率仅为人类的百万分之一。计算机使用进展偏慢,因该领域不仅要可验证,还需能在可重放的模拟器上大量并行试错。

6月20日周六
6月5日周五
5月22日周五