25年Q1大模型季报:和广密聊当下最大非共识、AGI的主线与主峰
广密在25年Q1《全球大模型季报》提出当下最大非共识:只有Pre-training才能决定模型内在上限、涌现新能力,Post-training+RL只是加强。他对两年内实现AGI有前所未有的信心,认为Coding是数字经济GDP活动最重要的环境,ChatGPT只是山脚第一站,Agent才是正餐。
广密在25年Q1《全球大模型季报》提出当下最大非共识:只有Pre-training才能决定模型内在上限、涌现新能力,Post-training+RL只是加强。他对两年内实现AGI有前所未有的信心,认为Coding是数字经济GDP活动最重要的环境,ChatGPT只是山脚第一站,Agent才是正餐。
这期播客邀请MIT计算机科学与人工智能实验室在读博士松琳,逐篇解读DeepSeek、Kimi与MiniMax发布的三篇注意力机制论文,解析不同模型公司的技术哲学与路线选择。
播客邀请加州大学伯克利分校人工智能实验室在读博士生潘家怡,逐句讲解DeepSeek-R1、Kimi K1.5与OpenAI o1三篇技术报告,聚焦大模型强化学习这一最新技术范式。
Lex Fridman 与 SemiAnalysis 创始人 Dylan Patel、Ai2 研究员 Nathan Lambert 就 DeepSeek-R1 与 DeepSeek-V3 展开长篇对谈。
《张小珺·商业访谈录》专访深言科技创始人岂凡超,这是他第一次接受访谈,讲述其公司在去年融资、估值12亿元人民币后的方向选择。23年下半年公司发现差异化训模型变难而战略转型,产品由5个模型组合构成,试图解决模型输出不确定性。访谈还聊到刚上线的新产品语鲸,以及ChatGPT之后资本环境过山车式的变化。
张小珺·商业访谈录邀请《英伟达之道》译者王亚军对谈,围绕该书作者 Tae Kim 对黄仁勋的专访,解读英伟达如何从 NV1、NV2 的败笔走到 3 万亿美元市值。节目细数英伟达发展的三个阶段、重大战略决策的成败,并聊到黄仁勋的白板文化、Top 5 等治理方式,以及联合创始人普里姆的离开、黄仁勋没有二号位。
Perplexity是过去一年应用端唯一跑出来的AI公司,最新一轮估值达30亿美元,月活2000多万、ARR 2000多万美元,月度环比增长20%以上。节目讨论AI应用为何尚未大爆发、GPT-5为何来得慢(GPT-4o为降成本而插入),并提到OpenAI API过去一年降价10倍,最后点评了OpenAI、苹果、Google、英伟达等美国科技巨头这半年的状态。
MiniMax天使投资人、云启资本合伙人陈昱谈MiniMax的创业、融资与团队幕后,并分享GenAI Summit SF 2024见闻。他称大模型资本扑克牌中巨头是筹码最多的大户,后面几家创业公司的首要课题是融资,自己共5轮投资基本每轮加码。MiniMax由商汤出来的闫俊杰创办,产品从数字人迭代到Glow、海螺AI、星野。
《商业访谈录》第64期邀请拾象CEO广密,对刚过去的2024 Q1全球大模型赛局做复盘与点评。广密提出当前正处于AGI大基建时期,类比上世纪90年代美国信息高速公路建设,认为没有基建就不可能有应用大爆发,并以电加芯片等于产出智能概括智能产出的关键投入。
百川智能创始人兼CEO王小川在张小珺播客访谈中集中回应朱啸虎对大模型创业公司的质疑,提出中国AGI的第三种可能性——"理想上慢一步,落地上快三步",主张TPF(技术与行业现存问题相契合)。他透露百川智能团队已达240人+,规划娱乐、医疗、创造三座模型大楼,并称技术同事想做Sora被他否决。该节目在腾讯新闻首发。
张小珺在播客第60期访谈真格基金的戴雨森和季逸超,围绕OpenAI发布Sora和Google推出开源模型Gemma两件大事,拼凑Sora在人才、算力和数据等方面的实现信息。两人作为投资人和创业者,同时讨论了国内大模型生态与进展,以及戴雨森投资月之暗面和光年之外的思考。
《张小珺·商业访谈录》对话95后创业者宋亚宸,速写95后、00后创业者的群体画像。他1997年生,2021年6月作为早期联合创始人参与创立MiniMax,2022年底创立AIGC 3D公司VAST并获国内知名基金投资。宋亚宸2023年在Siggraph上与英伟达黄仁勋同台发表主题演讲,他认为这代年轻创业者的「马斯克值」拉满,创业偶像已从乔布斯换成马斯克。
《张小珺·商业访谈录》第40期邀请供职GitHub的Kevin和一家美国Top5 VC的Sophia,从技术与投资视角聊硅谷AI的冷与热,ChatGPT诞生后的309天里美国AI形成新共识。节目提出AIGC拉开第二波热潮帷幕、模型不是产品更不是护城河,并谈算力短缺使创投从软件转向硬件、Copilot方向、大型收并购案以及开源与闭源的优劣势。
小冰CEO李笛在访谈中表示,只做大模型不追求商业模式是很难生存的,企业对大模型的商业模式问题不要抱有幻想。他提出模型绝不是越大越好,大、中、小模型应有明确范围界定,并把大模型称为行业第二名的攻击性武器。谈及OpenAI时李笛称"我们是很怂的",并解释自己上半年缄默是因为对狂热者讲理性无异于对宗教狂热分子说话。
OpenAI即将开源大语言模型,Amazon将在1个月内推出大模型和小模型两个model。大模型用于争夺通用大模型的船票,小模型则向垂直领域发力;据The Information曝光,OpenAI即将发布一款全新的开源大语言模型。访谈嘉宾王怀南判断,底层大模型的战争已经结束,不会再有第二家公司拿到通用大模型的船票,垂直领域的壁垒在于数据、社交与商业模式。
傅盛在访谈中谈AI变革、创业、恩怨和心性,坚定认为大模型技术会从高精尖向普及化过渡,"平民化大模型"会诞生。他自2016年起把精力逐步转向机器人和人工智能赛道,并分享这三年遭遇企业危机和市值滑坡的心情与改变。访谈还涉及机器人创业、对周鸿祎的态度以及给年轻人的建议。
李志飞在访谈中称中国大概率不会出现一个跟OpenAI一样的组织,并希望劝大部分人不要去做大模型,包括大佬们。一个月前他曾率先声称要做中国OpenAI,过去一个多月想法有很大改变。节目还回顾了他春节后赴硅谷的见闻、与王慧文的晚餐,以及他预计中国未来会有50家以上大模型公司的判断。
《商业访谈录》与清流资本创始合伙人、前百度技术VP梦秋对谈,聊2023年一级市场投融资风向与ChatGPT大模型热潮。她表示投资人对AI项目看似狂热但出手很理智,截至目前投资标的其实没那么多;她认为大模型总体是大厂的菜,这轮创业资金门槛高、人才密度高、时间漫长,并判断大模型与搜索引擎是补充而非替代关系。
张小珺商业访谈录第18集邀请前Google亚洲区CMO、为Google中国取名“谷歌”的王怀南,对谈ChatGPT来袭后谷歌的紧急应战。节目钩沉上世纪90年代至今的美国互联网往事,Sam Altman、陆奇、Satya Nadella、Jeff Weiner等人物交错其中,并比较雅虎与Google的两种命运、推演大中小公司的格局与高科技军备竞赛。