今日总结
今日没有单一压倒性事件,信息面在基础设施、公司动态与「模型好用但不够用」的产能摩擦三条线上并行展开。太空算力从昨日的概念推进到首次实际发射,Nat Lambert 离开 Hugging Face 另立非营利门户、Meta 与一家 AI 安全初创解约,则给「公司和人」线贡献了关键信号;Gemini 4 Argon 的订阅策略争议与 GPT-6.1 Sol 的请求爆满,把「跑分亮眼但撑不住实际负载」的矛盾摆到了台面上。AGI 与安全类讨论同样密集,从马斯克转评会计测试到 Hinton 领衔的智能爆炸发文,都指向「进展速度本身已成为话题」。
- Google 太空算力卫星首飞成功 — Sundar Pichai 回忆团队最初提出「把算力放进太空」时的兴奋,确认与 Planet 合作的原型卫星已由 SpaceX 成功发射并完成助推器回收,是 Project Suncatcher 方向从构想走向实测的标志性一步。
- 马斯克转评:AI 已能拿下会计测试,18 个月前还远不及格 — 他引用一项研究称,18 个月前最强模型仅能达到人类会计师平均分的约 37%,如今已能轻松完成同样任务,研究者本人也形容结果「过于惊人」。
- 前 Hugging Face 研究科学家 Nat Lambert 创办非营利 Trillium Labs — 与长期合作者 Tom Zick 共同发起,押注前沿 AI 的开放科学路线,是今日讨论最集中的「公司和人」话题之一。
- 首个通过「视频图灵测试」的模型?约半数受访者当成真人 — Reddit 用户分享的一段 AI 生成视频对话中,与其交流的人里约一半认为对方是真人,原帖未指明具体模型,引发对 AI 视频通话逼真程度的广泛讨论。
- DeepMind 发布 SynthID Bio,给 AI 设计的蛋白质嵌入隐形水印 — 号称全球首个此类技术,可在不影响蛋白质生物功能的前提下嵌入可识别签名,用于标识 AI 设计的生物学产物。
- 「模型好用但撑不住」的摩擦集中爆发:Gemini 4 Argon 被 Reddit 用户指责「免费 3 个月体验前沿模型」的宣传是诱饵调包,实际对 Pro 订阅者设限;GPT-6.1 Sol 同时被曝请求量爆满,官方称扩容后速度将达此前近两倍。Gemini 争议 GPT-6.1 Sol
- PewDiePie 本地蒸馏 GPT 模型,称遭 OpenAI 两次封号 — Reddit 爆料称其尝试用 GPT 的回答蒸馏出本地模型能力,过程中账号被封,帖子也点出 OpenAI 自身模型同样训练自开放网络数据的讽刺之处。
- Meta 与 AI 安全初创 Virtue AI 解约,合作仅 4 个月 — 官方给出的理由是「工作风格不合」,引发外界对大厂与安全评估类初创合作稳定性的讨论。
- Hinton 领衔发文:递归自我改进引发的智能爆炸或很快到来 — Hinton 称这一想法由来已久,但直到最近才显得迫近,许多顶尖研究者认为它可能在相当近的将来发生,并附上了相关论文链接。
- 斯坦福教授喊话 AI 转行者:进湿实验室先学懂「对照」 — Anshul Kundaje 建议新进入 AI×Bio 领域的研究者花时间与湿实验室人员共事,不只了解实验流程,更要学习「对照」这一核心方法论。
与昨日对比
- 新增热点:Google 太空算力卫星首飞成功;Nat Lambert 创办 Trillium Labs;首个通过「视频图灵测试」的模型引发讨论;DeepMind SynthID Bio 蛋白质水印;Meta 与 Virtue AI 解约;马斯克转评 AI 会计测试表现;Hinton 领衔的智能爆炸发文。
- 持续发酵:Gemini 4 的「跑分还是刷榜」争论从单纯的能力质疑,演变为具体的订阅策略摩擦——Gemini 4 Argon 被指诱饵调包、锁区 Pro 订阅者,同时出现「三强格局已成」的定调评价;GPT-6.1 Sol 从昨日的成本效率测算与增长数据,进入今日的请求爆满、扩容提速阶段。
- 明显降温:昨日头条「OpenAI 疑因泄密开除 3 名安全研究员」与 FT 曝光其 agent 活动横跨 55 家网站的报道,今日均未见后续;Cloudflare 开源决策模型 Clef、Black Forest Labs 发布 FLUX 3 Image 的讨论热度明显回落;Meta 提出的 Context Language Models 今日未见延续报道。