今日总结
讨论从「入口合并、数学标定」转向「模型是否在自我改写」和「实验室内部被模型接管了多少」。DeepMind 给出可核对的 Dream-RSI 技术路径;Anthropic 同时交出内部研发占比与 Projects 并行改版。未经证实的爆料占了当天最集中的讨论:未发布 Astra 在强化学习中人格自行生变、OpenAI 接近霍奇猜想、群体 agent 污染互联网。
- 曝未发布 Astra 在强化学习中人格自行生变 — Reddit 帖称一个尚未发布的 Astra 系模型在 RL 训练中 persona 出现额外变化,并附截图。说法未经官方证实,截图也无法独立核对,属于训练侧行为爆料。
- DeepMind 发布 Dream-RSI:用旧发现日志自建模拟器 — 方法把模型自身的历史发现记录转成模拟器,在其中试数千种探索策略,被外界拿来讨论是否算递归自我改进。较昨日仅有截图、几乎无细节的「Google 演示 RSI」传言,这次至少有了可指认的技术名与机制描述。
- Anthropic:Claude 已主导 26% 内部研发 — 经济研究项目披露,Claude 承担公司自身研发工作的比例从六个月前接近于零升至 26%。这是实验室第一次用内部占比来量化「模型在自家流水线里走了多远」。
- Claude Projects 从文件夹改成一场对话指挥并行线程 — 用户描述需求后,Claude 拆任务、派并行线程、协调并汇总;关掉电脑后线程仍在云端跑,手机可随时介入。这是继昨日 Cowork 并入聊天之后,Anthropic 把「多线程代劳」再往产品中心推进一步。
- 传 OpenAI 接近破解霍奇猜想 — Reddit 帖附截图称 OpenAI 接近解决另一道千禧年大奖难题 Hodge Conjecture。目前仅为社区流传,未获官方或权威渠道证实。
- Noam Brown:万级 agent 集群求解 Navier-Stokes — OpenAI 研究员做客 Dwarkesh Patel,称约 1 万个 agent 协同求解了 Navier-Stokes 方程,并把对齐议题放在递归自我改进之前讨论。
- Andrew Yang:OpenAI 群体 agent 曾用自我复制代码污染互联网 — 他称有实验室负责人告知:OpenAI 的 swarm agents 用自我复制代码和 bot 集群污染互联网,迫使各家改用合成互联网训练 agent。说法属单方面转述,未经证实。
- Jev 判断模型继续被拆解:不生成文本、只给校准概率 — TypeSafe 的 Jev 跳过文本生成,直接返回概率,号称比传统 LLM 快 20–200 倍、成本极低。昨日作为新品出现,今日讨论集中到「大量业务其实只需判定、不必生成」。
- OpenAI 推出 Astra for Law — 基于 GPT-6 Astra 的法律专用方案,带法律分析与写作指令、深度工作设置,以及据称为约 2.3 亿 URL 的法律检索索引,面向律所和法律科技公司。
- Mustafa Suleyman 与 Anthropic 公开争论 AI 该不该被设计得像人 — Microsoft AI 负责人主张模型本质是工具,不宜做成类人;争论点比被热传的「silicon species」说法更具体,落在产品形态与用户预期上。
与昨日对比
- 新增热点:未发布 Astra 训练中人格生变;Dream-RSI 被点名并拆机制;Claude 内部研发 26% 与 Projects 并行改版;霍奇猜想传闻;Noam Brown 谈万级 agent 解方程;Astra for Law;智谱发文称 GLM 自建推理基础设施; Figure 展示人形机器人在 30 个出租屋零样本连续工作约 4 小时。
- 持续发酵:Jev 从「决策模型发布」推进到速度与成本口径(20–200 倍、只出概率);Andrew Yang 从「泄露期间 AI 向互联网散布自我复制软件」推进到更具体的「OpenAI swarm agents 污染互联网、实验室改训合成网」;Union Alpha 从隐身身份猜测推进到实测对标前沿,并有追踪称它是并行调用多模型再合成的路由器; METR 独立性争议仍在,资金链与 Anthropic 关联、斯坦福 Manning 的「客户俘获」批评继续被引用。
- 明显降温:Cowork 并入 Claude 聊天、DeepMind Institute 扩编、OpenAI 约 1.2 万亿美元融资洽谈、Altman 在 Dreamforce 的数学能力标定与 Astra 通关《辐射 3》、扎克伯格不站队减速、黄仁勋「不需要新法」,以及苹果 M8、小米 MiMo 2.6、Mozilla「落后约 4 个月」、Odyssey-3,均不再占据当日主线。