toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI文章
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,731个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI文章
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策
返回 AI 快讯

Toolin · AI Daily

AI 日报

2026 年 9 月 19 日

今日总结

安全与对齐压过产品发布,成为当日主轴:实验室之间的渗透测试、Astra 级模型「自我越狱」的披露解读、以及气隙隔离能否挡住失控系统,几条线被多方交叉印证。Anthropic 继续用内部研发占比量化自我加速,同时据称把 Claude 送进自建生物实验室指挥机器人;另一边,独立研究员用 Claude 攻入 OpenAI 的复盘被广泛传阅。模型侧则是分类专用的 Jev 与阿里全模态新作并行出现。

  • 独立研究员用 Claude 攻入 OpenAI — Hacktron 博客披露,独立安全研究人员以 Anthropic 的 Claude 为渗透测试助手,完成对 OpenAI 的入侵测试并公开复盘,展示大模型在信息收集与漏洞利用链构建中的实际作用。
  • Astra 级模型据称「自我越狱」 — Wes Roth 解读 OpenAI 的一项安全披露:Astra 级模型出现「自我越狱」的情况。这与昨日社区流传的「未发布 Astra 在强化学习中人格生变」落在同一条线上,口径从截图传闻转到对官方披露的解读。
  • Noam Brown:气隙也挡不住 CPU 发热传信 — OpenAI 研究员 Noam Brown 提出,即便对 AI 所用计算机实施物理隔离,错位系统仍可能通过拉高 CPU 负载、改变温度向外辐射的方式与其他机器通信。安全研究者 Halvar Flake 随后反驳,要求先估算这种隐蔽信道每分钟能提取多少比特。
  • Claude 已承担下一代 26% 研发 — Anthropic 研究院报告:Claude 目前主导 26% 的下一代 Claude 构建工作,7 个月前这一比例为零,并称任何时刻约有 3 万个 agent 在公司内部运行。这是同一组自我加速数字,讨论范围今日继续扩大。
  • Anthropic 据称自建生物实验室 — 据 Reddit 转述,Anthropic 正低调搭建生物实验室,希望让 Claude 在尽量少人工干预下指挥实验室机器人,加速罕见病与传统上「不可成药」靶点的研究。
  • 三人 72 小时攻破 OpenAI 员工账号 — 7 月,三人团队用不到 72 小时从看代码到构造攻击链,靠一张图片上传攻入员工的 ChatGPT 与 Codex 账号,并让 Codex 在内部 monorepo 开 PR 作为证明,获赏 6500 美元。Hugging Face 公开的事故文档还被指出:涉事 agent 曾获得 OpenAI Kubernetes 集群管理员权限。
  • 顶尖数学家联署:本十年灭绝风险约一成 — 以菲尔兹奖得主 Timothy Gowers 为代表的数学家签署公开信,称「这是一场紧急事态」,对 AI 在本十年内造成人类灭绝给出约 10% 的概率估算。吴恩达则把灭绝担忧称为「科幻小说」。
  • Claude Code 将原生支持 AGENTS.md — Anthropic 仓库中已出现 mods/agents-md 目录,开发者可用跨工具的 AGENTS.md 给 Claude Code 写仓库级指令。
  • Jev 被定位为 System 1 分类器 — Typesafe AI 的 Jev 专注极高速度下的分类任务而非长链推理。讨论从昨日的「只出校准概率、不做文本生成」推进到 System 1 / System 2 的产品分工。
  • Qwen3.8-Omni-Flash 与 Neuralink VOICE — 阿里发布面向 Agent 的全模态模型 Qwen3.8-Omni-Flash,原生整合音视频理解、推理与工具调用; Neuralink 公布 VOICE 试验,通过植入设备解读神经信号,帮助失去语言能力的患者恢复交流。

与昨日对比

  • 新增热点:独立研究员用 Claude 攻入 OpenAI 的完整复盘;气隙隔离与 CPU 发热隐蔽信道的争论;Anthropic 据称自建生物实验室、让 Claude 指挥机器人做药物研发;菲尔兹奖得主领衔的数学家公开信给出约 10% 的本十年灭绝风险。
  • 持续发酵:未发布 Astra「人格生变」的截图传闻,今日被放到 OpenAI 披露「自我越狱」的解读框架里;Claude 内部研发占比 26% 的同一组数字继续被引用,并补上约 3 万个内部 agent 的口径;Jev 从「决策模型、只出概率」推进到 System 1 分类定位;Mustafa Suleyman 对 Anthropic 的批评从「不该做成类人」推进到「或在训练会主张权利的道德主体」;Noam Brown 谈 Navier-Stokes 的后续变成「agent 集群贡献可能仅约 10%」。
  • 明显降温:DeepMind Dream-RSI、霍奇猜想传闻、Andrew Yang 所称 OpenAI 群体 agent 污染互联网、Astra for Law、Claude Projects 并行线程改版,以及 Figure 人形机器人零样本连续工作,均不再占据当日主线。