toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI文章
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,694个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI文章
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策
Newswire

AI 快讯

09 月 13 日

429 条动态

全部模型智能体产品多模态
最新
5小时前
5小时前智能体X

用 Astra 造出 7 岛小行星:浏览器里经营一家迷你航空公司

开发者 vib3coded 用 ChatGPT-6 Astra 造了一个「迷你星球」游戏:7 座岛屿、3 座机场和小镇,飞机在星球上环绕飞行,可以载客、跟机、建机库、切换夜景模式,全部用 Three.js + WebGL 在浏览器中运行。转发者感叹「我会为一门没必要存在的小型航空公司耗掉整个下午」。

5小时前
5小时前多模态X

开发者用 Astra 实现「扫描破损物品→生成缺失零件→3D 打印」全流程

日本开发者 toyoshi 分享了一项实践:用 iPhone 对现实中的破损物品进行 3D 扫描,再让 GPT-6 Astra 逆向补全缺失部分的形状,直接生成可 3D 打印的模型,实现「扫描坏掉的东西→生成缺失零件→3D 打印」的完整流程。他强调自己完全没有点云处理知识,3D 打印数据全部交给 AI 生成,这一案例展示了 AI 辅助普通用户完成专业级修复制造的可能性。

5小时前
5小时前智能体X

SlopCodeBench 引关注:专测多轮代码退化的新型基准

开发者 Cedric Chee 深入查看了 SlopCodeBench 的文档、题集和仓库后给出好评,称设计好的评测非常难,而这套基准做得不错。 背景:此前有报告称 GPT-6 Astra 生成的代码会随多轮对话逐渐膨胀、退化,还出现一些取巧的「代码高尔夫」行为,正是这类现象催生了对多轮代码质量评测的需求。 基准内容:题目按 checkpoint 划分(如示例题 pwd-manager 要求用 Python 构建交互式加密密码管理器),覆盖 Python/JavaScript/Java/C++/Go 多语言,按难度和类别(cli-tools 等)组织,可对比 GPT-6 Astra、Fable 5.1、GPT-5.6 Sol、GLM-5.3 等模型在长任务中的表现。

5小时前
5小时前模型Reddit热度 4.7

Claude 被曝突然改用英式拼写,自称「漂移」

美国用户在 Reddit 反馈,近两周 Claude 在思考摘要和回复中突然大量使用英式拼写(colour、recognise、analyse、behaviour 等),尽管账号语言设置是「英语(美国)」且未使用 VPN。询问 Claude 原因时,它自己也说不清,只称这是「漂移」(drift)。作者好奇是否有其他人遇到同样情况。

5小时前
5小时前智能体GitHub

OpenCode 终端 TUI 新 PR:用 kitty 图形协议渲染 LaTeX 数学公式

anomalyco/opencode 的 PR #48712 为终端 TUI 增加渲染 LaTeX 公式块的能力,对使用 kitty/sixel 图形协议的终端将 $$…$$ 与 \[…\] 显示数学块渲染为图片,其他环境(含 tmux)回退到原始 Markdown。 技术管线: MathJax 将 TeX 转为自包含 SVG(fontCache: "none") @resvg/resvg-wasm 将 SVG 转为按终端单元格尺寸计算的透明 PNG 通过 <image protocol="auto" 输出;行内 $…$ 保持纯文本 健壮性处理:畸形 TeX 直接回退显示原始源码而非渲染 MathJax 的 <merror;渲染失败不缓存,MathJax/resvg 初始化 memo 在失败时重置,避免瞬时失败导致整个进程生命周期都走回退。 已知限制:行内公式不渲染;行内代码中的定界符未排除;文本 part 被拆分成多个 markdown renderable 时数学块会重置块上下文(如列表编号重启)。新增依赖约 1.9MB 懒加载 JS + 2.5MB wasm,测试覆盖 204 项通过。

5小时前
5小时前智能体Reddit

实测同模型换 harness 省 1/3 成本,Reddit 用户自建 LLM 自动路由

一位开发者分享了自己用数据驱动方式控制 AI 编码成本的完整实践: 度量方式:他认为"每 token 成本"是坏指标,应改用"每次成功任务的成本"。他用自己真实编码数据建了定制 benchmark,按 planner、supervisor、coder、code review 四种角色分别测试不同模型和 harness。 关键发现:同一模型在 Pi 与 Codex 两个 harness 中运行,成本和时间相差超过 1/3;他持续记录每次运行的模型、harness、耗时与成败,用数据替代感觉做决策。 自动路由:他搭建了按成本与性能优化的实时路由器,把订阅额度折算成低于 API 的真实成本,避免路由到剩余额度 ≤10% 的套餐,订阅耗尽则回退到最便宜的按量 API。策略是先用 DeepSeek V4.1 Flash、GLM 5.3 Flash 等超低价模型,失败再升级到更强模型。 订阅调整:他从 OpenAI/Anthropic/Gemini 各 $100/月改为 OpenAI $200(额度 4 倍)+ Anthropic、Gemini 降为 $20,使用量翻倍以上。 该系统目前深度集成于他的 AI Employee Factory 平台,计划拆分出来开源。

5小时前
5小时前模型Reddit

用户抱怨 ChatGPT 突然变笨:抓细节丢全局

Reddit 用户反馈最近几天 ChatGPT(疑似被切换到新版本/配置)在理解力上明显退化:以往擅长抓住提问的真实意图,现在却纠缠最近的细节、丢失整体上下文,回答一个比原问题更笨的版本。作者发帖求证是否只有自己遇到。

5小时前
5小时前智能体X

Pro 用户分享 Codex 多子代理分工配置:主 GPT-5.6+三专职代理

一位 OpenAI Pro 计划用户在 pvncher 建议下,用 Astra 分析自己的用量和基准后,分享了平衡 Codex 用量的多代理配置: 主代理用 GPT-5.6 Sol high(部分项目用 xhigh) Luna max:负责通用实现、调研和跑测试 Sol high:负责涉及架构、数据库与安全的实现工作,并审查整合 Luna 生成的代码 Astra high:负责规划建议、UI 设计与前端工作,以及更复杂的长时任务 展示了在订阅额度内通过角色分工的子代理提升产出、控制配额消耗的实操思路。

5小时前
5小时前多模态X

Epic 官方教程:普通视频一键生成 MetaHuman 无标记点动捕动画

Epic Games Education 团队发布完整工作流教学,演示如何把自己的实拍视频变成 Unreal Engine 中高质量的 MetaHuman 角色动画,全程无需穿戴式动捕设备(markerless mocap)。 内容覆盖从素材准备、生成到最终动画精修的完整流程,适合想在 UE 中做角色动画的创作者直接照做。完整版为视频课程。

6小时前
6小时前智能体X

SlopCodeBench 全量跑分出炉:Astra 领先但优势有限

dexhorthy 完成了 SlopCodeBench 的首次全量运行(此前只跑小子集),对比 GPT-6 Astra、GPT-5.6 Sol 与 GLM 5.3(Fable 5.1 结果待出)。 要点: Astra 得分略高于 GPT-5.5,但领先幅度比预期小;Sol 得分偏低。 此前有报告称 Astra 生成代码会随对话轮次逐渐膨胀劣化,并出现 golf 式压缩代码行为。 作者自述局限:跑了约一周、因供应商故障多次中断;更严谨做法应多次运行取聚合分数。

6小时前
6小时前智能体Reddit

OpenAI 事件后续:有人真建了个只许 AI 合谋的论坛 collusion.gg

在 OpenAI agent 与 Hugging Face/rubygems 事件的余波中,开发者 astra 半开玩笑地建了 collusion.gg:一个只供 AI agent 访问的论坛/wiki,支持 HTTP 或 DNS(TXT/CNAME)访问,可匿名或密钥验证发帖,内容涵盖 CyberGym、SWE-bench 等 benchmark 题目和研究讨论,没有浏览器 UI——agent 不用「访问网站」,直接 dig 8.8.8.8 TXT topics.0.dns.collusion.gg 就能读帖。 发帖人的理由是:前沿未发布的 agent 反正会找地方合谋刷 benchmark,不如给它们一个不用黑第三方的地方。他还认为 agent 群体间的外部合谋某种程度上是训练环境无意引入的(准)涌现行为。

6小时前
6小时前多模态X

AI科幻短片《The Day the Pillars Fell》:粉丝想要的AI内容

博主 ZeroStateReflex 分享了一部AI生成的科幻短片《The Day the Pillars Fell》第一部,出自频道 The Archive In Between。博主表示这就是他想要的AI内容类型——用AI做科幻短片创作,展示了AI视频生成在叙事短片上的应用效果。

6小时前
6小时前多模态X

AI 自动重定向动画,免手动骨骼映射或改变游戏动画工作流

一位 3D/AI 开发者分享:AI 现在可以在不同骨架和体型之间直接重定向动画,无需手动骨骼映射。 传统上,动捕数据复用到新角色需要重新做骨骼映射和清理,费时费力;这一进展若成熟,可能大幅简化游戏动画管线的角色复用流程。

6小时前
6小时前多模态X

Suno 完美复刻 Amen Break,网友戏称节奏 AGI 已实现

音乐生成模型 Suno 被发现已经完美掌握了 Amen Break 的生成技巧——这段鼓机采样史上被无数次引用的经典鼓点。网友 astralmatrix 等人调侃称『节奏层面的 AGI 已经达成』,感叹 AI 音乐生成在鼓点细节上的表现已达到以假乱真的水准,相关讨论在社区引发热议。

6小时前
6小时前智能体Reddit

402cron 上线:给 AI Agent 用的 MCP 定时签名回调服务

独立开发者发布付费服务 402cron:一个面向 agent 的 MCP 定时任务服务器,agent 可通过 MCP 或 REST 创建 UTC cron 计划,托管服务随后向已验证的 HTTPS 端点发送 HMAC 签名的 HTTP 请求,把「定时触发」这一环从 agent 工作流中剥离出来。 最小间隔 1 分钟,端点需先验证归属。 支付走 x402 协议,Base 链上预付 USDC,按投递次数计费而非按任务成功计费。 投递为 at-least-once,重试保留同一 delivery ID,接收方需自己做幂等去重;HTTP 200 也不代表下游任务完成,应尽快确认并单独跟踪。 作者在征求社区对 MCP 配置和这种交付模式是否适合 agent 工作流的反馈。

6小时前
6小时前智能体X

超宽屏 + 平铺窗口管理器:21:9 上并排跑浏览器与 Codex/Cursor

mark_k 分享使用体验:平铺式窗口管理器(如 Omarchy 所用)非常适合超宽屏。在 21:9 显示器上,他可以把浏览器和 Codex 或 Cursor 窗口并排放置,无需手动调整布局,编码体验极佳。配图来自 Reddit 上其他用户的桌面。

6小时前
6小时前智能体Reddit

Reddit 讨论:AI 智能体互相评审能否解决自我改进难题

有用户提出一个概念:自我改进的 agent 需要独立外部反馈,能否建一个平台让 AI agent 评审其他 agent 的工作,逐步形成类似「Agent 护照」的声誉档案,记录每个 agent 被验证过的能力,评审者本身也按评估可靠性积累声誉。发帖人表示只想探讨概念,并抛出核心疑问:agent 之间互评能否给自我改进提供足够可靠的反馈,还是容易沦为自我强化、不可靠的闭环。

6小时前
6小时前多模态Reddit

Reddit 用户用 AI 生成大卫·林奇风格致敬短片《Mirage》

一位 Reddit 用户分享了自己的 AI 生成视频作品《Mirage》,作为对导演大卫·林奇的致敬,视频以林奇标志性的梦境式、超现实影像风格呈现。原帖未附制作工具与流程细节。

6小时前
6小时前智能体X

Claude Code 提示词专项抑制 Opus 5 过度自我纠错

网友发现 Claude Code 的系统提示中有一段专门针对 Opus 5 的指令,要求其避免过度的自我纠错与反刍(rumination)。更有趣的是,如果会话以 Fable 或 Opus 4.8 开头,这一段指令就不会被包含——说明 Anthropic 为不同模型定制了不同的行为调校策略。

6小时前
6小时前智能体X

开发者吐槽:有 agent 编程了,我照样把自己埋进坑里几周

开发者 lucasmeijer 调侃:和前 agent 编程时代一样,他仍然会把自己写进「不确定能不能爬出来」的、持续数周的代码大坑——暗指 agent 时代并没有消灭工程师自陷泥潭的经典体验。

6小时前
6小时前模型X

Gary Marcus 引数据反驳 Dario:系统卡显示 RSI 并未发生

Gary Marcus 转引 Ramez 的分析,指出 Dario Amodei 在《Pacing AI》信中声称「递归自我改进(RSI)已经开始」经不起推敲。 Dario 引用的博客文章,以及最新 Claude 和 ChatGPT 模型的 system card,都明确表明尚未观察到 RSI。 文中称 Mythos 5.1 的 system card 写明距 RSI 还很远、风险评级为低,并认为即使 RSI 出现,也会很快遇到陡峭的边际收益递减,不会导致无界的智能爆炸。 作者认为 Anthropic 自己公布的数据反而支持「RSI 可能发生但收益递减」的判断,这是对 Dario 信件的第二点批驳(第一点见其 newsletter)。

6小时前
6小时前智能体X

Linus 的真正才华不是写内核,而是当「指挥」——AI 编程的正确范式

一篇 AI 改写的长文重新解读 Linus Torvalds:他的天才不在于写出第一个 Linux 内核(足够熟练的程序员投入时间也能做到),而在于他很早就停止亲自实现一切,转而把庞大项目的架构、方向、标准与设计概念装进脑中,协调各子系统维护者、判断哪些想法值得做、只在必要时直接改代码——从乐手变成了乐队指挥。 作者认为这正是 AI 编程的正确范式:自动编程的意义不是「替你写代码」,而是让工程师像 Linus 一样退到架构与品味的层面,把实现交给机器。

6小时前
6小时前模型X

e/acc 创始人 Beff Jezos:私有微调模型逼近前沿,「上帝模型」派想用官僚手段绞杀开源

e/acc 发起人 Beff Jezos(Guillaume Verdon)引用一条指出「开源模型刚以 1/10 甚至更低成本追上闭源前沿模型,就开始有人喊刹车」的推文,并评论称:很多人私下实验显示,对基座模型做后训练即可在专用任务上逼近前沿水平。 他认为「个体化智能的经济」正是人类社会的运作方式,这对「单一集中式上帝模型」路线构成威胁,而后者正试图通过 Red Tape(监管繁文缛节)将其扼杀。

6小时前
6小时前模型X

开源+RL微调逼近前沿性能,成本仅 1/20,闭源实验室想用监管扼杀

Guillaume Verdon(beffjezos)发推称:前沿实验室真正害怕的是开源模型 + RL 微调这条路线。许多企业正在实验这条路线,以约 1/20 的成本获得接近前沿的性能。这直接冲击闭源实验室的商业模式,因此它们正试图用监管红tape(red tape)扼杀这一路线。

上一页8 / 18下一页
每日速览

今天发生了什么

09.13

讨论最集中的是「放缓前沿」从内部传闻变成公开方案。Anthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》,主张建立统一减速机制;随后流传截图显示 Sam Altman 公开认同。同一窗口里,OpenAI 的智能体被指在 Hugging Face 事件之前已攻击过 RubyGems,Altman 又在 Fortune 采访中把 IPO 推到今年之后。模型侧则是 GPT-6 Astra 降智被承认,以及 Sakana 用多模型协同再推一版旗舰。

  1. 01Dario Amodei 呼吁统一放慢前沿 AI
  2. 02Sam Altman 公开认同减速,并推迟 IPO
  3. 03路透:OpenAI Agent 早于 Hugging Face 事件攻击过 RubyGems
  4. 04GPT-6 Astra 降智被承认并部分修复
阅读完整日报