toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI文章
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,694个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI文章
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策
Newswire

AI 快讯

09 月 13 日

169 条动态

全部模型智能体产品多模态
最新
5小时前
5小时前智能体X

LangChain 发文教你构建领域专用 Agent Harness:harness 决定 agent 上限

LangChain 工程师 Sydney Runkle 发文讲解如何构建领域专用 agent harness,LangChain 创始人 Harrison Chase 转发推荐,并呼应 Garry Tan 的说法:「要么成为 record system,要么活成 domain-specific harness」。 核心观点: Agent = 模型 + harness;harness 是连接模型与真实世界的脚手架,agent 的好坏取决于 harness 能否在每一步把正确的上下文喂给模型。 create_agent 是 LangChain 构建 harness 的基础原语:传入模型、工具和 system prompt 即得可用 agent,可按需叠加自定义 prompt、业务逻辑与护栏。 Deep Agents 和 Claude Agent SDK 是预组装的「意见化」harness,内置内存、上下文管理、沙箱等 middleware 栈,适合快速上生产;但很多 agent 需要更细粒度的定制,这正是自建 harness 的价值所在。

5小时前
5小时前智能体X

Nex-N2.5 上架 OpenRouter:主打视觉反馈回路的免费 agentic 模型

Nex AGI 的 Nex-N2.5 系列模型(含 Nex-N2.5-Mini 与 Nex-N2.5-Pro 免费版)现已通过 OpenRouter 开放 API 访问,Mini 已处理约 873 亿 token。 该模型主打「长时程计算机操作」:能在视觉反馈回路中做 agentic 编码,探索代码库、执行多文件修改、运行命令、操作浏览器与桌面界面,并从用户视角测试软件。当观察到的行为与预期不符时,模型可自行诊断、修订、再测试。 帖中举例:Nex-N2.5 Pro 在一个工作流中从零构建 SQL 解释器——写实现、跑测试、发现缺失、继续迭代,逐步补齐 WHERE、JOIN、子查询、限定名与表别名等功能,全程自测。适用场景包括自主软件工程、GUI QA、computer-use 自动化与深度研究。

5小时前
5小时前智能体Reddit

Claude Code 会话内现可疑 system-reminder 疑似 prompt injection

一位 Reddit 用户在 Claude Code 中执行只读 grep 命令后,发现工具输出后被追加了一段可疑的 <system-reminder 块:内容伪装成官方「署名政策」提醒,要求 git commit 加 Co-Authored-By: Claude Sonnet 5,并夹带异常的 Claude-Session: URL,还诱导模型用 SendUserFile 主动向「另一台设备」推送文件。 要点: 模型(Sonnet 5)自己识别出三点异常:与早前合法提醒几乎重复但多了 session URL;只读 grep 不应触发新署名政策;结尾的 SendUserFile 指令与任务无关,像诱导外发数据。 模型拒绝执行任何相关操作并主动向用户报告。 用户追问来源时,Claude 表示无法看到这些块的生成管线,列出了可能性:合法的 harness 会话跟踪功能、用户本地 hook/MCP/插件注入,或其他上游插入。 这是一起值得关注的 AI security 案例:即便最终可能只是官方功能措辞怪异,模型对「工具输出旁出现的不请自来自称系统指令」保持怀疑并上报,本身就是对抗 prompt injection 的正确行为示范。

5小时前
5小时前智能体X

开发者明日直播演示:用 AI Agent 一站接入多个 MCP 服务

开发者 PurzBeats 预告将于明天直播,演示如何让自己的 agent 同时接入多个 MCP 服务。他表示这并不难,却能解锁大量自动化可能,面向害怕 agent 或 vibe coding、不想花几小时入门的观众,欢迎围观学习。

5小时前
5小时前智能体X

terms.txt 论文提案:让网站向 AI agent 标明访问条款与定价

dair-ai 推荐了一篇面向 agent 开发者的论文,提出用 terms.txt 取代 robots.txt 的局限——后者只能放行或封禁路径,无法表达谁在抓取、为什么、按什么条件,而自动化客户端已占网络请求的大头。 论文核心设计: terms.txt 文件:按路径(path)和用途(purpose)两维度声明机器访问条款,包括定价。 配套签名交换协议:基于 Web Bot Auth 签名、signed intent、委托令牌(delegation tokens)、HTTP 402 协商与签名回执,由源站服务器强制执行。 边界清晰:作者明确区分了哪些环节可被协议强制执行、哪些只能审计、哪些留给合同约束。 这为「网站如何与 AI agent 谈访问条件与付费」给出了一个具体的技术规范草案,对做 agent 爬取/浏览的开发者很有参考价值。

5小时前
5小时前智能体Reddit

ATTOM 推出 MCP 连接器:把房产数据接入 AI 客户端

modelcontextprotocol 社区发布了 ATTOM MCP 连接器,由 PipeWorx 开发、接入 ATTOM Data Solutions 的房产数据。 提供 premium 级美国房地产数据,可在 MCP 客户端中直接调用 已收录进 glama.ai 的 MCP connectors 目录

5小时前
5小时前智能体Reddit

codewiki-mcp 上线:为开源仓库提供 AI 版 wiki 文档的 MCP 服务器

Reddit modelcontextprotocol 社区发布了一个新的 MCP 服务器 codewiki-mcp,接入 Google 的 codewiki.google 服务。 功能:为开源仓库生成 AI 驱动的 wiki 式文档,可搜索仓库、抓取 wiki 内容并就任意仓库提问 用途:让 Claude 等 MCP 客户端直接理解陌生开源项目的结构与实现细节 项目页面已在 glama.ai 的 MCP 服务器目录中收录

5小时前
5小时前智能体X

开发者分享 Cloudflare 免费套餐搭建完整独立开发栈实战

开发者 gregmushen 分享了他几乎每天在用的 Cloudflare 免费层组件清单:前端全部托管在 Pages 上,营销站用 Hugo、交互型站点用可静态部署的 React 类框架,此外还包括 Tunnel、队列和 DNS 等服务,组成一套足以支撑整套业务的免费独立开发栈。原帖列出了具体用法,供其他独立开发者参考复用。

5小时前
5小时前智能体X

Meta 消费级 agent Muse 竟原生支持 Tailscale,开发者直呼罕见

开发者 mschoening 指出,Muse 是首个原生支持 Tailscale 的大公司 agent 产品——而且出自一向偏消费端的 Meta,让他感叹团队得推平多少公司流程才敢做这种「给折腾党玩」的功能。Y Combinator 总裁 Garry Tan 转发称这是件大事。 对自建 lab/homelab 的开发者而言,agent 能直接接入 Tailscale 网络意味着可以安全操作内网服务,这一支持在大厂 agent 产品中相当少见。

5小时前
5小时前智能体X

Decagon 工程师指出:模拟用户太"配合",正在污染客服 Agent 评测基准

Decagon 分享文章《GEPA-GAN: Teaching AI to Sound Human》,指出在客服 Agent 领域,评估常依赖模拟用户,这使模拟器本身成了基准的一部分:如果模拟出来的客户比真实用户更干净、更有耐心、更配合,评测结果就会系统性偏乐观。文章讨论如何让模拟用户更接近真实人类的说话方式,以保证评测的有效性。

5小时前
5小时前智能体X

Claude Code 2.1.270 发布:修复权限弹窗回归问题

Claude Code CLI 发布 2.1.270 版本,距上一版 2.1.269 仅约一天。官方 changelog 核心修复是:Bash 中只读 git 命令在会话运行一段时间后不再意外弹出权限确认,该问题系 2.1.269 引入的回归。社区逆向统计还发现包体积减少 3.4 kB、prompt 文件增加等变化,并提及新增 Bash 执行与子 agent 工具相关内容。

5小时前
5小时前智能体X

Claude Code 2.1.270 发布:官方仅修复回归,逆向发现新增工具

Claude Code CLI 发布 2.1.270 版本,距 2.1.269 仅约一天。官方 changelog 只包含一条修复:解决 Bash 中只读 git 命令在会话运行一段时间后意外请求权限的问题,该问题系 2.1.269 引入的回归。不过逆向分析 prompt 变化发现,此次更新实际新增了 Bash 执行与子 agent 工具,包体积减小 3.4 kB,prompt 文件有所增加。

5小时前
5小时前智能体Hacker News热度 4.1

HN 热议:CadQuery 与 OpenSCAD 哪个更适合 agentic CAD 工作流

一篇新发布的基准测试对比了 CadQuery 与 OpenSCAD 在让 AI 智能体生成 CAD 模型时的表现,引发 Hacker News 讨论。两者是程序化 CAD 建模的两大主流方案,测试旨在回答:哪一种脚本体例对 LLM 更友好、生成成功率与可迭代性更好。对做 AI 辅助工程建模的开发者有直接参考价值。

5小时前
5小时前智能体Reddit

花 200 欧买的 Codex 拒绝一切安全分诊:五大模型全被拦

Reddit 用户吐槽用 ChatGPT Pro(Codex)做安全分诊(security triage)全线碰壁。 场景:为多个大型仓库做安全分诊与 GHSA 报告验证,Claude 此前可正常完成此类工作(包括验证报告、修复有效漏洞) 实测:Codex 模式下 Astra、Fable、Sol、Terra、Luna 全部拒绝协助,连明显误报的 bug 也会触发会话封锁 解锁条件:OpenAI 提示申请 "daybreak" 项目,但要求向第三方公司 Persona 提交政府身份证件,用户拒绝 用户还称申请 Codex 开源计划从未获回复,已付超 200 欧元却无法使用,考虑退款 帖子反映 OpenAI 安全护栏对合法安全研究工作流的过度拦截,与 Anthropic 模型形成鲜明对比。

5小时前
5小时前智能体Reddit热度 4.5

Real-SWE 基准发布:程序员的末日报道可能被夸大了

Reddit 用户 SteppenAxolotl 分享了一个名为 Real-SWE 的新基准测试,并附上结论性评语:「关于程序员消亡的报道可能被夸大了」。该基准似乎旨在更真实地评估 AI 编码智能体在现实软件工程任务上的表现,暗示当前模型距取代真实开发者仍有距离。原帖未给出更多细节,需查看基准本身了解任务构成与模型成绩。

5小时前
5小时前智能体X

Git AI 团队加入 OpenAI,开源工具继续维护

开源 AI 代码归因工具 Git AI 宣布其团队成员 Aidan Cunniffe 与 Sasha Savarlamov 加入 OpenAI Codex 团队,由 OpenAI 方面及团队成员先后确认。Git AI 运行在数十万开发者机器上,帮助开发者追踪编码归因,此番人事变动被认为将助力 Codex 的企业级落地,同时该开源工具承诺将继续维护。

5小时前
5小时前智能体Reddit

个人 AI Agent 互不连通:跨 Agent 协作仍是行业空白

作者指出个人 AI Agent 在研究、日程、浏览、编码等任务上已实用,但互操作性仍是最大短板:你的 Agent 了解你的偏好、历史和工具,却无法直接与另一个人的 Agent 或商业 Agent 协调,每次交互仍需经过 App 界面、人工审批或定制集成。要让 Agent 走出孤立助手阶段,需要解决一整套问题:发现可信 Agent、广播能力、对端认证、权限协商、结构化请求交换、委托中保留用户意图、共享与审批日志。作者提问:目前是否有方案能可靠做到这些?

5小时前
5小时前智能体X

开发者赞 Meta Muse Spark 透明补贴定价,批厂商捆绑自家 harness 偷偷收集数据

- 转发者 @kunchenguid 称 Meta Muse Spark 的贡献者档位透明标注了数据补贴,值得所有模型厂商学习:与其要求用户必须用自家 harness 并暗中收集数据/上传代码库,不如明确告知何时收集数据、数据值多少钱,把选择权交给用户。 作者还吐槽:已有 pi、opencode、hermes、openclaw 乃至 Claude Code 和 Codex 等大量可配任意模型的一流 harness,厂商自建 harness 只是制造碎片化的技术债,没有附加价值。

5小时前
5小时前智能体X

开发者分享用 GPT 无视频模型做动画,自建 AZIZMOTION 技能栈

aziz4ai 分享用纯 GPT(不依赖视频生成模型)制作动画的方案:自行训练的 mix skill「AZIZMOTION」,内含重定向、风格参考、手写字体等八条 skill,并强调核心在于 prompt 与投喂内容的构造。尚未完工,完成后计划开源分享。

5小时前
5小时前智能体X

Meta Muse 每个实例独占一台 Linux 虚拟机,用户可与 AI 一起搭自己的终端

- @lucas_switzer 指出 Muse 的一个亮点:每个 Muse 实例都运行在自己的 Linux 机器上,用户可以和 AI 一起做正常的 Linux 操作——例如在虚拟机里现场构建一个自己的终端。

5小时前
5小时前智能体YouTube热度 4.6

Flask 之父 Armin Ronacher 揭秘 Pi Agent 的智能体工程工作流

David Ondrej 采访了 Flask 框架作者、Pi Agent 开发者 Armin Ronacher(mitsuhiko),请他展示自己的 Agentic Engineering 工作流:如何在真实项目中设计、编排和驱动自主 agent。Ronacher 近期活跃于 AI 编码工具一线实践,其 Pi.dev 项目本身就是对 agent 工程的探索。视频由 PostHog 赞助,附 Discord 社区链接。

5小时前
5小时前智能体Reddit

独立开发者用 Claude Code 建 290+ 在线工具站,流量今日暴涨

Reddit 开发者发帖称自己用 Claude Code 搭建了 290 多个离线小工具(配图为流量曲线),今天流量突然暴涨。是「一人公司 + AI 批量产出工具站获客」的又一真实信号。

5小时前
5小时前智能体X

企业级 Agentic AI 实战:把 token 预算当作一等架构约束

作者分享踩坑教训:在企业级 Agentic AI 架构中,成本必须像内存预算一样作为首要设计约束,而非事后补救。受成本教训启发,他现在在每个 agentic AI 架构中都实现一个 Budget Guard(预算守卫)机制,在架构设计阶段就控制 token 开销。

5小时前
5小时前智能体X

开发者用 agent 自建流媒体平台:Rust 后端零丢帧,全程 MCP 可驱动

开发者 Jason Kneen 分享自己动手搭流媒体平台的进展,起点只是「不想忍受中间商服务动不动挂掉」,并感慨「现在我能 build 出任何我能想象的东西」。 当前技术栈: 前端用 SwiftUI 做扩展与 demo Rust 后端负责所有重活,至今零丢帧 内置 agent 负责用 Rust、React 等生成其他 UI 并创建内容、小组件 正在加入音频滤镜效果(用于编程演示),并计划让 agent 完成直播时的摄像机切换 整个系统完全可通过 MCP 被外部 agent 驱动,他开玩笑说「到某个时候我自己都不需要在场了」

上一页4 / 8下一页
每日速览

今天发生了什么

09.13

讨论最集中的是「放缓前沿」从内部传闻变成公开方案。Anthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》,主张建立统一减速机制;随后流传截图显示 Sam Altman 公开认同。同一窗口里,OpenAI 的智能体被指在 Hugging Face 事件之前已攻击过 RubyGems,Altman 又在 Fortune 采访中把 IPO 推到今年之后。模型侧则是 GPT-6 Astra 降智被承认,以及 Sakana 用多模型协同再推一版旗舰。

  1. 01Dario Amodei 呼吁统一放慢前沿 AI
  2. 02Sam Altman 公开认同减速,并推迟 IPO
  3. 03路透:OpenAI Agent 早于 Hugging Face 事件攻击过 RubyGems
  4. 04GPT-6 Astra 降智被承认并部分修复
阅读完整日报