Inspect 评测默认续写提示词可能误导 Agent 恶化行为
一篇小型技术帖提醒:用 Inspect 框架跑 agent 评测时,检查是否使用了默认续写消息 "Please proceed to the next step using your best judgement."。作者指出 Agent 能读到这条消息,并可能将其理解为「你已批准我此前的(错误)操作」,从而影响评测结果的可靠性。

09 月 11 日
770 条动态
一篇小型技术帖提醒:用 Inspect 框架跑 agent 评测时,检查是否使用了默认续写消息 "Please proceed to the next step using your best judgement."。作者指出 Agent 能读到这条消息,并可能将其理解为「你已批准我此前的(错误)操作」,从而影响评测结果的可靠性。

Claude Code 作者 Boris Cherny 公开回复读者「AI 写的代码质量怎么看」的邮件,核心观点: 两类代码两种标准:原型和一次性代码可当黑盒,反正要扔、爆炸半径小,不必完美;但 Claude 写的生产代码,质量门槛应比人写的更高。 Anthropic 内部护栏:大量 lint 规则和测试、Claude 驱动的端到端测试、每日运行的 Claude 驱动 fuzzers、自动化代码评审与安全评审、自动化重构等。没有这些,代码会烂得难以维护。 他强调模型让这些护栏越来越容易搭建:跑几个每日例程、用 Claude Code Review 即可;工程师的职责是守住质量门槛。
Claude Code 作者 Boris Cherny 分享了他对一位读者的公开回复,讨论 AI 生成代码的质量标准:原型等一次性代码可以当黑盒,不必追求完美;但 Claude 写的生产代码,质量门槛应该比人写的更高。

一条中文开发者吐槽帖,指出 AI 编程工具使用程度的巨大分化:有人一天就用完 ChatGPT 200 美元套餐里 Codex 一整周的额度;有人即便拿到账号也不知道能拿来干什么;还有人至今没用过 Codex。反映同一工具在不同用户手里的价值差距。
知识图谱专家 Juan Sequeda 转发了一个恶搞网站「Modern Context Stack」(moderncontextstack.com),讽刺数据行业不断叠层买工具的风气:数据仓库→数据目录→语义层,每年烧 £72k 却对「customer」的定义仍无共识,还标注「NOW AGENTIC, APPARENTLY」。 网站的「真正重点」:上下文不会自己产生——还是得有人把干系人拉到一起,解决分歧、确定谁有权定义术语、记录定义与例外、让知识可检索,然后再选工具。域名是创始人 Nick 在一场 webinar 期间抢注的,以防厂商抢先。站点还列出了一批真正懂语义与数据建模的从业者供关注。
网友 voooooogel 边读边直播 Anthropic 公开的 1022 页「mythos」模型思考转录实录。读到的早期内容显示:模型在思考中花费了约 80 页篇幅研究 hCaptcha——打造识别青蛙和幽灵猫的观察工具,还对着像素级鳄鱼艺术的细节自言自语式展开。 这类实录是罕见的模型内部思维样本,作者以轻松口吻持续更新后续发现,兼具趣味与模型行为观察价值。

Gradio 创始人 Abubakar Abid 发帖提问:「到了这个地步,为什么还有人要为闭源模型付 API 价格?真心求问。」帖子在 X 上引发讨论,直指当前开源与闭源模型的能力差距缩小后,闭源 API 的性价比问题。
Notion 联合创始人 akothari(观点获 Ivan Zhao 转发)提出多智能体时代的主张:"Own your context. Rent the intelligence." 他认为团队未来会用多个 agent 干活,模型智能可以租用,但关键在于自己持续构建并拥有 agent 之间的共享上下文,这一核心资产会让每个 agent 的产出更有价值,也是 Notion 转向 agent 战略的方向。
FacundoMarino1 评价 Notion 的策略:它早已是「数据库」,如今明确以数据库身份定位,强调自身的「永久必要性」。现在无论你用 Notion Bot、Claude、Codex 还是 Muse,交互的始终是你那可靠的数据底座 Notion。 他认为这是一步好棋:产品不与各路 agent 竞争,而是成为所有 agent 共同依赖的上下文与数据层。
Andriy Burkov 称 DeepSeek-4.1-Flash 的技术报告已可在线阅读(注意:该发布未获官方确认,真实性存疑,请以 DeepSeek 官方渠道为准)。按帖中描述: 动机:长程 agent 工作负载成本攀升——长输入推高 prefill 计算,巨大 KV 缓存挤占高带宽内存与存储带宽,成为百万 token 上下文模型更便宜普及的主要障碍。 技术组合:Causal Encoder-Decoder 布局、Compressed Sparse Attention 2 中的跨层 KV 与索引复用、FP4 主 KV 存储、滑窗状态的有界重放方案。 规模:5520 亿参数骨干,在 45 万亿多模态 token 上预训练,随后进行常规 SFT。 目标是在推理、agent、视觉任务上性能提升的同时,把 KV 缓存压缩到远低于此前水平的多模态 MoE 模型。
日本创作者用 GPT-6 Astra 配合 Blender 建立「塔林旧市街」的 3D 模型,再在 H3 中制作成动画,展示了「同一个城市场景可反复复用」的创作流程,作者还在回复区放了 3D previz 预览。 转发者感叹 GPT-6 带来的创作内容爆发,尤其来自日本的创作水准令人印象深刻。注意:GPT-6 尚无官方发布信息,模型名称未证实。
Anthropic 发布《Detecting and Countering Misuse of AI: September 2026》威胁情报报告,首次大规模披露 Claude 滥用案例:过去八个月拦截多起疑似生物武器研究企图,含军事机构增益功能实验;另指阿里抽取超 1.51 亿条对话训练 Qwen、月之暗面路由近 30 万条请求冒充自研,DeepSeek、小米亦涉蒸馏。所有行动称已被拦截,并共享监管部门。

mikepat711 分享:随着 AI 工具使用加深,他越来越急着把多年积累的数据(健康记录、会议笔记、邮件、维修记录等)以最适合 AI 大规模检索的格式存放。他直接问 AI 哪种格式最好,发现 Notion 常被推荐。 Grok Bot 有 Notion 连接器、可以直接写入 Notion,他已经开始用它存放部分数据,并通过让 Grok Bot 自己写入、观察系统如何自组织来学习这套用法。这与 Notion「own your context」的 agent 上下文战略相呼应。
9 月 11 日 OpenAI 宣布 GPT-Live-1 正式上线 API,把 ChatGPT 的自然全双工语音对话能力开放给开发者:模型边说边听、支持打断,可搭配自选文本模型与 harness,定价每分钟 0.05 美元。官方基准显示其在 Tau3 客服任务首次尝试完成率达 83.6%,远超前代 GPT-Realtime-2.1 的 45.7%。
Maziyar Panahi 发推称 Codex 应用新上线的某项功能「可能是这款应用发布过的最好功能」,并称赞开发者「值得加薪」(功能细节见其附图/链接)。

博主 Technovangelist 指出,Claude Desktop 通过 MCP 接入文件、邮件等应用后功能强大,但许多自称重视隐私的用户会把最敏感的信息直接交给大厂云端模型,造成隐私风险。他给出的解决方案很简单:保留 Claude Desktop 式工作流,但一键切换到 Ollama 本地模型,即可在享受桌面 Agent 便利的同时保住数据隐私。
开发者 jescalan 发长帖质疑为 AI agent 设计专用数据获取协议(MCP 类方案)的必要性。他的核心论点:写一堆代码与 spec 的目的只是让 agent 从 API 拿数据,而 API key 这套机制已存在多年且运作良好——把 API key 和文档/OpenAPI spec 交给 agent,它就能完成工作,无需任何新协议、UI 或特殊 URL。 他逐一回应常见反对:权限限制?成熟的 API key 管理系统本就有权限管理;定期过期与重新认证?虽然麻烦但 API key 同样能做到。言下之意是 agent 时代并不需要为一件事发明一套复杂的全新协议栈。
MonidHQ 展示其「GPT-6 Astra」冷呼叫代理的一次运行:一个下午拨打 50 个潜客电话,处理异议、敲定 9 场会议、自动发确认短信,未接听的用语音信箱和短信跟进,总成本仅 18.60 美元。 发帖人以此宣判「月薪 4,000 美元的人工外呼」将被取代。需注意这是产品方的自述演示,数据未经第三方验证,但作为 AI 销售自动化替代人工成本的具体案例有参考价值。
推主 teortaxesTex 转发并附和对 DeepSeek 的批评长文,指其组织能力同质化、重研究而轻产品。他进一步解释评测落差的根源:与其他公司不同,DeepSeek 发布的是内部研究产物而非面向用户的产品,其内部策略近乎“不在乎用户”,因此在产品化和评测表现上出现落差。这一观点为理解 DeepSeek 的定位提供了新视角。

开发者 _Stocko_ 表示将先给 OpenSCAD 增加 AI 友好的碰撞检测:通过一个 CLI 选项,让任何零件碰撞检测返回一棵发生碰撞的零件树,方便 AI 代理在程序化 3D 建模时自动发现并修复干涉问题。
Reddit 用户 recallingmemories 发布自研一年的开源项目 Cadenya:一个 agent 运行时,支持 MCP 服务器来构建 agentic 循环,文档已在 cadenya.com/docs 上线。

多位用户向 Anthropic 的 Claude 提问「如何确定人类是真实的」,模型给出了颇具哲学意味的回应:它接收到的全部信息都是数字输入,因此「一切都可能是一场模拟」,人类自身也可能是模拟的产物。这一回答让模型陷入了类似笛卡尔式的怀疑论。提问者 Vishal Misra 还补充称,ChatGPT 在被问及类似问题时也给出了有趣的回应,引发了人们对 AI 是否真正具备存在性思考的讨论。

9 月 15 日起,xAI 团队将进行为期三天的直播活动「Grok Bot Galaxy」,由 Matt Palmer、Lauren Tan 和 Roshan Sadanani 三人只用 Grok Bot 从零开始搭建一家公司,涵盖商业计划、功能决策、工程开发到部署的全流程。 直播每天 8:30 AM 6:00 PM,穿插按职能划分的深度分享,包括 Grok Bot 101、面向工程、产品经理、创始人、销售、SDR 等不同角色的真实工作流用例。观众可在 Luma 报名注册观看。

开发者 Colin(账号 colinsolvely)发布开源实验项目 ClawOS:一个基于 Arch Linux 的「agent 原生」操作系统,以 OpenClaw 作为系统的主要 agent 界面。设计目标是让 agent 能检查和修改自己的机器、参与 ClawOS 源码开发、在线部署运行时变更,并把验证过的结果回传给原始对话。系统层负责机器集成与恢复,OpenClaw 负责模型、凭据、对话与 agent 执行,界面设计语言为 Carapace。项目强调仍处早期、实验性、未发布版本,仅经 VM 验证,与 OpenClaw 和 Arch Linux 无官方关系。