返回精选推文
宝玉

宝玉

@dotey·2026/09/14·1周前

Apple 今天正式发布了 Siri AI,这是 Siri 自诞生以来最大幅度的重建,也是 Apple Intelligence 迄今为止最重要的落地。https://t.co/NizH38ylDd Siri AI 的核心变化可以用一句话概括:它终于能理解你的个人数据了。过去的 Siri 只能回答通用问题或执行简单指令,新版 Siri 可以跨应用搜索你的邮件、短信、照片,把散落在不同 App 里的信息串起来。Apple 给了一个典型场景:你问家人来访时要一起做什么,Siri 能从你的短信里找到"一起烤个家传食谱"的对话,然后从邮件里翻出亲戚之前发过的做法,再把食材自动加到提醒事项的购物清单里。这种跨应用的信息整合,是之前的 Siri 做不到的。 除了个人数据理解,Siri AI 还有几个值得注意的能力。屏幕感知(onscreen awareness)让 Siri 能看懂你当前屏幕上的内容并据此行动。视觉理解(Visual Intelligence)从 iPhone 扩展到了 iPad、Mac 和 Vision Pro,你可以对着屏幕截图或摄像头画面直接向 Siri 提问。写作工具也直接内嵌到 Siri 里,在任何文本输入框都能让 Siri 帮你起草或修改内容,写邮件和短信时还能模仿你平时跟每个联系人的沟通风格。 Apple 还给 Siri 做了一个独立 App,对话记录通过 iCloud 同步,你可以在 iPhone 上开始一段对话,到 Mac 上接着聊。这个设计说明 Apple 不再把 Siri 当成一个快捷指令入口,而是想让它成为一个持续对话的 AI 助手。 Apple Watch 这次拿到了一组叫"音频智能"(Audio Intelligence)的新功能,需要 Series 12 或 Ultra 4。其中最有意思的是 Live Rewind:双击数码表冠,手表会把刚才对话的最后 15 秒转成文字显示出来。对于听力障碍用户或者开会走神的人,这个功能很实用。还有 Siri Recap,对话结束后自动生成摘要和要点,不过这两个功能要到 2026 年底才会以测试版形式上线,而且初期不支持欧盟地区。 其他零散更新:Image Playground 现在可以生成写实风格图片;Safari 能自动按主题整理标签页,还能根据你的描述创建自定义扩展;快捷指令支持用自然语言描述来创建复杂自动化。 怎么用、什么时候能用?Siri AI 今天起随 iOS 27、iPadOS 27、macOS 27 等系统更新一起推送,更新系统后直接可用,不需要单独下载。唤醒方式和以前一样:说"Hey Siri"、按侧边键,或者从灵动岛下滑。新增的 Siri 独立 App 可以像打开微信一样打开它,翻看之前的对话记录。Mac 上 Siri AI 直接集成在 Spotlight 里,搜索框就能问问题。 硬件门槛方面,iPhone 至少需要 16 系列(或 15 Pro / 15 Pro Max),iPad 和 Mac 需要 M1 芯片及以上。目前 Siri AI 以测试版上线,首批只支持英语,下个月加入法语、日语、韩语、葡萄牙语和西班牙语。中文暂时不在 Siri AI 的支持列表里。Apple Intelligence 本身已经支持简体中文和繁体中文,但 Siri AI 这个新版助手的中文支持还没有时间表。另外,中国大陆因监管要求,Siri AI 和其他新 Apple Intelligence 功能暂时都无法使用。 对 Apple 用户来说,Siri AI 是 Apple 对 ChatGPT、Google Gemini 这波 AI 助手竞争的正面回应。它最大的差异化优势在于 Apple 生态内的深度整合——能调用你所有 App 的数据,这是第三方 AI 助手做不到的。 官方公告:https://t.co/F5icrwUAhV

Tweet media 1
435217.9K

相关推文

DeepMind CEO Demis Hassabis 宣布 Gemini App 用户数已突破 1B,创下其迄今为止最快的增长纪录。

Gemini App 达到 1B 用户了!这是我们有史以来增长最快的产品 🚀 这是一个难以置信的里程碑 —— 向 @JoshWoodward 和优秀的团队表示热烈祝贺!我为我们共同付出的所有努力感到无比自豪。 同时感谢所有优秀的用户的支持,我们迫不及待想看到你们接下来会用它创造出怎样的精彩!

Gemini App1B 用户DeepMind
1.1K596177.8K

OpenAI 宣布推出 GPT-5.5,这是一款专为理解复杂目标和自主完成任务而设计的新模型,现已在 ChatGPT 和 Codex 中上线。

隆重推出 GPT-5.5 这是一种为实际工作和驱动智能体(Agents)而生的新一代智能,旨在理解复杂目标、使用工具、检查自身工作,并能执行更多任务直至完成。它标志着一种全新的计算机工作处理方式。 现已在 ChatGPT 和 Codex 中上线。

Tweet media 1
AI模型GPT-5.5OpenAIAI 智能体
33.8K4.6K1.6K4.5M

Anthropic 发起 Project Glasswing 软件安全计划,由其最新的尖端模型 Claude Mythos Preview 提供支持,旨在精准识别关键软件漏洞。

隆重推出 Project Glasswing:一项旨在帮助保护全球最关键软件安全的紧急行动。 它由我们最新的前沿模型 Claude Mythos Preview 提供支持,该模型发现软件漏洞的能力超越了绝大多数人类专家,仅次于最顶尖的专业人士。 https://t.co/NQ7IfEtYk7

AI模型AnthropicClaude MythosProject Glasswing
19.2K2.7K8907.4M

Lenny Rachitsky 总结了他与 Simon Willison 的深度对话,探讨了 AI 辅助软件工程的演变,涵盖了智能体工程模式、职业影响及安全风险。

我从 @simonw 那里获得的最大心得: 1. 2025 年 11 月是 AI 编程的一个拐点。GPT 5.1 和 Claude Opus 4.5 跨越了一个阈值,编程智能体从“大多能用”变成了“几乎总是能按你预想的执行”。假期里尝试过这些工具的软件工程师们意识到,这项技术已经真正变得可靠了。 2. 中坚工程师最容易受到冲击——不是初级,也不是资深工程师。AI 通过让资深工程师利用几十年的模式识别经验来放大他们的能力。它也极大地帮助了新工程师入职。Cloudflare 和 Shopify 各自雇佣了一千名实习生,因为 AI 将上手时间从一个月缩短到了一周。但那些尚未积累深厚专业知识,又已经吃不到初学者红利的中坚工程师,正处于最不稳定的境地。 3. AI 疲劳是真实存在且被低估的。Simon 同时运行四个编程智能体,到上午 11 点时大脑就完全耗尽了。他节省了更多时间,但同时指挥多个自主工作者带来的强度让他精疲力竭。一些工程师为了保持智能体运行而牺牲睡眠。这可能只是因为新鲜感,但其底层的动态——即管理 AI 即使减少了劳动,也增加了认知负荷——是一种真实的张力。优秀的公司会管理预期,而不是无限期地期待 5 倍的产出。 4. 代码现在很廉价。这个简单的想法有着深远的影响。过去最耗时的事情——写代码——现在耗时最少。瓶颈已经转移到其他方面:决定构建什么、证明想法可行、获取用户反馈。由于原型设计几乎零成本,Simon 在开始时通常会为每个功能构建三个版本。 5. “黑暗工厂”是目前 AI 辅助开发中最激进的实验。一家名为 StrongDM 的公司制定了政策:没人写代码,没人读代码。相反,他们 24/7 全天候运行一群 AI 模拟的终端用户——成千上万的假员工发出类似“给我 Jira 访问权限”的请求——每天花费 1 万美元的 Token 成本。他们甚至让编程智能体根据 API 文档构建了 Slack、Jira 和 Okta 的模拟版本,以便在没有速率限制的情况下进行测试。 6. “红/绿 TDD”是杠杆率最高的智能体工程模式。让编程智能体先写测试,观察它们失败,然后编写实现,再观察它们通过,能产生实质上更好的结果。“使用红/绿 TDD”这五个字的提示词就能编码整个工作流,因为智能体能识别这些行话。 7. “囤积你已掌握的方法”是 Simon 最喜欢的另一种智能体工程模式。Simon 维护着一个包含 193 个小型 HTML/JavaScript 工具的 GitHub 仓库,以及一个独立的编程智能体实验研究仓库。每一个都捕捉了他测试过的一种技术、概念验证或库。当新问题出现时,他可以向 Claude Code 指出过去的项目并说:“结合这两种方法。” 8. “致命三要素”使得 AI 智能体安全问题从根本上无法解决。每当 AI 智能体具备访问私有数据、接触不可信内容(如传入的电子邮件)以及向外部发送数据(如回复邮件)的能力时,你就拥有了“致命三要素”。提示词注入——即不可信文本中的恶意指令覆盖了智能体的预期行为——无法被可靠地预防。Simon 三年来每六个月就预测一次 AI 安全领域的“挑战者号灾难”。虽然还没发生,但他非常确定它迟早会发生。 9. 从精简模板开始每个项目,而不是长篇指令文件。编程智能体在匹配现有模式方面表现极佳。一个包含你偏好的缩进和风格的单一测试文件,比长篇大论的文字指令更有效。Simon 每个项目都从包含一个测试(字面意思是测试 1 + 1 = 2)的模板开始,并按照他喜欢的风格布局。智能体能领悟这一点,并在整个代码库中遵循该惯例。这比维护复杂的提示词文件更便宜、更可靠。 10. “骑自行车的鹈鹕”基准测试意外地成为了一个真正的 AI 基准。Simon 创建它纯粹是为了嘲讽数字基准测试——让每个大语言模型生成一张鹈鹕骑自行车的 SVG 图,然后比较画作。出乎意料的是,画作的好坏与模型在其他所有方面的能力之间存在很强的相关性。没人能解释原因。这已经成为了一个梗:Gemini 3.1 的发布视频中就出现了骑自行车的鹈鹕。AI 实验室对此心知肚明,并正在私下里进行竞争。 不要错过我们的完整对话:https://t.co/ghZZeyvWBZ

AI开发AI 工程编程智能体Simon Willison
6528646169.8K