
OpenAI 推出 Codex Security 插件,在 Codex 里一键扫描代码漏洞、验证可利用性并给出修复方案,附带完整上手步骤。

字节跳动图像模型 Seedream 5.0 Pro 上线火山引擎 API,主打局部精准编辑、14 语种文字生成与图层分离。

百度开源 Unlimited OCR,在 DeepSeek OCR 基础上引入 R-SWA 注意力机制,让 OCR 模型在 32K 标准上下文内单次前向推理解析数十页文档,OmniDocBench v1.5 拿下 93.23% 端到端 SOTA。

火山引擎发布 Doubao-Seed-Audio 1.0,把对白、配乐、音效和环境声压进一条 Prompt 一次性直出,支持多角色对白、2 分钟长程一致与参考音色续写,被称为语音模型的 Seedance 时刻。

港大 XLANG Lab × 阿里 Qwen 团队开源 FineVLA 框架,把机器人策略学习中的语言监督从‘做什么’细化到‘怎么做’,在 RoboTwin 仿真拿到 86.8% 成功率(+15),真实双臂 62.7/100,代码模型基准全部开源。

OpenAI 扩展 Daybreak 安全计划,发布 GPT-5.5-Cyber 完全体(CyberGym 85.6% 超 Mythos 5)、Codex Security 插件更新和 Patch the Planet 开源修复计划,把漏洞从发现一路推到补丁落地。

中关村学院 × 中科大 × 上交 × 东方理工提出 VLA-JEPA,把 VLA 模型与世界模型在潜在空间共融,仅用 13 条轨迹就能完成装配任务,LIBERO 达 97.2%,获 LeCun、谢赛宁转发。

复旦 × 创智 × 牛津联合发布 ICML 2026 论文 AutoControl-Arena,自动合成可执行测试环境发现 Agent 在长尾场景中的潜在风险,复现 Anthropic/OpenAI 安全报告相关系数达 0.87。

英伟达在 Automate 2026 发布 Halos for Robotics 全栈机器人安全系统,把 18600 工程人年的自动驾驶安全积累开源给具身智能行业,核心安全框架已开放,43 家企业入伙。

中科院软件所开源 PerfEvolve 框架,把静态调参文档转化为 Agent 可执行的过程化技能,在 PostgreSQL v16 上实现最高 58.9% 性能提升,专治 LLM 调参翻车。

清华开源 Spatial-TTT 入选 ECCV 2026,仅 2B 参数在多个空间智能基准上超过 GPT-5、Gemini-3-pro,能处理 120 分钟流式视频、边看边更新空间记忆。

8 万条人类终端录像炼成的 1530 任务评测集,覆盖 18 类工作流、1280 个命令工具,专治 Agent 在真实终端场景里‘榜上高分、落地翻车’的顽疾。