通义千问 Qwen3.5-Omni 正式发布,支持文本、图片、音视频原生输入。实测具备超强的视觉代码理解能力,可实时解读论文并生成对应代码。


通义千问 Qwen3.5-Omni 正式发布,支持文本、图片、音视频原生输入。实测具备超强的视觉代码理解能力,可实时解读论文并生成对应代码。
这是阿里云开源的最新全模态大模型,性能直逼 Gemini 3.1 Pro。它最大的特点是“原生全模态”,无需通过外部插件即可直接处理复杂的视觉与音频流。
适合需要处理多模态数据、进行实时交互式教学或希望通过视觉引导进行快速原型开发的创作者和研究员。

腾讯发布操作系统级AI助手Marvis,预置6个Agent协同工作,一句话搞定电脑配置、文件处理、系统运维,每天1000万Token免费。

通义千问发布实时同传模型 Qwen3.5-LiveTranslate,支持 60 种语言输入、29 种语音输出,端到端延迟 2.8 秒,实时音色克隆保留说话人原声。

Claude Mythos Preview 帮助 Firefox 团队一个月修复 423 个安全漏洞,含 180 个高危漏洞和多个沙箱逃逸,含藏了 20 年的老 Bug。