toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI文章
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,578个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI文章
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策

腾讯混元 Hy3 正式版:比肩 GLM-5.2 的国产 Coding Agent 模型

2026/07/11
·toolin小编

腾讯混元 Hy3 正式版上线,295B MoE 架构、Agent 任务成功率升至 90%,API 价格 1 元/百万 tokens,WorkBuddy 内限时免费试用。

腾讯混元 Hy3 正式版:比肩 GLM-5.2 的国产 Coding Agent 模型
腾讯混元 Hy3 正式版:比肩 GLM-5.2 的国产 Coding Agent 模型
2026/07/11

腾讯混元 Hy3 正式版:比肩 GLM-5.2 的国产 Coding Agent 模型

腾讯混元 Hy3 正式版上线,295B MoE 架构、Agent 任务成功率升至 90%,API 价格 1 元/百万 tokens,WorkBuddy 内限时免费试用。

Hy3 正式版是什么实测:Coding Agent 能力的跃升榜单表现怎么用API 定价适合谁用仍需关注
AI产品
所有文章

作者

avatar for toolin小编
toolin小编

分类

  • AI产品
Hy3 正式版是什么实测:Coding Agent 能力的跃升榜单表现怎么用API 定价适合谁用仍需关注

相关文章

阿里 HappyHorse 1.1 实测:油腻感退了,1080P 还降价 25%
AI产品

阿里 HappyHorse 1.1 实测:油腻感退了,1080P 还降价 25%

阿里发布视频生成模型 HappyHorse 1.1,五大维度升级,1080P 每秒 1.2 元降为 0.9 元,附实测对比与体验地址。

avatar for toolin小编
toolin小编
2026/06/22
百度开源 Unlimited OCR:500M 激活小模型,一口气读完 40 页不失忆
AI产品

百度开源 Unlimited OCR:500M 激活小模型,一口气读完 40 页不失忆

百度开源 Unlimited OCR,3B 总参数 / 500M 激活的端到端 OCR 模型,刷新 OmniDocBench SOTA,单次推理转录数十页文档不失忆。

avatar for toolin小编
toolin小编
2026/06/22
Sakana Fugu:不自己答题,只指挥别的模型干活的编排器
AI产品

Sakana Fugu:不自己答题,只指挥别的模型干活的编排器

Sakana AI 发布 Fugu 系列编排器模型,靠智能调度 GPT、Claude、Gemini 完成任务,性能逼近 Fable 5 与 Mythos Preview。

avatar for toolin小编
toolin小编
2026/06/22

2026 年 4 月,腾讯混元发布了 Hy3 Preview——这是姚顺雨(Shunyu Yao,ReAct 论文一作)加入腾讯后的首秀。当时模型能接住一些真实需求,但 Coding 实测跟同期旗舰还有差距。两个月后,Hy3 正式版上线:在 Agent 和 Coding 能力上有了实质提升,榜单成绩来到 GLM-5.2 附近,办公场景任务成功率从 72% 升到 90%。如果你在找一个性价比高的国产 Coding Agent 模型,Hy3 现在值得一试,而且 WorkBuddy 内还在限时免费。

Hy3 正式版是什么

腾讯混元 Hy3(Hunyuan 3)正式版是 2026 年 7 月发布的旗舰大语言模型,主打 Agent 和 Coding 能力。

核心规格(来自腾讯云官网 cloud.tencent.com/product/tclm):

  • 架构:MoE(混合专家),总参数 295B,激活参数 21B
  • 上下文:最大输入 192K,最大输出 128K
  • 思考模式:no_think、think_low、think_high 三档
  • 定位:面向真实业务场景打磨的正式版

实测:Coding Agent 能力的跃升

根据 APPSO 的实测,Hy3 正式版相比 Preview 在前端网页生成上有肉眼可见的提升。测试用例包含复杂的 3D 网页模拟、严格的游戏逻辑、多框架/库调用。

金门大桥 3D 体验:相同提示词下,Hy3 设计了近距穿梭、中景环绕、高空俯瞰、自动环绕、电影巡游几种视角,桥面、汽车、水面倒影的呈现都比 Preview 更真实。Preview 版交付的则是"一个未完成的中途项目,又粗糙又局限"。

游戏复刻:此前用于测试 GLM-5.2 的多个游戏复刻任务(我的世界、黑神话:悟空、地铁跑酷),现在用 Hy3 基本都能达到同一水平,部分表现更好。黑神话悟空复刻中,GLM-5.2 和 Opus 4.8 偏向 2D 或暗黑风格,而 Hy3 交付了完成度较高的 3D 游戏。

代码项目分析:从 GitHub 拿一篇经典论文的代码交给 Hy3,要求找 Bug 和优化方向。Hy3 主动交付了一份详细 Markdown 报告,清晰列出项目研究内容、已确认的 Bug、潜在 Robust 风险、性能和架构优化方向。此外还能把 Matlab 项目转成其他语言、把 Python 项目转成 Google Colab 的 ipynb 格式、修复自己发现的 Bug。

榜单表现

Hy3 在 SWE-bench、HLE、BrowseComp 等榜单上几乎是预览版之后进步最显著的模型。官方对比中,Hy3 主要对标 DeepSeek V4 Pro、GLM 5.2、Qwen 3.7 Max、GPT 5.5、Opus 4.8、豆包 Seed 2.1 Pro,整体水平来到 GLM 5.2 附近,部分维度超过其他模型。

怎么用

Hy3 可以在两个平台使用:

  • 腾讯元宝:选择快速思考模式,输入明确要求并说明需要的文件类型结果(PPT、Word、Excel、PDF、HTML 等),元宝会自动触发 Agent 能力
  • WorkBuddy(腾讯全场景 AI 工作台):类似 Codex,可直接从本地文件出发处理电脑任务,Hy3 在此限时免费试用

WorkBuddy 测试中,面对复杂工作流,Hy3 的任务规划、长文本信息处理、多工具调用都得到强化,办公场景任务成功率从 72% 升到 90%。

API 定价

Hy3 API 价格在国产旗舰中很有竞争力:

项目Hy3DeepSeek V4 Pro(对比)
输入1 元 / 百万 tokens3 元 / 百万 tokens
输出4 元 / 百万 tokens6 元 / 百万 tokens
输入命中缓存0.25 元 / 百万 tokens0.025 元 / 百万 tokens

输入价格只有 DeepSeek V4 Pro 的三分之一。缓存命中价格 DeepSeek 更低,但标准输入/输出 Hy3 更便宜。

💡 提示:腾讯云联合混元还推出了 Hy3 preview Token Plan 套餐,个人版最低 28 元/月,适合 Agent 开发和长期使用。

适合谁用

  • 前端开发者:Hy3 在 3D 网页、游戏复刻、SVG 动画上的交付质量接近 GLM-5.2 和 GPT-5.5
  • 数据/科研工作者:推理和 STEM 复杂推理能力显著提升,可完成高阶数据分析、科学研究
  • Agent 开发者:API 定价低、上下文长(192K 输入)、任务成功率高,适合构建生产级 Agent
  • 办公场景用户:通过元宝和 WorkBuddy 直接用,无需写代码

仍需关注

官方自己也承认"两个月一更新",有些模型甚至不用两个月就迭代。等 GPT-5.6 全面开放、Gemini 3.5 Pro 上线,基准又是一个新标杆。Hy3 这次完成了肉眼可见的迭代,但能否保持这个更新速度,比这一代模型本身更值得关注。