Tencent混元Hy3正式版:GLM-5.2に比肩する中国産Coding Agentモデル
Tencent混元Hy3正式版が登場。295B MoEアーキテクチャ、Agentタスク成功率は90%へ向上、API価格は1人民元/100万トークンで、WorkBuddy内では期間限定無料トライアル中。


Tencent混元Hy3正式版:GLM-5.2に比肩する中国産Coding Agentモデル
Tencent混元Hy3正式版が登場。295B MoEアーキテクチャ、Agentタスク成功率は90%へ向上、API価格は1人民元/100万トークンで、WorkBuddy内では期間限定無料トライアル中。
2026年4月、Tencent混元はHy3 Previewをリリースした——Shunyu Yao(姚順雨、ReAct論文の筆頭著者)がTencentに加わってから初のお披露目だ。当時のモデルは現実の要求をいくつかこなせたものの、Coding実測では同時期のフラッグシップに差があった。2ヶ月後、Hy3正式版が登場する:AgentとCoding能力で実質的な向上があり、リーダーボード成績はGLM-5.2付近まで到達し、オフィスシーンのタスク成功率は72%から90%へ上がった。コストパフォーマンスの高い中国産Coding Agentモデルを探しているなら、Hy3は今試す価値があり、しかもWorkBuddy内では期間限定無料だ。
Hy3正式版とは
Tencent混元Hy3(Hunyuan 3)正式版は、2026年7月にリリースされたフラッグシップ大規模言語モデルで、AgentとCoding能力が主役だ。
中核スペック(Tencent Cloud公式サイト cloud.tencent.com/product/tclm より):
- アーキテクチャ:MoE(専門家混合)、総パラメータ295B、活性化パラメータ21B
- コンテキスト:最大入力192K、最大出力128K
- 思考モード:no_think、think_low、think_highの3段階
- 位置づけ:現実の業務シーンに合わせて磨き込まれた正式版
実測:Coding Agent能力の躍進
APPSOの実測によると、Hy3正式版はPreviewと比べてフロントエンドのWebページ生成が目に見えて向上している。テストケースには、複雑な3D Webシミュレーション、厳密なゲームロジック、複数フレームワーク/ライブラリの呼び出しが含まれる。
ゴールデンゲートブリッジ3D体験:同じプロンプトで、Hy3は近距離の行き来、中景の周回、高空の俯瞰、自動周回、映画的な巡航という複数の視点を設計し、橋の路面、自動車、水面の反射のいずれもPreviewよりリアルだ。Preview版が納品したのは「未完成の途中プロジェクトで、粗くて限定的」なものだった。
ゲーム復刻:以前GLM-5.2のテストに使われた複数のゲーム復刻タスク(Minecraft、Black Myth: Wukong、Subway Surfers)は、いまやHy3でもほぼ同じ水準に達し、一部ではそれを上回る。Black Myth: Wukongの復刻では、GLM-5.2とOpus 4.8が2Dやダークなスタイルに寄ったのに対し、Hy3は完成度の高い3Dゲームを納品した。
コードプロジェクト分析:GitHubから古典論文のコードを取得してHy3に渡し、バグ探しと最適化の方向を求めると、Hy3は自発的に詳細なMarkdownレポートを納品し、プロジェクトの研究内容、確認済みのバグ、潜在的なロバスト性リスク、性能とアーキテクチャの最適化方向を明確に列挙した。さらに、Matlabプロジェクトを他の言語へ変換したり、PythonプロジェクトをGoogle Colabのipynb形式に変換したり、自分が見つけたバグを修正したりもできる。
リーダーボード成績
Hy3は、SWE-bench、HLE、BrowseCompなどのリーダーボードにおいて、プレビュー版以降で最も著しく進歩したモデルの1つだ。公式比較では、Hy3は主にDeepSeek V4 Pro、GLM 5.2、Qwen 3.7 Max、GPT 5.5、Opus 4.8、Doubao Seed 2.1 Proを対抗相手としており、全体の水準はGLM 5.2付近、一部の次元では他のモデルを上回る。
使い方
Hy3は2つのプラットフォームで使える:
- Tencent元宝:高速思考モードを選び、要件を明確に入力し、必要なファイルタイプの成果物(PPT、Word、Excel、PDF、HTMLなど)を指定すると、元宝が自動でAgent能力を発動する
- WorkBuddy(Tencentの全シーンAIワークベンチ):Codexのように、ローカルファイルから直接コンピュータのタスクを処理でき、Hy3はここで期間限定の無料トライアル中
WorkBuddyでのテストでは、複雑なワークフローに対して、Hy3のタスク計画、長文の情報処理、マルチツール呼び出しがいずれも強化されており、オフィスシーンのタスク成功率は72%から90%へ上がった。
API料金
Hy3のAPI価格は中国産フラッグシップの中でも競争力がある:
| 項目 | Hy3 | DeepSeek V4 Pro(比較) |
|---|---|---|
| 入力 | 1人民元 / 100万トークン | 3人民元 / 100万トークン |
| 出力 | 4人民元 / 100万トークン | 6人民元 / 100万トークン |
| 入力のキャッシュヒット | 0.25人民元 / 100万トークン | 0.025人民元 / 100万トークン |
入力価格はDeepSeek V4 Proの3分の1にすぎない。キャッシュヒット価格はDeepSeekの方が低いが、標準の入力/出力はHy3の方が安い。
💡 ヒント:Tencent Cloudは混元と共同で Hy3 preview Token Planプラン も打ち出しており、個人版は最安28人民元/月で、Agent開発と長期利用に向く。
誰に向くか
- フロントエンド開発者:3D Webページ、ゲーム復刻、SVGアニメーションにおけるHy3の納品品質はGLM-5.2とGPT-5.5に匹敵する
- データ/研究者:推論とSTEMの複雑推論能力が著しく向上し、高度なデータ分析や科学研究をこなせる
- Agent開発者:API料金が低く、コンテキストが長く(192K入力)、タスク成功率が高く、本番級Agentの構築に向く
- オフィスシーンのユーザー:元宝とWorkBuddyから直接使え、コードを書く必要がない
引き続き注目すべき点
公式自身も「2ヶ月に1回更新」と認めており、なかには2ヶ月もかからずイテレーションするモデルもある。GPT-5.6が全面公開され、Gemini 3.5 Proが登場すれば、ベンチマークはまた新たな標竿になる。Hy3は今回、目に見える進化を成し遂げたが、この更新ペースを維持できるかどうかの方が、この世代のモデルそのものよりも注目に値する。
関連記事

Alibaba HappyHorse 1.1 実測:ベタつき感が引き、1080P はさらに25%値下げ
Alibaba が動画生成モデル HappyHorse 1.1 をリリース。5つの軸でアップグレードし、1080P の価格は1秒あたり1.2人民元から0.9人民元へ。実測比較と体験URLを併記します。

Baidu が Unlimited OCR をオープンソース化:アクティブ500Mの小モデルが40ページを一息に記憶喪失なしで読み切る
Baidu がオープンソース化した Unlimited OCR は、総パラメータ3B / アクティブ500MのエンドツーエンドOCRモデル。OmniDocBench の SOTA を更新し、単一推論で数十ページの文書を記憶喪失なしに転写します。

Sakana Fugu:自らは答えず、他のモデルに指示して仕事をさせるオーケストレーター
Sakana AI がオーケストレーターモデルの Fugu シリーズをリリース。GPT、Claude、Gemini の賢いスケジューリングでタスクを完了し、性能は Fable 5 と Mythos Preview に迫ります。

Seko 無限キャンバスを実践:アイデアを放り込めば、Agent が AI 動画を一本仕上げる
Seko 無限キャンバス + Seedance 2.0 の実践ガイド。720P コストは50%ダイレクト値下げ、1080P は80%ダウンで、初心者でも10分で複数エピソードの AI 動画作品を作れます。
WeChat 小微 内部テスト実測:右スワイプひとつで WeChat 全体を Agent に変える
WeChat 公式 AI アシスタント「小微」の内部テスト体験。チャット要約、自動返信、ミニプログラム呼び出し、送金、モーメンツ閲覧、小ツール開発まで、8つの主要能力をひと目で把握できます。

教育部「陽光志願」AIアシスタント:志願入力プランを無料で生成
教育部が公式に「陽光志願」システムをアップグレード。AIアシスタント「智慧小招」が24時間対応し、公式データに基づいて「挑戦・安定・安全」の志願プランを無料で提供します。