Alibaba HappyHorse 1.1 実測:ベタつき感が引き、1080P はさらに25%値下げ

·Toolin 編集部

Alibaba が動画生成モデル HappyHorse 1.1 をリリース。5つの軸でアップグレードし、1080P の価格は1秒あたり1.2人民元から0.9人民元へ。実測比較と体験URLを併記します。

Alibaba HappyHorse 1.1 実測:ベタつき感が引き、1080P はさらに25%値下げ

6月22日、Alibaba は最新世代の動画生成モデル HappyHorse 1.1(愛称「ハッピーポニー」1.1)をリリースしました。この世代のモデルは5つの能力アップグレードが主役です。ダイナミックな表現力、主体の一貫性、指示追従、視覚的質感、オーディオ能力。技術仕様は 1.0 と同じで——1回の生成は3〜15秒、720p / 1080p 解像度と自由なアスペクト比に対応します。

モデルはすでに Alibaba Cloud 百炼(Bailian)プラットフォームと HappyHorse 公式サイトで公開されています。注目すべき実際の変化は2つ。1つは前世代で批判されていた「ベタつき感」のある画面の問題が明確に改善されたこと、もう1つは 1080P の価格が25%引き下げられたことです。本記事では5つの軸ごとに実測結果を分解し、切り替える価値があるか判断しやすくします。

HappyHorse 1.1:Alibaba の最新世代動画生成モデル

価格:1.1 は 1.0 より安い

解像度HappyHorse 1.0HappyHorse 1.1(通常価格)HappyHorse 1.1(割引後)
720p(1秒あたり)0.9人民元0.9人民元0.54人民元
1080p(1秒あたり)1.2人民元0.9人民元(↓25%)0.72人民元

体験入口:

軸1:ダイナミックな表現力——スローモーション問題の修正

HappyHorse 1.0 が批判された痛点の1つは、一部の画面で動作が緩慢になりテンポ感に欠けることでした。1.1 ではモーションモデリングと時系列の一貫性が最適化されています。

バイク走行のケースでテストします。

  • HappyHorse 1.1:画面の速度は正常で、基本的な物理法則に合致。クローズアップに引くと、スクリーンに反射する景色も比較的理にかなっています。唯一の小さな難点は、バイクのテールランプの光がやや不自然なこと。
  • HappyHorse 1.0:同じタスクで明らかなスローモーションが発生。画面内でバイクが逆走し、ヘルメットの映り込みが実際の画面と一致しません。

結論:動的モデリングについては、この世代は確かに前世代の「スロー再生感」を修正しています。

軸2:主体の一貫性——9枚の参考画像を同時入力

HappyHorse 1.1 は 9枚のキャラクター参考画像の同時入力に対応し、商品のディテール、ブランド要素、キャラとシーンを柔軟に組み合わせられます。マルチカットやN分割グリッドの画像参照といった人気の遊び方に対する理解力も強化されています。

実測では、特定の人物の退職を描いた3枚の参考画像をアップロードし、1.1 と 1.0 にそれぞれ10秒の動画を生成させました。

  • HappyHorse 1.1:人物の顔立ちや服装の特徴を正確に再現し、2つのショットでシーンと人物のディテールが安定して一貫。画面の隅々のディテールまで揃っています
  • HappyHorse 1.0:主体の一貫性はほぼ保たれているものの、画面に現れる物理バグが多い

結論:複数参考画像のシーンでは 1.1 の安定性が明確に優勢で、ブランド IP キャラの連続ショットに向いています。

軸3:指示追従——Seedance 2.0 Mini と一進一退

シュールな無重力カフェのシーンで比較テストを行いました。プロンプトは以下のとおりです。

現代的なデザインのカフェの中で、重力が突然消える。客、テーブルと椅子、本やさまざまな物品がゆっくりと空中に浮かんでいく。バリスタは浮かびながらコーヒーを作り続け、液体のコーヒーがカップから溢れた後に無数の浮遊液滴となる。一匹の茶トラ猫が水中を泳ぐようにゆっくりと空間を横切る。カメラは回転し続け自由に動き、無重力環境全体を見せる。すべての浮遊物体は実際の慣性と運動量の法則に従わなければならず、液体の動きは流体物理の特徴に合致する必要がある。全体として極めて高いリアリティと複雑な物理シミュレーション能力を呈する。

比較結果:

  • どちらもプロンプトの順序どおりにディテールをひとつずつ再現できる
  • HappyHorse 1.1:破綻ショットが多い——人物の表情が固く、画面の中で椅子が何もないところから地面から湧き出ている
  • Seedance 2.0 Mini:真空状態で液体が漂う様子が物理法則にやや合致しないが、人物の表情は全体のスタイルに比較的合っている

結論:極端にシュールで強い物理シミュレーションのシーンでは、1.1 はまだ差をつけられず、最適化の余地があります。通常のショットでの指示追従は安定しています。

軸4:視覚的質感——「ベタつき感」が明確に改善

「中国代表がワールドカップ決勝で1ゴールを決める」画面の生成を要求し、人物が大量にいるシーンでの質感を重点的にテストしました。

  • 1.1 は主要人物の描写において、前世代で頻発した「ベタつき感」と「過度なシャープ化」の問題が減っている
  • ただし画面の背景では人物の顔がややぼやけており、リアリティと動きの感じがやや欠ける

結論:前景の質感は明確に進歩しており、背景の群衆のリアリティは次の段階で補うべき弱点です。

軸5:オーディオ能力——この世代で目立った向上なし

楽器演奏のシーンで 1.1 と 1.0 を比較すると、明確な差はありませんでした——演奏画面の変化とオーディオの変化は依然として噛み合いません。今回のアップグレードで最も弱い項目です。

メリットと適用シーン

メリット:

  • より低価格:1080P が25%値下がり、割引と合わせてコストパフォーマンスが突出
  • 画面の質感改善:ベタつき感、過度なシャープ化の問題が大幅に緩和
  • 複数参考画像の能力が高い:9枚の同時入力で、ブランド IP / 広告シーンに適する
  • エコシステムが完全:公式サイト+百炼 API の2つの入口で、工学的な組み込みが可能

適用シーン:

  • ショート動画クリエイター:3–15秒のストーリー断片やカメラワーク素材を迅速に産出
  • Eコマース / 広告:複数の参考画像で製品広告を作り、主人公と商品の一貫性を保持
  • 長編動画チーム:絵コンテ素材ジェネレーターとして、編集ツールと組み合わせて完成作品に

💡 ヒント:HappyHorse 1.1 のアップグレード幅は、マイナーバージョン更新の想定とほぼ整合しています——前世代で顕在化した実際の問題に対して堅実な最適化を施しましたが、オーディオ同期、強い物理シミュレーション、背景の群衆のリアリティには依然として磨きが必要です。ワークフローがコストに敏感で、なおかつ複数参考画像によるキャラの一貫性に依存しているなら、1.1 は切り替える価値のあるバージョンです。超高リアリティの長編コンテンツが主であれば、Seedance 2.0 Mini との併用をおすすめします。ショットのタイプごとに振り分けましょう。

関連記事

GLM-5.2 の 100 万トークンコンテキスト実測:85 ページのワールドカップ展望を一括生成
AIチュートリアル

GLM-5.2 の 100 万トークンコンテキスト実測:85 ページのワールドカップ展望を一括生成

Zhipu の GLM-5.2 は 100 万 token コンテキスト対応、来週 MIT ライセンスでオープンソース化。85 ページのワールドカップ展望 PPT を実測で完了させ、マルチ agent 並列処理の効率は期待を超える

Toolin 編集部
OpenRouter Fusion チュートリアル:3 モデル組み合わせで Fable 5 を代替、コスト半減
AIチュートリアル

OpenRouter Fusion チュートリアル:3 モデル組み合わせで Fable 5 を代替、コスト半減

OpenRouter の Fusion マルチモデル融合。Kimi K2.6+DeepSeek V4 Pro+Gemini 3 Flash の組み合わせで、DRACO ベンチマークにおいて Fable 5 に性能で並び、コストはわずか 50%

Toolin 編集部
VeraRetouch:0.6BパラメータのAIレタッチモデル、スマホ端末内処理の新手法
AI製品

VeraRetouch:0.6BパラメータのAIレタッチモデル、スマホ端末内処理の新手法

vivoが浙江大学と共同でVeraRetouch軽量レタッチフレームワークを発表。0.6Bの視覚言語モデルをベースに、自動レタッチ・スタイルレタッチ・パラメータレタッチに対応し、iPhone上で13秒で処理を完了します。

Toolin 編集部
GLM-5.2が全ユーザーに開放:1Mコンテキストの中国製コーディングモデル
AI製品

GLM-5.2が全ユーザーに開放:1Mコンテキストの中国製コーディングモデル

ZhipuのGLM-5.2は本当に使える1Mコンテキストをサポートし、性能はOpus 4.8に匹敵。MITライセンスでオープンソース化され、来週APIが提供開始されます。

Toolin 編集部
Kimi K2.7 Code:8分で3案のデザイン、20分で3つのバグ修正
AI製品

Kimi K2.7 Code:8分で3案のデザイン、20分で3つのバグ修正

Kimi K2.7 Codeは並列agent(swarm)をサポートし、thinkingを強制的に有効化。コーディング能力はGPT-5.5やOpus 4.8に迫ります。

Toolin 編集部
Office Raccoon デスクトップ版2.0:10分で任意のブロガーの方法論を分解
AIチュートリアル

Office Raccoon デスクトップ版2.0:10分で任意のブロガーの方法論を分解

Office Raccoon 2.0はカスタムSkillとQuick Barショートカット操作をサポートし、WeChat公式アカウント記事の取得・分析から再利用可能なライティングフレームワークの出力までこなします。

Toolin 編集部