Meta Muse Spark 1.1:100万トークン・コンテキストのAgentモデル、APIパブリックベータ

·Toolin 編集部

MetaがMuse Spark 1.1を発表。agentタスクに主眼を置いたマルチモーダル推論モデルで100万トークンのコンテキストを搭載し、あわせてMeta Model APIの公開プレビューも始まった。

Meta Muse Spark 1.1:100万トークン・コンテキストのAgentモデル、APIパブリックベータ

Metaの超知能研究所(Meta Superintelligence Labs)が Muse Spark 1.1 を発表した——agentタスクに向けたマルチモーダル推論モデルだ。売りは単一のリーダーボードスコアではなく、「超長コンテキスト + マルチモーダル知覚 + agentオーケストレーション + コーディング」を1つのモデルに詰め込み、OpenAI互換のAPIを備えた点にある。あわせて Meta Model APIの公開プレビュー もリリースされており、開発者は今すぐ接続できる。

中核となる位置づけ

Muse Spark 1.1 はagentタスクのために生まれたモデルで、主な能力は次のとおり:

  • ツールとコンピュータ操作:デスクトップアプリの操作、MCPサーバーの呼び出し、カスタムskillの利用ができる
  • コーディング:複雑なバグの診断、エンタープライズ級コードベースでの新機能実装、大規模コード移行の実行
  • マルチモーダル理解:画像、動画、PDF、視覚からコードへの変換、極めて細かい画像/動画キャプション

100万トークンのコンテキスト + 自動圧縮

これはMuse Spark 1.1の最も強力な指標の1つ:1Mトークンのコンテキストウィンドウ。

さらに重要なのは、モデルがこの1Mトークンを能動的に管理できること:

  • それまでに行った操作を記憶する
  • かなり前の作業から情報を検索する
  • コンテキストを自動圧縮し、後続ステップで必要な重要な内容を保持する

agentタスクにとっては、これで「長いタスクの途中でコンテキストが爆発する」というよくある痛みが解消される。

Agentオーケストレーション:メインagent + サブagent

Muse Spark 1.1 はメインagentとサブagentの両方を同時に担えるよう訓練されている:

  • メインagentとして:コンテキストを収集し、計画を立て、実行を並列のサブagentに委譲し、エンドツーエンドのレイテンシを最適化する
  • サブagentとして:自分のタスクに集中し、使えるツールを理解し、いつ問題をメインagentにエスカレーションすべきかを知っている

このマルチagentオーケストレーション能力により、複数アプリにまたがり情報が動的に変わる複雑なワークフローを扱う際、単純に「一歩ずつクリックする」従来のcomputer-useモデルより効率的だ。モデルは、いつスクリプトを書いて自動化すべきか、いつ直接UIをクリックすべきか、いつ操作をバッチ生成すべきかを判断する。

コンピュータ操作能力

Muse Spark 1.1 は、複数アプリにまたがり情報がリアルタイムに変わるcomputer-useシーンで専用の最適化が施されている:

  • 長いセッションの中でコンテキストを維持する
  • 要件の変化に適応する
  • 最小の手作業で未知のUIに対応する

Metaは実際の例を出している:Facebook Marketplace出品agent——スマホで動画を撮ると、モデルが有用な写真を自動抽出し、商品を分析し、ユーザーのブラウザを操作して、ユーザーの代わりにMarketplaceへ商品を出品する。

コーディング能力

実世界の複雑なコードベースタスクでは、Muse Spark 1.1 は初代から大幅に向上している:

  • 複雑なバグの診断と修正
  • エンタープライズ級システムでの新機能実装
  • 大規模コード移行の実行

主要なagentコーディングツールチェーンに対応しており、プランニングモード、ゴール条件付け、サブagent委譲、コンテキスト圧縮などの一般的な機能を備える。Metaのデモでは、モデルがOpenCodeの中にチャットWebアプリを構築した:自動でスクリーンショットを撮ってユーザーに見える不具合を発見し、関連コードまで遡って、修正し、検証する。

💡 ヒント:Replit CEOのAmjad MasadはMuse Sparkをこう評している——「100万トークンのコンテキスト、オールモーダル対応(画像/動画/PDF)、検索と引用の内蔵、強い推論、トップクラスのコーディング(特にフロントエンドとデザイン)、構造化出力、並列ツール呼び出しを、1つのきれいなOpenAI互換パッケージに全部詰め込んだ。完全なagent基盤だ。」

使い方

  • Meta AIアプリ / meta.ai:今すぐ「Thinking」モードで使える
  • Meta Model API(公開プレビュー):開発者が正式に接続可能。OpenAI互換インターフェース
  • サードパーティのコーディングツール:Replit、Cline、OpenClawなどがすでに接続済み

安全性

MetaはAdvanced AI Scaling Frameworkに沿って完全な評価を行い、化学/生物、サイバーセキュリティ、制御不能リスクの3分野をカバーした。結果として、Muse Spark 1.1 はすべてのフロンティアリスクカテゴリで安全な範囲内にあり、ジェイルブレイク攻撃、間接的プロンプトインジェクション、開発者プロンプト攻撃への耐性が比較的強く、幻覚率と追従率も低下した。

誰に向くか

  • Agentアプリ開発者:1Mコンテキスト + マルチagentオーケストレーションで、長いチェーンの自動化に向く
  • コーディングツールチーム:OpenAI互換API + サブagent委譲で、接続コストが低い
  • マルチモーダル知覚が必要なagent:視覚/音声理解と実際の行動を組み合わせるシーン(ユーザーの代わりにブラウザを操作するなど)

参考リンク