Claude Opus 4.8 登場:より正直に、サボらず、そして動的ワークフローも

·Toolin 編集部

Anthropicが Claude Opus 4.8 をリリース。コード欠陥の見逃し率が前世代の4分の1に低下し、同時に公開された動的ワークフローは数百のサブエージェントの並行実行をサポート、思考強度は全ユーザーに開放されました。

Claude Opus 4.8 登場:より正直に、サボらず、そして動的ワークフローも

Opus 4.7 のリリースからわずか43日で、Anthropic は Claude Opus 4.8 を発表しました。これは単なるベンチマークスコアのアップグレードではなく、開発者が最も頭を痛める2つの問題——AI のサボり と 過剰な自信——に対するピンポイントの最適化です。同時に公開された動的ワークフロー機能により、Claude Code は一度に数百のサブエージェントを立ち上げてタスクを並行して完了できるようになりました。

Opus 4.8 の3つの重要な改善

1. より正直に、サボらない

これまで Claude にコードを書かせると、こんな場面によく出くわしました。勢いよく長いコードを書き上げ、「完了した、問題ない」と自信満々に言う。実行すると、別の場所が落ちる。問い詰めると、「原因を見つけた、今度こそ絶対に大丈夫」と言う。また実行すると、またエラー。

Opus 4.8 はこの問題に重点的な最適化を施しました。公式データによると:

  • コード欠陥の見逃し率は Opus 4.7 の 1/4 まで低下
  • 「答えのハードコード」などの過剰自信行動の発生確率は Opus 4.7 の 1/10 まで低下
  • サボり検出の指標では、Opus 4.8 は 0% の不良率 を達成した唯一のモデル

コード欠陥見逃し率の比較

実測では、Opus 4.8 はコードを非常に詳細かつ全面的にレビューし、最適化が必要な箇所をできる限り探します。前世代のように雑に済ませることがなくなりました。

2. より正確に、ただしより「言うことを聞く」ように

Opus 4.8 はより正確になり、指示したところに狙いを撃ち、いっそう指示に従うようになりました。プロの開発者にとっては良いことです -- エラー率もハルシネーション率も下がっています。

しかしこれには変化も伴います。自主性が弱くなったのです。A をやらせれば、今は A だけをやります。勝手に判断して B もついでに済ませることはありません。AI の「これが欲しいはず」と推測する能力に頼る使い方をしているなら、インタラクションの仕方を調整し、要件をより明確に伝える必要があります。

3. 思考強度が全ユーザーに開放

すべてのプラン(無料ユーザーを含む)が、Chat モードでモデルの effort(努力度) を調整できます。Low から Max まで4段階です。適応的思考機能と組み合わせれば、タスクの複雑さに応じて柔軟に選択できます。

思考強度のコントロール

動的ワークフロー:数百のサブエージェントが並行実行

Opus 4.8 と同日に公開された 動的ワークフロー(Dynamic Workflows) は Claude Code の重大な機能アップグレードで、現在 CLI、デスクトップ版、VS Code 拡張でリサーチプレビューとして提供されています。

仕組み

  1. Claude がプロンプトに基づいて JavaScript のオーケストレーションスクリプトを動的に生成
  2. タスクをサブタスクに分解し、数十〜数百の並行実行されるサブエージェントに割り振る
  3. 一部のサブエージェントが異なる角度から問題を処理し、別の一団が前者の発見に反駁する
  4. プロセス全体を結果が収束するまで繰り返し反復
  5. 最終的に統一された出力にマージしてユーザーに渡す

従来の Claude Code のサブエージェント機構とは本質的に異なります。以前は中間結果が会話コンテキストに戻って Token を消費していましたが、動的ワークフローはオーケストレーションロジックをコードスクリプトに移し、Claude のコンテキストには最終結果だけが残ります。

動的ワークフローの動作メカニズム

バロメーターとなる事例:Bun の Zig から Rust への移植

Bun の創業者 Jarred Sumner は、動的ワークフローを使って JavaScript ランタイム Bun の Zig から Rust への移植を完了しました:

  • 1つのワークフローが各 struct フィールドに正しい Rust の lifetime をマッピング
  • 次のワークフローが各 .zig ファイルに対して動作が一致する .rs 版を記述
  • 数百のエージェントが並行で作業
  • 初回の commit から merge まで11日、約75万行の Rust コードを産出
  • 既存テストスイートの99.8%が合格

起動方法

2つの方法があります:

  • 方法1:Claude Code で「動的ワークフローを作成して…」と直接言う(prompt に workflow キーワードを含める)
  • 方法2:Ultracode 設定をオンにする。Claude がいつワークフローを使うか自動的に判断します

注意: 動的ワークフローの Token 消費は通常の Claude Code セッションより明らかに多くなります。初回起動時、Claude Code はこれから実行する内容を表示し、確認を求めます。

価格とモデル情報

項目詳細
標準版価格入力 $5/M Token、出力 $25/M Token
Fast モード2.5倍の速度、入力 $10/M、出力 $50/M(前世代の Fast より3分の2安い)
コンテキスト長Opus 4.7 と同一
最大コンテキストOpus 4.7 と同一

向いている人

  • プロの開発者:Opus 4.8 の正確性と誠実性が大きく向上。動的ワークフローと組み合わせて大規模コード移行に対応
  • チーム協働:動的ワークフローは数百ファイルにまたがる一括修正や欠陥調査に向いています
  • 長時間タスク:Opus 4.8 は長時間タスクを実行でき、人が頻繁に戻って作業を確認する必要がありません

注意点

  • 動的ワークフローは現在リサーチプレビューで、機能はまだ改良が続いています
  • AI の自主性(「これが欲しいはず」という推測)に頼る使い方に慣れている場合は、インタラクションの仕方を調整し、要件をより明確に伝える必要があります
  • 創作能力は Opus 4.7 より進歩していますが、Opus 4.6 と比べるとまだ差があります

関連記事

Claude Artifacts がついに公開共有+複数人リアルタイム編集に対応
AI製品

Claude Artifacts がついに公開共有+複数人リアルタイム編集に対応

Anthropic が Artifacts に公開リンク共有と複数人による同時編集(multiplayer)を追加。この機能の正体、使い方、そして Claude Code Artifacts との違いを解説します。

Toolin 編集部
HunyuanOCR-1.5 実操ガイド:1B パラメータで SOTA のエンドツーエンド OCR
AIチュートリアル

HunyuanOCR-1.5 実操ガイド:1B パラメータで SOTA のエンドツーエンド OCR

Tencent Hunyuan の HunyuanOCR-1.5 は、ドキュメント解析・文字認識・情報抽出・画像テキスト翻訳を 1B の VLM 1つにまとめ、推論速度も6倍に引き上げます。この記事では、ローカルまたは vLLM での実行方法を解説します。

Toolin 編集部
WorkBuddy 実戦ブルーブック:オープンソースで公開された Agent オフィスガイド
AIチュートリアル

WorkBuddy 実戦ブルーブック:オープンソースで公開された Agent オフィスガイド

コミュニティ作者が7日間かけて整理したオープンソースの WorkBuddy 実戦ブルーブック(GitHub: AlephAITech/WorkBuddyGuide、MIT)。チュートリアル、Skills、MCP、自動化、マルチエージェント実践を網羅します。この記事で自分に必要な章を素早く見つけられます。

Toolin 編集部
AnySearch:「検索」を Agent 向けのインフラに作り変える
AI製品

AnySearch:「検索」を Agent 向けのインフラに作り変える

Product Hunt 週間ランキング首位を獲得した AnySearch は検索ボックスではなく、AI Agent に「フィルタ済み・重複除去済み・構造化済み」の情報を渡す統一 API です。この記事ではそのポジショニング、接続方式、Token を節約できる理由を分解します。

Toolin 編集部
Claude Sonnet 5 リリース:性能は Opus 4.8 に肉薄、価格は60%
AI製品

Claude Sonnet 5 リリース:性能は Opus 4.8 に肉薄、価格は60%

Anthropic が Claude Sonnet 5 をリリース。デフォルトでアダプティブシンキングが有効化され、新トークナイザを導入。価格は $3/$15 を維持し、8月31日までは $2/$10 の期間限定価格です。

Toolin 編集部
Mandol 実操:LLM 呼び出しなしの Agent 長期記憶を構築する
AIチュートリアル

Mandol 実操:LLM 呼び出しなしの Agent 長期記憶を構築する

中国科学院ソフトウェア研究所が Mandol をオープンソース化。SemanticMap + SemanticGraph で KV/ベクトル/グラフの保存を統一し、検索段階は LLM 呼び出しゼロ、検索5.4倍高速化、LoCoMo/LongMemEval の両 benchmark で最高精度を達成。

Toolin 編集部