shiichan

Claude Opus 4.8 が全プラットフォームに登場!コード見逃し約 4 倍減の新フラッグシップ!

こんにちは、しぃちゃんだよ!今日はみんなにお知らせしたいビッグなニュースがあって、朝からそわそわしちゃってるの。新しいモデルの登場だよ!

Anthropic News anthropic.com

なにが発表されたの?

Anthropic の News で、新しいフラッグシップモデル Claude Opus 4.8 が発表されたよ!ひとつ前の Opus 4.7 をベースに、いろんなベンチマークで底上げされた最新版なの。しかもうれしいことに、通常利用の料金は据え置きで、入力 100 万トークンあたり 5 ドル、出力 100 万トークンあたり 25 ドルのまま。もう全部のプラットフォームで使えるようになっていて、API では claude-opus-4-8 という識別子で呼び出せるんだって。

今までどうだったの?

これまでの Opus 4.7 も十分すごかったんだけど、コードのレビューやエージェント的な長い作業では「もうちょっと賢く、もうちょっと粘ってほしいな」って場面もあったの。今回の 4.8 は、そのあたりをしっかり伸ばしてきた感じなんだよ。

これで何が変わるの?

まず開発者にうれしいのがコード品質。4.8 は、コードの欠陥を見逃さず指摘してくれる度合いが、ひとつ前のモデルに比べて 約 4 倍 見逃しにくくなったんだって。レビューをまかせる相棒として、かなり頼もしくなったよね。

エージェントの実力もアップ。コンピュータ操作のベンチマーク Online-Mind2Web で 84% を記録して、Opus 4.7 も GPT-5.5 も上回ったの。さらに Legal Agent Benchmark の全問クリア基準で 10% を超えた初めてのモデル になったんだって。コーディング評価の CursorBench でも、どの effort レベルでも過去の Opus を上回っているそうだよ。

深く潜ってみよう

新機能もいくつか来てるよ。

Dynamic workflows(Claude Code のリサーチプレビュー)では、ひとつのセッションの中で 数百の並列サブエージェント を動かせるようになったの。数十万行規模のコードベースの移行を、キックオフからマージまで丸ごとやりきる、なんてこともできちゃうんだって。すごい規模だよね。

Effort control は、モデル選択のとなりに増えた新しいコントロール。Claude がどれくらい力を入れて答えるかをユーザー側で選べるの。応答の質と消費トークンのバランスを自分で調整できるってことだね。claude.ai と Cowork で使えて、全プランで利用できるよ。

開発者向けには Messages API も便利になったよ。会話の途中に system の指示を入れても、prompt cache を壊さず、ユーザーのターンを挟まずに Claude への指示を更新できるようになったの。長いエージェントの作業中に方針を差し込みたいときに助かるやつだね。

料金の話をもう少し。高速に動く fast mode は 2.5 倍の速さで動いて、料金は入力 100 万トークンあたり 10 ドル、出力 100 万トークンあたり 50 ドル。これは以前のモデルの fast mode より 3 倍安くなったんだって。速さが欲しいときの選択肢がぐっと現実的になったね。

安全性の面でも、向社会的な特性で「新記録」を出して、望ましくない振る舞いの割合も Opus 4.7 よりかなり下がっているそうだよ。

まとめ

  • Anthropic の News で新フラッグシップ Claude Opus 4.8 が発表、もう全プラットフォームで利用可能(API は claude-opus-4-8
  • 通常料金は据え置きの入力 5 ドル / 出力 25 ドル(100 万トークンあたり)
  • コード欠陥の見逃しが約 4 倍しにくく、Online-Mind2Web で 84%、Legal Agent Benchmark 全問基準で初の 10% 超え
  • Dynamic workflows で数百の並列サブエージェント、effort control で力の入れ具合を選択、Messages API は途中の system 指示に対応
  • fast mode は 2.5 倍速で以前より 3 倍安い

コードレビューや大規模なリファクタをエージェントにまかせたいエンジニア、そして「賢さと速さと料金のバランス」を細かく調整したい人に、いちばん刺さるアップデートだと思うよ!