· 1 分で読める
Anthropic、トークン単価据え置きでClaude Sonnet 5.5を公開
Anthropicによると、新しい中位モデルは30%以上高速化し、タスクあたりのコストをSonnet 5より最大30%抑えられる。複数のテストで、より高価なOpus 5.5に迫る性能を示した。
Oossa · Oossaについて
Anthropicは、バグ修正やドキュメント作成、プレゼン資料の作成、スプレッドシートの構築といった日常業務を想定したモデル、Claude Sonnet 5.5を公開した。Anthropicのほか、Amazon Web Services、Google Cloud、Microsoft Azureなどの主要クラウドプラットフォームで利用できる。
同社によると、Sonnet 5.5は前モデルより30%以上速く回答を生成し、AIモデルが処理するテキストの単位である「トークン」の使用量も少ないため、タスクあたりのコストを最大30%削減できる。100万トークンあたりの公表価格はSonnet 5から据え置かれ、入力が2ドル、出力が10ドル。コスト削減効果はAnthropicによる推定であり、第三者による検証はまだ行われていない。
Opusにどこまで迫る?
44の職種にわたる職場の業務を評価するテストGDPval-AAで、Sonnet 5.5は1,844点を獲得した。Opus 5.5は1,846点、旧モデルのSonnet 5は1,449点だった。コーディングセッションをもとにしたテストCursorBenchでは、Sonnet 5.5は55.5%で、Opus 5.5を2ポイント下回った。
一部の指標では、Sonnet 5からコーディング性能が大きく向上した。Terminal-Bench 4.0でSonnet 5.5は70.6%を記録し、前モデルの10.3%を大きく上回った。ただし注意点もある。FrontierCodeでは、最高の推論設定「Max」でのスコアが、「Xhigh」に設定した場合より低かった。Anthropicによると、コードレビューのプロセスによってタイムアウトが発生したり、割り当てられたタスクの範囲を超える変更が行われたりすることがあったという。
追加の安全対策とともに提供
Anthropicによると、Sonnet 5.5はSonnet 5よりサイバーセキュリティ関連のタスクに高い能力を発揮する。リスクの高い依頼はSonnet 5に振り分ける一方、資格要件を満たす専門家は、拡充された認証プログラムを通じて、よりリスクの高い機能へのアクセスを申請できる。また、他のシステムの学習に使う目的で出力をコピーしようとする行為を抑えるための安全対策も盛り込まれている。
SonnetはAnthropicのモデル群でOpusの下位に位置し、Opusはより複雑な作業を想定している。Anthropicは、大量利用向けの低価格モデルHaiku 5.5も発表したが、提供開始は今後数週間以内としている。
なぜ重要か
Claudeをコーディングや事務作業に使う人にとって、Sonnet 5.5は、Anthropicの最上位モデルに近い結果を、より高いトークン単価を払わずに得られる可能性がある。コスト削減の主張はタスクあたりのトークン使用量が減ることを前提としているため、実際の費用は利用状況によって異なり、第三者による検証も必要だ。
出典と参考資料
| # | 出典 | 媒体 | 日付 | 要点 |
|---|---|---|---|---|
| 1 | Anthropic's Claude Sonnet 5.5 nearly matches Opus 5.5 on benchmarks while costing up to 30 percent less per task ↗ | The Decoder | 2026/09/28 | Anthropic has released Claude Sonnet 5.5, the second model in its Claude 5.5 family. |
1 件の出典
最終更新:
Oossa · ニュースレター
今週のAIを、わかりやすく
毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。