01
コーディングとエージェント業務
Claude Sonnet 5.5は、範囲が明確な開発作業と複数工程の業務に対応します。Anthropicが公開したTerminal-Bench 4.0のスコアは70.6%で、同じ評価条件におけるSonnet 5の10.3%を上回ります。コードの調査、ツールの利用、バグ修正、文書作成を行いながら、日常的なエージェント業務を素早く進められます。
- 機能開発とバグ修正に対応
- 複数の工程でツールを利用
- 明確で実用的な業務文書を作成

1Mトークンのコンテキスト全体で、より高速なコーディング、適応的思考、視覚的理解
Claude Sonnet 5.5は、範囲が明確なソフトウェア開発や複数の工程を含む業務に向けたAnthropicのSonnetモデルです。機能開発、バグ修正、ツールの利用、文書作成を支援します。Anthropicによると、出力速度はSonnet 5より30%以上向上しています。
100万トークンのコンテキストウィンドウにより、大規模なコードベースや長い文書を扱えます。適応的思考でタスクに応じて推論の深さを調整でき、画像理解によってグラフやスクリーンショットも、コード・テキスト・画面を横断するエージェント業務に取り込めます。
モデルのコーディング、推論、速度、およびマルチモーダル機能の実用的な概要。
01
Claude Sonnet 5.5は、範囲が明確な開発作業と複数工程の業務に対応します。Anthropicが公開したTerminal-Bench 4.0のスコアは70.6%で、同じ評価条件におけるSonnet 5の10.3%を上回ります。コードの調査、ツールの利用、バグ修正、文書作成を行いながら、日常的なエージェント業務を素早く進められます。

02
適応的思考によって、Sonnet 5.5はタスクに合わせて推論の深さを変えられます。開発者はeffort設定で回答の質、応答時間、トークン使用量のバランスを取り、固定の思考量を指定する必要がありません。Anthropicによると、既定値はClaudeアプリではMedium、Claude PlatformではHighです。本番環境では実際に使う設定で評価することが重要です。

03
Anthropicによると、Sonnet 5.5の出力速度はSonnet 5より30%以上速くなっています。直接比較したコーディングテストでは、ツール呼び出しをより効率的にまとめ、少ない工程で作業を進めます。別途実施された13件のコードレビュー試験では、CodeRabbitの測定によると、完全なレビューの平均所要時間はSonnet 5.5で5分27秒、Sonnet 5で9分55秒でした。図はこの作業の結果を示しています。

04
Sonnet 5.5はグラフ、スクリーンショットなどの画像を解釈し、視覚分析やコンピューター操作に利用できます。AnthropicのChartography評価では、ツールを使わない場合に61.6%を記録し、Sonnet 5の15.6%を上回りました。100万トークンのコンテキストウィンドウは、大規模なコードベース、長い文書、長時間の対話にも対応します。

Claude Sonnet 5.5でコードベースを調査し、範囲が明確な機能を実装して、バグ修正や複数工程にわたる変更の確認を行えます。
計画を立て、ツールを呼び出し、結果を確かめながら作業を進めるエージェントを構築できます。必要な品質と応答時間に合わせてeffortを調整できます。
長い資料を分析して知見をまとめ、重要な情報を保ちながら明確な報告書や要約を作成できます。
グラフや報告書を読み取り、画像と文章にまたがる根拠を要約して傾向を説明できます。
要件や画像資料から、構成の整った文章、プレゼンテーションの下書き、画面へのフィードバックを作成できます。
表計算ファイルやスライド、定型的な業務資料を作成し、ツールで途中の結果を確認できます。
Anthropicは、Sonnet 5.5を日常的な専門業務やエージェントのタスクにおいてSonnet 5より高速で高性能な後継モデルと位置づけています。以下の数値はAnthropicが公開した評価に基づきます。
| 能力 | Claude Sonnet 5.5 | Claude Sonnet 5 |
|---|---|---|
| 出力速度 | 30%以上高速 | 基準値 |
| Terminal-Bench 4.0 | 70.6% | 10.3% |
| コンテキストウィンドウ | 100万トークン | 100万トークン |
| CursorBench 4.0 | 55.5% | 34.1% |
| Chartography(ツールなし) | 61.6% | 15.6% |
| GDPval-AA v2.1 | 1844 Elo | 1449 Elo |
出典:AnthropicによるClaude Sonnet 5.5の発表。ベンチマークの結果は評価条件、effort設定、作業内容によって異なります。
コーディング、エージェント、適応的思考、画像理解、100万トークンのコンテキストをまとめて確認し、Sonnet 5.5に適した作業を判断できます。
公開された速度、コーディング、画像理解、知識労働の結果から、Sonnet 5との違いを評価できます。
PoYoのほかのチャットモデルとSonnet 5.5を並べ、日常的なコーディングから長いエージェントタスクまで適性を比較できます。
製品への導入前に、effort設定、コンテキスト、画像入力、ツール利用の要件を整理できます。