Anthropicは、最上位モデルClaude Opus 4.6を公開した。コーディング、長時間のエージェントタスク、大規模コードベースでのレビューやデバッグを強化し、Opusクラスとして初めて100万トークンのコンテキストウィンドウをベータ提供する。企業開発の現場では、単発のコード補完から、複数工程を任せるAIチーム運用へ焦点が移りつつある。
主なアップデート
Opus 4.6は、Terminal-Bench 2.0、Humanity’s Last Exam、GDPval-AA、BrowseCompなど複数の評価で高い性能を示したとされる。GDPval-AAでは、次点モデルであるOpenAI GPT-5.2を約144 Eloポイント上回ったとAnthropicは説明している。
Claude Codeではエージェントチーム機能、APIではコンテキスト圧縮、adaptive thinking、effort制御が追加された。これにより、開発者は知能、速度、コストのバランスを用途ごとに調整しやすくなる。
文脈長 | 1Mトークンをベータ提供 |
|---|---|
API価格 | 入力100万トークン5ドル / 出力25ドル |
開発支援 | agent teams、compaction、adaptive thinking、effort制御 |
業務連携 | Excel強化、PowerPoint研究プレビュー |
日本の開発組織への影響
長文脈モデルは、仕様書、設計資料、ログ、既存コードをまとめて読ませる用途に向いている。保守開発、移行、脆弱性調査、データ分析のように文脈の取りこぼしが失敗につながる仕事では価値が出やすい。
ただし、長い文脈を入れられることと、正しく判断できることは別だ。重要な変更ではテスト、コードレビュー、権限分離を残し、AIに任せる範囲をタスク単位で区切る必要がある。
注意点
高性能モデルは簡単な作業では過剰に考え、コストや遅延が増えることがある。Anthropicがeffort制御を用意したことは、モデル選定が「最上位を常用する」から「仕事に合わせて深く考えさせる」運用へ移ることを示している。
参考:Anthropic発表


.png&w=384&q=75)

