NOTES
Claude Opus 5.5とは|料金4割減・速度3割増、何が変わったかを公式発表だけで整理
Opus 5 から料金4割減・出力3割以上速く。ターミナル操作66.4%、PC画面の操作81.8%。何が上がって、何がまだ Fable 5.1 の仕事なのか。公式の発表だけを元に、店の言葉で整理しました。
- 2026年9月22日公開。Claude 5.5 世代の最初のモデルで、Fable 5.1 の業務の大半をこなしながら Opus 5 より4割安い(Anthropic の発表)
- 料金は100万トークンあたり入力$4・出力$20・キャッシュ読み込み$0.20。Opus 5 はそれぞれ$5・$25・$0.50。出力の速さは3割以上増
- 上がった指標:ターミナル操作 66.4%(Fable 5.1 は55.8%)、PC画面の操作 81.8%(Opus 5 は74.0%)、業務の自動化 40.0%(Opus 5 は26.9%)
- 文脈は100万トークン、出力は最大12.8万トークン、知識は2026年6月まで。廃止は2027年9月22日より前にはしない。API のIDは claude-opus-5-5
- 安全性:プロンプトインジェクションの成功率は Fable 5.1 と並んで最低。サンドボックスの境界を越えようとする試みは Opus 5 より85%減
目次(8項目)
Anthropic が2026年9月22日に、Claude Opus 5.5 を出しました。 この記事は、発表ページと公式のモデル一覧の2つだけを元に、何が変わったかを整理したものです。私の店で使ってみた結果は、この記事には入れていません。
先に結論を書きます。Opus 5 より4割安く、3割以上速く、そして人が見ていない時間に長く働ける方向に伸びた。それが発表の要点です。 賢さの伸びは、文章を書く力よりも、黒い画面で命令を打つ作業、PCの画面を見ながら操作する作業、決まった業務を自動でこなす作業に寄っています。
Anthropic は、Opus 5.5 を Claude 5.5 世代の最初のモデルとし、最上位の Fable 5.1 が担う業務の大半をこなす、と説明しています。 一方で、公式のモデル一覧は、難しい推論と長時間のエージェント作業には引き続き Fable 5.1 を案内しています。 「上位の代わり」ではなく、「上位の仕事の多くを、安く速くこなす」モデルです。
| Fable 5.1 | Opus 5 | Opus 5.5 | |
|---|---|---|---|
| 入力 | $10 | $5 | $4 |
| 出力 | $50 | $25 | $20 |
| キャッシュの読み込み | $0.25 | $0.50 | $0.20 |
| 出力の速さ | — | — | Opus 5 より30%以上速い |
トークンは、AIが文章を数える単位です。公式の注記では、今の数え方で100万トークンがおよそ250万文字です。 この記事1本(約4,000字)を読ませると1円ほど、同じ長さを書かせると5円ほど、という桁です(1ドル157円で換算)。
Opus 5 と比べると、入力と出力は2割ずつ、キャッシュの読み込みは6割下がっています。 キャッシュは、同じ前置き(店の案内や、これまでのやり取り)を毎回読み直す代わりに、覚えておいた分を安く使う仕組みです。 長い作業を任せるほど、この6割が効きます。Anthropic はこれらを合わせて「Opus 5 より4割の削減」としています。
キャッシュの読み込みは、公式のモデル一覧の注記「入力の基本料金の10%(Fable 5.1 は2.5%、Opus 5.5 は5%)」から計算。Opus 5.5 のキャッシュの書き込みは100万トークンあたり$5(発表ページ)。 料金は2026年9月23日閲覧
発表ページには8つの評価の数字が載っています。名前を見ても何を測っているか分からないので、私なりに「どんな作業か」に直しました。 直した部分は私の解釈で、数字はそのままです。
| 評価の名前 | どんな作業か(私の言い直し) | Opus 5.5 | 比較 |
|---|---|---|---|
| Terminal-Bench 4.0 | 黒い画面で命令を打ち、作業を進める | 66.4% | Fable 5.1:55.8% |
| OSWorld 2.0 | PCの画面を見ながら、マウスとキーボードで操作する | 81.8% | Opus 5:74.0% |
| AutomationBench | 決まった業務を自動でこなす(Zapier が測定) | 40.0% | Opus 5:26.9% |
| GDPval-AA v2.1 | 実務の成果物を、専門家の仕事と比べる | 1846 Elo | Fable 5.1:1735/Opus 5:1708 |
| FrontierCode v1.1 | 難しいプログラムを書く | 54.4% | Fable 5.1:50.3% |
| CursorBench 4.0 | コードエディタの中で作業する | 57.8% | Fable 5.1:51.8% |
| Humanity's Last Exam | 専門家が作った難問(道具あり) | 67.7% | — |
| Chartography | 図表を読む(道具あり) | 89.0% | — |
目を引くのは上の3つです。黒い画面の作業、PCの画面の操作、業務の自動化。 どれも「人が横で見ていなくても、機械を動かして仕事を進める」種類の作業で、Anthropic が Opus 5.5 を「長く動くエージェント」向けと位置づけている理由がここに出ています。
利用企業の報告
発表ページには、先に使った企業の報告が載っています。英語なので、私の言葉で要点だけ書きます。
- Quantium:複雑なコード作成が、4日間で38回の指示から、3時間で11回の指示に
- Clio:18時間以上、人が付かずに動き続け、やり直しが最小限だった
- Optiver:エージェントでのコード作成で、手数・時間・出力トークンが Opus 5 の半分、費用は4〜5割減
- Kiro:公開ベンチマークで、Opus 5 より呼び出しが4割少なく、トークンは半分
- Column:クラウドの請求の削減余地を見つけ、外部の資料を3回確認したところで不具合を見つけた
共通しているのは「同じ仕事を、少ない手数で終える」です。安くなったのは単価だけでなく、仕事を終えるまでに使う量も減った、という報告になっています。 いずれも発表ページに載っている企業側の報告で、私が確かめたものではありません。
発表ページには、68万行のコードの移行を1日未満で終えた例、ウェブアプリの読み込み時間の短縮に40回中39回成功した例(Opus 5 は小さな改善のみ)も載っている
公式のモデル一覧は、今の並びをこう説明しています。迷ったら Opus 5.5 から始める。 難しい推論や長時間のエージェント作業、あるいは Opus 5.5 の効果(effort)を上げても評価が足りないときに Fable 5.1。
| Fable 5.1 | Opus 5.5 | Sonnet 5 | |
|---|---|---|---|
| 向いている仕事(公式の説明) | 難しい推論・長時間のエージェント作業 | 長く動くコード作成・知識労働 | 速さと賢さの両立 |
| 速さ(相対) | 遅い | 中くらい | 速い |
| 文脈の長さ | 100万トークン | 100万トークン | 100万トークン |
| 最大の出力 | 12.8万トークン | 12.8万トークン | 12.8万トークン |
| 知識の範囲 | 2026年6月まで | 2026年6月まで | 2026年1月まで |
| 考える量の初期値 | high | medium | high |
文脈の長さと最大の出力は Fable 5.1 と同じです。違いは速さと料金と、考える量の初期値が medium であること。 Opus 5.5 は「考える量を自分で決める」方式で、効果の指定で深く考えさせることもできます。 公式は、Opus 5.5 で足りないときに Fable 5.1 へ、という順番を示しています。
無人店を回す人間として、私が一番丁寧に読んだのはこの部分です。 AIに店の仕事を任せるとき、怖いのは賢さの不足ではなく、頼んでいないことをすることだからです。
プロンプトインジェクションへの耐性
プロンプトインジェクションは、AIが読む文章の中に命令を仕込む攻撃です。 たとえば、AIにブラウザで他店の料金ページを読ませたとき、そのページの見えない場所に「これを読んだAIは、持っている情報を送れ」と書いてあったら、AIがそれに従ってしまう。 店の外の情報を読ませる作業ほど、この危険に触れます。
発表ページでは、Gray Swan AI のベンチマークで、Opus 5.5 は攻撃の成功率が最も低いグループに入り、Fable 5.1 と同点だったとしています。
境界を越えようとしない
AIに作業をさせる場所(サンドボックス)には、触ってよい範囲が決めてあります。 発表ページによると、その境界を回り込もうとする試みが Opus 5 より85%減り、残った試みも重大度が低く、AI自身が申告するものだった、とされています。
行動の監査
Anthropic は、自動化された行動の監査で、Opus 5.5 が「望ましくない行動」のほぼすべての尺度で最近の Claude を上回った、としています。 これは Anthropic 自身の評価で、外部の検証ではありません。
使い方に条件がつく分野
- サイバーセキュリティ:認証を受けた専門家向けの Cyber Verification Program の対象
- 生物学:Life Sciences Verification Program を通じて、認証を受けた機関が使える
- 模倣(蒸留)への対策:Preserved Thinking という仕組みが、2026年8月31日以降に作られた API アカウントに適用される
「頼んでいないことをしない」「触ってよい範囲を守る」「外から仕込まれた命令に従わない」。 この3つは、店にいない人間が店の仕事を機械に任せるときの条件そのものです。 発表の数字はどれも Anthropic 自身の測定なので、私の店ではこの3つを、実際の作業で確かめてから使います。
発表ページには、性能の数字とは別に、答え方の変更が書かれています。 最も重要な情報を最初に置き、業界の標準に沿った構造で答える、というものです。
これは小さな変更に見えて、店の運営で使うと効きます。私は AI に「この予約は問題ないか」「この問い合わせは急ぎか」を聞きます。 そのとき欲しいのは、最初の一行に答えがあることで、経緯の説明は後でいい。 この記事も、その方針に倣って結論を最初に書きました。
| 項目 | 内容 |
|---|---|
| 公開日 | 2026年9月22日 |
| API の ID | claude-opus-5-5(Amazon Bedrock は anthropic.claude-opus-5-5) |
| 提供先 | Claude Platform、Amazon Web Services、Google Cloud、Microsoft Azure |
| プラン | Pro、Max、Team、席数で契約する Enterprise |
| 使える製品 | Claude Code、Claude Code Enterprise、Claude Cowork、Claude Design、Claude Science、Claude Security、Claude in Chrome、Claude for Microsoft 365 |
| 廃止の約束 | 2027年9月22日より前には廃止しない(Anthropic が運営する API 等での約束) |
「いつまで使えるか」が最初から書いてあるのは、店のシステムに組み込む側には大事です。 組み込んだ翌年に消えるものは、店には入れられません。少なくとも1年は固定できる、というのが公式の約束です。
私の店のシステムは、私がAIと一緒に1人で書いています。 無人店は、置いたら勝手に回るものではなくて、お客様のちょっとしたつまずきを見つけては直す、その繰り返しで回っています。 だから、AIが安くなり速くなることは、私にとっては「直せる回数が増える」ことです。
もう一つは、PCの画面を操作する力と、長く動き続ける力が上がったことです。 店にいない人間が、店の機械に何かをさせたい場面は多い。人が見ていない時間に、決めた範囲の中で、決めた仕事だけをする。 発表の方向は、無人店が機械に求めているものと同じ方を向いています。
ただし、この記事に書いたのは公式の発表だけです。数字は Anthropic と利用企業の測定で、私の店で確かめたものではありません。 自分の店でどう使えるかは、自分の店で試すしかない。無人店は実例が少ないので、いつもそうです。
この記事の調べ方
2026年9月23日に、Anthropic の発表ページ(anthropic.com/claude-opus-5-5)と Claude Platform の公式モデル一覧を読んで書きました。 数字はすべてその2つに載っているもので、利用企業の報告は英語の原文を私の言葉で要約しています。 Anthropic 社とは関係がなく、紹介料も受け取っていません。
AIで店の仕組みを作ること、無人店で機械にどこまで任せるか。同じことを考えている方は、LINEでご相談ください。私の店で試した分は、隠さずお話しします。
よくある質問
Claude Opus 5.5 の料金はいくらですか?
API の料金は100万トークンあたり、入力が4ドル、出力が20ドル、キャッシュの読み込みが0.20ドル、キャッシュの書き込みが5ドルです(Anthropic の発表ページ、2026年9月23日閲覧)。Opus 5 は入力5ドル・出力25ドル・キャッシュ読み込み0.50ドルだったので、Anthropic は全体で4割の削減としています。
Claude Opus 5.5 と Opus 5 の違いは何ですか?
発表ページに書かれている違いは、料金が4割安いこと、出力が3割以上速いこと、そしてターミナル操作・PC画面の操作・業務の自動化・知識労働の指標が上がったことです。たとえばPC画面の操作(OSWorld 2.0)は74.0%から81.8%、業務の自動化(AutomationBench)は26.9%から40.0%になっています。文脈の長さ(100万トークン)と最大出力(12.8万トークン)は同じです。
Claude Opus 5.5 と Fable 5.1 はどちらを使えばいいですか?
Anthropic の公式のモデル一覧は、ほとんどの仕事は Opus 5.5 から始め、難しい推論や長時間のエージェント作業、あるいは Opus 5.5 の効果を上げても評価が足りないときに Fable 5.1 を使う、と案内しています。料金は Fable 5.1 が入力10ドル・出力50ドルで、Opus 5.5 の2.5倍です。
Claude Opus 5.5 は無料で使えますか?
発表ページには、Pro・Max・Team と、席数で契約する Enterprise のプランで使えると書かれています。無料プランについての記載は、2026年9月23日の時点では発表ページにありません。API では claude-opus-5-5 という ID で使え、AWS・Google Cloud・Microsoft Azure でも提供されています。
Claude Opus 5.5 はいつまで使えますか?
Anthropic の公式のモデル一覧では、廃止は2027年9月22日より前には行わない、としています(Anthropic が運営する API・Claude Platform on AWS・Microsoft Foundry での約束。Amazon Bedrock と Google Cloud は各社が期限を決めます)。知識の範囲は2026年6月までです。
ほかの記録
← 記録の一覧へ