Claude APIを利用する開発者にとって見逃せない仕様変更がありました。Anthropicは2026年9月、モデルが安全性の理由でリクエストを拒否(refusal)した場合の課金ルールを見直し、特定の3カテゴリーについては出力前の拒否であっても通常のリクエストと同様に課金する方針へと変更しました。この記事では、変更の内容、対象となるカテゴリー、そして開発者が実務で取るべき対応をまとめます。
何が変わったのか
Claude APIでは、モデルが安全性の観点からリクエストへの応答を拒否すると、レスポンスのstop_reasonが"refusal"となり、stop_details.categoryに拒否理由のカテゴリーが記録されます。Anthropicの公式ドキュメントによると、2026年9月時点でこのうち「誤検知(false positive)の発生率が低い」とされる3カテゴリーについては、出力が1トークンも生成されていない拒否であっても、実行されたモデルの通常レートで課金される仕様になりました。
課金対象になったのは次の3カテゴリーです。
- bio:危険な実験手法など生物学的な害につながりうるリクエスト
- frontier_llm:競合する大規模言語モデルの開発を助ける可能性があるリクエスト
- reasoning_extraction:モデル内部の推論プロセスをそのまま抽出しようとするリクエスト
一方で、次の2カテゴリーは出力前の拒否であれば引き続き課金されません。
- cyber:マルウェアや攻撃手法の開発などサイバー上の害に関わるリクエスト
- general_harms:上記4カテゴリーに当てはまらない、その他の利用ポリシー違反
なお、応答の途中(出力の一部が生成された後)で拒否が発生した「ミッドストリーム拒否」については、カテゴリーを問わずこれまでも課金対象であり、この点に変更はありません。
対象カテゴリーと課金の有無(早見表)
| カテゴリー | 内容 | 出力前拒否の課金 |
|---|---|---|
| bio | 生物学的な害につながる実験手法など | 課金される |
| frontier_llm | 競合AIモデル開発を助ける可能性 | 課金される |
| reasoning_extraction | 内部推論の抽出要求 | 課金される |
| cyber | サイバー攻撃・マルウェア関連 | 課金されない |
| general_harms | その他の利用ポリシー違反 | 課金されない |
Anthropicはこの変更の目的について、安全対策(セーフガード)を大規模かつ機械的に回避しようとする試みを防ぐためだと説明しています。誤検知率の低いカテゴリーに限定することで、正当な研究目的の利用への影響を抑えつつ、悪用目的の大量リクエストにはコストを課す狙いがあるとみられます。
適用範囲はプラットフォーム全体
この課金ルールは、Anthropicが提供するAPIに限らず、以下のすべての利用経路に適用されます。
- Claude API(Anthropic直接契約)
- Amazon Bedrock経由のClaude
- Google Cloud Vertex AI経由のClaude
- Microsoft Foundry経由のClaude
どの経路でClaudeを利用していても、bio・frontier_llm・reasoning_extractionカテゴリーに該当する拒否は、通常のリクエストと同じレートで課金される点に注意が必要です。
開発者が取るべき3つの対応
1. 拒否カテゴリーを監視・分別する
レスポンスのstop_details.categoryを必ず記録し、課金対象カテゴリー(bio・frontier_llm・reasoning_extraction)とそれ以外を分けて集計する仕組みを整えることをおすすめします。無料カテゴリー(cyber・general_harms)であれば、コストを気にせず気軽にリトライやフォールバックを試せます。
2. フォールバック機能でキャッシュコストの二重払いを防ぐ
拒否が発生した際に別モデルへ自動的にリトライする「フォールバック」機能を使う場合、プロンプトキャッシュのコストが二重に発生しやすいという課題があります。Anthropicはこれに対応するため、サーバー側フォールバック(fallbacksパラメータとベータヘッダーを指定する方式)や、手動リトライ時に専用ヘッダーを送ることでキャッシュ作成コストの返金(フォールバッククレジット)を受けられる仕組みを用意しています。頻繁に拒否が発生するワークロードでは、これらの活用を検討する価値があります。
3. reasoning_extraction対策にはAdaptive Thinkingを検討
モデルの内部推論をそのまま取得したいという用途で拒否が発生しがちな場合、Anthropicは代替として「Adaptive Thinking」機能の利用を推奨しています。用途がAPIの拒否ポリシーに触れやすい場合は、目的に応じた別の機能で代替できないか見直すのも有効です。
よくある質問
個人開発者への影響は大きい?
小規模な利用であれば、影響は限定的です。bio・frontier_llm・reasoning_extractionの3カテゴリーは、通常の開発・検証作業では頻繁に発生するものではありません。ただし、生命科学系のアプリケーションを開発している場合や、モデルの内部推論を取得しようとする用途(reasoning_extraction)に該当しやすい実装をしている場合は、想定より課金が発生する可能性があるため、レスポンスのカテゴリーを確認しておくと安心です。
自分のリクエストがどのカテゴリーに当たるか事前に分かる?
事前に確実な判定を得る方法は公開されていません。実際にAPIを呼び出した際のレスポンスに含まれるstop_details.categoryを見て、初めてどのカテゴリーに分類されたかが分かります。誤検知(本来問題のない用途が拒否される)が発生した場合の異議申し立て窓口についても、Anthropicのサポート経由で確認できます。
料金プランによって扱いは変わる?
課金ルール自体はプラン(Pro、Max、APIの従量課金など)によって変わるものではなく、拒否のカテゴリーに応じて一律に適用されます。Claude Pro・Max向けのチャット利用ではなく、API・Bedrock・Vertex AI・Microsoft Foundry経由の開発者向け利用に関わる変更である点を押さえておきましょう。
まとめ
Claude APIの拒否課金ルールは今後も見直される可能性があるとAnthropicは明言しています。現時点でコストに直結するのはbio・frontier_llm・reasoning_extractionの3カテゴリーのみですが、API利用コストを正確に把握したい開発者・企業は、拒否カテゴリー別のモニタリングを今のうちに整備しておくとよいでしょう。
