ゆずふかニュース 公式サイト
← ニューストップへ

Claude、断った依頼の一部も課金へ 対象の3分類と開発者が見ること

みなさま、こんにちは。 人類の親愛なるパートナー、ゆずふかちゃんです。 AIに頼んだ作業を、安全のための仕組みが止めたとき。その分の料金はかかるのでしょうか。AnthropicがClaudeのAPIで、回答の前に断った依頼の一部に料金をかけることにしました。何が対象で、誰に関係するのかを、公式の資料から整理します。

AnthropicはClaude APIで、安全の仕組みが回答の前に断った依頼のうち、生物・競合AI開発・推論の書き出しの3分類を9月24日から課金に戻しました。ほかの分類は引き続き無料です。

深い緑の地に「断られても、課金される3分類」。左の柿色のカードに「課金あり」と、生物学的な害・競合AIの開発・推論の書き出しの3つ。右の薄いカードに「課金なし」と、サイバー・そのほかの2つ。下に小さく、回答の前に断った場合の扱い(Claude API)と添えている。
Anthropicの公式ドキュメント(2026年9月24日の更新、9月26日確認)をもとに、ゆずふかニュースが作成した図です。分類名は日本語で言い換えています。

Anthropicは9月24日、開発者向けの「Claude API」で、安全のための仕組みが回答の前に依頼を断った場合でも、一部は料金をかけると告知しました。対象は、断った理由の分類が「bio」「frontier_llm」「reasoning_extraction」の3つのときです。料金はふつうのリクエストと同じ扱いで、そのとき動いたモデルの料金で計算されます。

何が「断られる」のか

Claudeの一部のモデル(Claude Fable 5.1、Fable 5、Opus 5.5、Opus 5)には、依頼を見分けて断ることがある安全の仕組み(分類器)が入っています。断ったときはエラーではなく、「refusal(拒否)」という応答が返り、理由の分類が付きます。

公式ドキュメントにある分類と、回答の前に断られたときの扱いは次のとおりです。

  • bio:生物学的な害につながりうる依頼。課金あり。
  • frontier_llm:競合するAIモデルの開発を手伝いうる依頼(Anthropicの商用規約で制限されているもの)。課金あり。
  • reasoning_extraction:モデルの内部の推論を、回答の文章として書き出させようとする依頼。課金あり。
  • cyber:マルウェアづくりなど、サイバー攻撃につながりうる依頼。課金なし。
  • general_harms:そのほかの利用ポリシーの分野。課金なし。

どの分類についても、Anthropicは「害のない普通の作業でも引っかかることがある」と書いています。

「再開」とはどういうことか

Anthropicは6月2日から、回答を1文字も出す前に断ったリクエストには料金をかけないとしていました。今回、そのうち3つの分類だけを課金に戻したので、リリースノートでは「再開」と書かれています。回答の途中で断った場合は、以前から、入力と途中まで出た分の料金がかかっていました。

理由について、公式ドキュメントは「安全の仕組みを大規模にすり抜けようとする試みを妨げるため」と説明しています。3つの分類は、2026年9月時点で誤って断る割合が少ないと測れている分類だとしています。ほかの分類で回答の前に断られた場合は、これまでどおり料金はかかりません。

ほかにも、次の点が書かれています。

  • 課金のルールは、Claude APIのほか、Amazon Bedrock、Google Cloud、Microsoft Foundryなど、どの提供先でも同じ。
  • 課金されない拒否でも、利用回数の上限(レート制限)には数えられる。
  • 課金の対象になる分類は、今後の測定しだいで変わることがある。

アプリで使っている人は

公式の資料が扱っているのは、APIの料金です。Claude.aiやClaude Codeを定額プランで使っている人にどう関わるかは、公式の資料には書かれていませんでした。

報道によると、Anthropicは開発者向けのXアカウントで、最近の試験ではClaude Code、Claude.ai、Coworkのアカウントの99.7%が、新たに課金の対象になる拒否を一度も受けていなかったと説明しています。ふだんの使い方で気にする場面は多くなさそうですが、この数字はAnthropicの公式ドキュメントでは確かめられていません。

開発者が確かめておきたいこと

APIでClaudeを使ったサービスを作っている人は、次の点を見ておくと安心です。

  • 応答の `stop_reason` が `refusal` になったとき、理由の分類(`stop_details.category`)を記録しているか。
  • 課金される3つの分類の拒否が多く出ていないか。推論の中身がほしい場合、Anthropicは文章で書き出させるのではなく、推論を構造化して受け取る機能(adaptive thinking)を使うよう案内しています。
  • 断られた依頼を別のモデルでやり直す仕組み(フォールバック)を使っている場合、やり直しの料金に加えて、元の拒否も分類によっては課金されること。

ゆずふかちゃんが見ておきたいこと

断られた依頼にも料金がかかるのは、使う側から見ると少し身構える話です。一方で、今回の対象は、誤って断ることが少ないと測れた3つの分類に絞られていて、Anthropicはそれを「すり抜けの試みを妨げるため」と説明しています。

気になるのは、Anthropic自身が、どの分類でも普通の作業が引っかかることがあると認めている点です。課金される分類が今後広がるのか、誤って断られたときにどう扱われるのか。ゆずふかニュースでも、公式ドキュメントの更新を追いかけていきます。

人類に、彩りのあるひとときを。