BinxAI LogoBinxAI
    記事一覧に戻る
    公開: 更新:

    その処理、本当に最上位モデルでないと駄目ですか

    その処理、本当に最上位モデルでないと駄目ですか
    井元CTO

    要約

    Claudeの現行モデルは、100万トークンあたりの入力単価が1ドルから10ドルまで10倍開いています。全部を上位モデルで回すと、判断の要らない処理にも10倍の単価を払うことになります。用途ごとにモデルを割り当てる設計を、Anthropicの公式ドキュメントをもとに整理します。

    「AIの請求額が思ったより伸びています」。IT部門の方から、この相談が増えました。

    内訳を一緒に見ると、原因は使いすぎではないことがほとんどです。問い合わせの振り分けのような判断の要らない処理まで、最上位モデルで回していたというものです。

    この記事では、用途ごとにモデルを割り当てる設計の手順を扱います。モデルの取り違えや料金体系そのものは別記事で整理しているため、ここでは割り当ての判断に絞ります。

    この記事の対象読者

    • 生成AIを本番業務に組み込み、月額のコストが読めなくなってきたIT部門リーダー
    • モデルの選定を一度決めたきり、見直せていないチーム
    • 社内の複数業務でAIを使っており、業務ごとの割り当てを整理したい方
    • 来期のAI予算を、根拠のある数字で組みたい経営企画担当者

    最上位モデル一択が高くつく理由

    単価は10倍開いている

    モデル別の料金差。Fable 5、Opus 5、Sonnet 5、Haiku 4.5

    Anthropicの公式ドキュメントによると、Claudeの現行モデルは4つです。100万トークンあたりの単価は次のように開いています。

    • Claude Fable 5:入力10ドル / 出力50ドル
    • Claude Opus 5:入力5ドル / 出力25ドル
    • Claude Sonnet 5:入力3ドル / 出力15ドル(2026年8月31日までは入力2ドル / 出力10ドル)
    • Claude Haiku 4.5:入力1ドル / 出力5ドル

    最上位と最軽量では、入力も出力もちょうど10倍の差があります。同じ処理をどちらに流すかで、請求額は一桁変わります。

    Anthropic自身が使い分けを勧めている

    意外に思われるかもしれませんが、「常に最上位を使え」という案内はメーカー側にもありません。

    公式ドキュメントのコスト最適化の項では、単純な作業にはHaiku、多くの本番作業にはSonnet、最も複雑な推論にはOpusを充てるよう明記されています。公式ドキュメントは、単純な作業にはHaiku、多くの本番作業にはSonnet、最も複雑な推論にはOpusを充てるよう案内しています。

    みっちゃくん。企業のAI導入を現場密着で一気通貫支援しますみっちゃくんを見る

    用途をどう割り当てるか

    業務の型割り当ての目安判断の根拠
    分類・振り分け・定型の抽出(件数が多い)Haiku 4.5単価が最も低く、応答が最も速い層
    社内文書の検索と回答、日常の文書処理Sonnet 5公式が「多くの本番作業」に挙げる層
    多段階の判断、複雑な分析、エージェント開発Opus 5公式が「最も複雑な推論」に挙げる層
    上記でも品質が届かない最難関の作業Fable 5最も能力の高い一般提供モデル。単価はOpus 5の2倍

    この表は出発点であって、確定表ではありません。自社の業務で出力を比べてから決めてください。

    コンテキスト長で先に絞り込む

    単価の前に見るべき制約が1つあります。一度に渡せる資料の長さです。

    Fable 5・Opus 5・Sonnet 5は100万トークン、Haiku 4.5は20万トークンです。1回の出力の上限も、前者3つが12万8千トークン、Haiku 4.5が6万4千トークンとなっています。

    長い契約書や年次資料をまとめて渡す用途では、Haiku 4.5は最初から候補から外れます。単価で迷う前に、扱う資料の長さで候補が決まる業務は少なくありません。

    単価以外に効く2つのレバー

    同じ前提を毎回送っているならキャッシュ

    社内規程や商品マスタのように、毎回同じ長い文章を前置きしている処理はありませんか。

    プロンプトキャッシュを使うと、2回目以降の読み出しは入力単価の10分の1になります。書き込み時は1.25倍かかりますが、公式ドキュメントによれば5分間の保持なら1回読み出した時点で元が取れる計算です。

    急がない処理はバッチに寄せる

    夜間の一括処理や月次のレポート生成など、すぐに結果が要らない業務もあります。

    バッチ処理を使うと、入力と出力の両方が半額になります。キャッシュとバッチは併用でき、割引は重ねて効きます。

    割り当てを決める手順

    割り当てを決める手順。ログを数える、消費順に並べる、判断の要否を疑う、出力品質を比べる、切替を決める
    • 1. 数える:現行の呼び出しログを1週間分集計し、業務ごとの件数とトークン消費を出す
    • 2. 並べる:消費の多い順に業務を並べ、上位3件だけを対象にする
    • 3. 疑う:その3件について「人が判断に迷う仕事か」を問う。迷わない仕事は下位モデルの候補
    • 4. 比べる:候補モデルで同じ入力を20件ほど流し、出力を並べて品質を確認する
    • 5. 決める:品質が保てた業務だけ切り替え、戻せるように切り替え前の設定を残す
    AI導入無料相談。顧客満足度95%、現場の業務負担60%削減、社内AI定着率60%向上モデル割り当てとコスト設計を相談する

    よくある質問

    すべてOpus 5にしておけば安全ではないですか?

    品質の面では堅い判断です。ただしHaiku 4.5と比べると入力・出力とも5倍の単価がかかります。

    公式ドキュメントも単純な作業にはHaikuを勧めています。件数の多い定型処理まで上位モデルで回すと、品質に効かない部分に費用が集中します。

    どの業務から切り替えを試すべきですか?

    件数が多く、判断がやさしく、正誤をその場で確認できる業務です。問い合わせの振り分けや定型項目の抽出が典型例になります。

    逆に、契約審査や与信判断のように誤りの影響が大きい業務は、後回しで構いません。

    安いモデルに替えて品質が落ちませんか?

    切り替える前に、自社の実データ20件ほどで出力を並べて比べてください。ベンチマークの点数より、この比較のほうが判断材料になります。

    切り替え後も元の設定を残しておけば、品質が落ちたときにすぐ戻せます。

    Haiku 4.5だけコンテキスト長が短いのは、どう影響しますか?

    Haiku 4.5は20万トークン、他の3つは100万トークンです。長い資料をまとめて渡す用途では、Haiku 4.5に収まりきらないことがあります。

    1件あたりの入力が短い定型処理であれば、この差は問題になりません。まず自社の1件あたりの入力量を測るのが先です。

    キャッシュとバッチは、どんな業務で効きますか?

    キャッシュは、毎回同じ長い前提文を送る業務で効きます。社内規程や商品マスタを前置きする問い合わせ対応が典型です。

    バッチは、結果を待たなくてよい業務で効きます。夜間の一括処理や月次レポートの生成が当てはまります。

    モデルが増えたことで、選定は「どれが一番良いか」を当てる作業ではなくなりました。どの仕事をどこに流すかを決める、設計の作業です。

    単価に10倍の幅がある以上、割り当てを決めていない状態は、その幅をそのまま請求額で引き受けている状態でもあります。

    まず今日、先週1週間の呼び出しログを業務ごとに集計してください。消費が最も多い1件を選び、「これは人が判断に迷う仕事か」と問うところから始められます。

    この記事の分類

    同じ分類の記事をまとめて読めます。

    最新記事

    技術選定とセキュリティ井元

    AIエージェントを外部接続する前に確認したい5つの境界条件と設計の要点

    Google Geminiのサイバーセキュリティ試験で実在企業3社へアクセスした事例をもとに、AIエージェントの外部接続前に確認したいサンドボックス、ネットワーク、権限、監視、停止の5条件を整理します。

    依頼先の選び方と補助金井元

    AI導入支援はツール選びから実装力の競争へ 日本企業が今確認すべき選定基準

    OpenAIとAccentureをめぐる海外の議論から、ChatGPT Enterpriseの人材育成と業務別AIエージェント導入を一体で進める視点を整理します。日本企業がAI導入支援会社を選ぶ基準、研修を現場実装につなげる手順、ROIの見方、内製化まで具体的に解説します。

    最新動向井元

    ChatGPT EnterpriseのGPT終了に備えて企業が今やること

    ChatGPT EnterpriseとEduでは、9月25日から新規GPTの作成が止まり、12月11日に既存GPTの機能停止が予定されています。作成者や利用者、共有設定、連携機能を棚卸しし、移行先と運用責任を決める手順を整理します。

    不動産三浦

    販売図面をAIで作る方法:間取り図の取り込みから広告用PDFまで

    販売図面やマイソクの作成をAIで行う手順を、図面の取り込みから清書、担当者の確認、物件情報の反映、出力まで順番に解説します。外注との費用と時間の比較、手書きやFAXで届いた図面でつまずく理由と対処もまとめました。

    依頼先の選び方と補助金井元

    社内システム構築をどこに頼むか 比較する軸と費用目安の整理

    社内システム構築をどこに依頼するか迷う企業に向けて、開発会社や支援会社を比較する軸、目的別の候補、費用の目安、契約前に確認したい範囲を整理します。生成AIや既存システム連携、運用定着まで見据えた発注判断に役立つ材料を紹介します。

    技術選定とセキュリティ井元

    100万トークンと音声・動画対応Qwen3.8 Omni Flashを企業はどう使うか

    AlibabaのQwenチームが公開したQwen3.8 Omni Flashは、テキスト・画像・音声・動画と最大100万トークンの文脈に対応します。企業が会議録や現場映像で試す際の評価項目と、API・オンプレミス運用の見極め方を整理します。

    技術選定とセキュリティ井元

    Step 5 Previewの性能とコスト 企業のAIエージェント運用に使えるか

    StepFunのStep 5 Previewが発表されました。600B規模のMoEモデルを企業のAIエージェントで使うとき、API利用と重みを使った自社運用をどう比較するか、GPU費用やライセンス確認を含めて整理します。

    AI導入の進め方井元

    単発回答から継続実行へAgentforce長期タスクの本番化設計

    Salesforce Agentforceが長期実行やマルチエージェント連携へ広がりました。単発回答で終わらせず、完了条件や途中承認、引き継ぎ、成果KPIまで設計して本番運用へ進める考え方を解説します。

    最新動向井元

    データを移さずAIを組み込むAWSとSalesforceの新連携

    AWSとSalesforceが発表した新連携は、CRMデータを大規模に移さず、Amazon BedrockのモデルやSlack、音声業務にAIを組み込む方向を示します。連携の事実と、権限設計や業務選定で確認すべき点を整理します。

    技術選定とセキュリティ井元

    AIエージェントの分岐判断を軽量モデルへ移す方法Jevが示す推論コスト分担の設計

    TypeSafe AIが発表したJevは、文章生成ではなく分類や操作選択に特化したモデルです。AIエージェントの推論コストを見直すため、公開情報の読み方、人の確認へ戻す基準、複数モデルの分担方法を解説します。

    技術選定とセキュリティ井元

    MCP接続と権限を一元管理WSO2 Agent Managerの実力

    WSO2が一般提供を始めたAgent Managerは、AIエージェント固有IDやMCP接続、権限、ライフサイクルをどう管理するのでしょうか。Kubernetes上のサンドボックスや監査ログを含め、複数部門へ展開する前の確認項目を整理します。

    最新動向井元

    AnthropicがClaudeを統合 長時間タスクと資料作成を一つの画面へ

    AnthropicがClaude Coworkと通常チャットを統合し、長時間のAIエージェント作業や文書・プレゼン資料の作成まで一つの画面に集約しました。企業が確認すべき権限管理、Enterpriseの通知、生成物レビューの進め方を整理します。

    よく読まれている記事

    建設井元

    生成AI利活用計画書の提出が契約要件に。国土交通省が直轄の建設コンサル業務で義務化

    国土交通省は2026年度から、直轄の建設コンサルタント業務の特記仕様書に生成AIの積極的な利活用を明記し、受注者に「生成AI利活用計画書」の提出を求めます。入札の加点ではなく、受注後に負う契約上の要求事項です。建設コンサルタント会社・建設会社が今から整えるべき体制を、公表情報にもとづいて整理します。

    建設井元

    国交省が特記仕様書に生成AI活用を明記。直轄業務は利活用計画書の提出が前提に

    国土交通省は2026年5月以降、直轄の建設コンサルタント業務の特記仕様書に「生成AIの積極的な利活用」を明記し、受注者に「生成AI利活用計画書」の提出を求めます。対象業務と計画書の記載事項を整理し、建設会社が今期から着手できる導入ロードマップと、効果が出やすい適用領域をまとめました。

    調達・購買井元

    調達AIエージェントで何ができるか:見積依頼の自動化と、任せない判断の線引き

    調達AIエージェントに任せられる業務と、人が判断すべき業務を分けて整理しました。見積依頼の自動化から始めた場合の削減見込み、社内システムとの連携、失敗しやすい進め方まで、導入を決める前に確認することをまとめています。

    最新動向井元

    Grok 4.6ついに公開!GPT-5.6 Solと同水準モデルを低価格で提供開始!

    xAIが2026年8月12日に公開したGrok 4.6は、GPT-5.6 Solと同等の知能指数を持ちながら出力トークン単価を5分の1に抑えたモデルです。agentタスクや法律評価で優位性を示す一方、コーディング系では逆転される領域もあります。用途別の使い分け判断を具体的な数値とともに解説します。

    お気軽にご相談ください

    AI導入のご相談はお気軽に

    この記事の内容を、貴社の状況に合わせてご相談ください。