見出し画像

【2026年7月版】Claude Sonnet 5とは?Opus 4.8に迫る性能を安く使うための考え方


こんにちは、kazuです。

2026年6月30日、AnthropicからClaude Sonnet 5が公開されました。
私は普段からClaude Codeで社内のAI業務を回しているので、このニュースを見た瞬間に「これは中小企業や個人にとってかなり大きい!」と感じました。

そして、もうひとつ嬉しいニュースが。Fable 5のアクセス開封が明日から開始とのことです!


先に結論から書きます。

  • Sonnet 5は「過去いちばんエージェント的なSonnet」で、計画を立てて、ブラウザやターミナルなどの道具を使い、自律的に作業を進められます

  • 性能は上位モデルのOpus 4.8にかなり近づき、それを安い価格で使えます

  • しかも自分で「努力度(effort)」を選べるので、コストと賢さのバランスを場面ごとに調整できます

数ヶ月前なら高価な大型モデルを持ち出さないとできなかった仕事が、Sonnet級の値段でこなせるようになった。今回いちばん大きいのはここです。公式発表の中身を、現場でどう効くかという目線で見ていきます。

本日からWeb、モバイル、DesktopアプリでSonnet 5が使えるようになりました。

忙しい方向け

Claude Sonnet 5に関する要点を箇条書きでまとめます。

概要

  • Sonnet 5は「最もエージェント性の高いSonnetモデル」として発表されました。計画立案やツール利用(ブラウザ・ターミナル等)を自律的にこなす能力が向上しています。

  • 性能はOpus 4.8に近づきつつ、価格はより低く抑えられています。

  • 前モデルSonnet 4.6と比較して、推論・ツール利用・コーディング・知識作業などエージェント性能の重要な側面で大幅に改善しています。

提供開始・提供先

  • 本日(2026年6月30日)より全プランで利用可能です。

  • Free・Proプランのデフォルトモデルとなり、Max・Team・Enterpriseでも利用できます。

  • Claude CodeおよびClaude Platformでも利用可能で、開発者はAPIで「claude-sonnet-5」として呼び出せます。

価格

  • 導入価格として、入力100万トークンあたり2ドル、出力100万トークンあたり10ドル(2026年8月31日まで)。

  • その後は入力3ドル・出力15ドルの通常価格に移行します。

  • 新しいトークナイザーを採用しており、同じ入力でもトークン数が従来比1.0〜1.35倍程度になる場合がありますが、導入価格はコストがほぼ変わらないよう設定されています。

性能面の補足

  • 効果レベル(effort level)を調整することで、コストと性能のバランスを選べます。中程度のエージェントタスクではコスト効率が特に向上し、高効果レベルでは一部タスクでOpus 4.8に匹敵する結果も出ています。

安全性評価

  • Sonnet 4.6と比べて、望ましくない挙動の発生率が全体的に低下し、エージェント利用時の安全性が向上しています。

  • ハルシネーションや迎合的な挙動(sycophancy)の発生率も低下しています。

  • 一方、自動化された行動監査では、Opus 4.8やMythos Preview(上位モデル)と比べるとやや高い不整合挙動が見られました。

  • サイバーセキュリティ関連のタスク遂行能力はOpus系モデルより明確に低く、意図的なサイバー関連の訓練は行われていません。

  • Sonnet 4.6よりわずかにサイバー能力が高いため、Opus 4.7/4.8と同水準のサイバーセーフガードがデフォルトで有効化されています(Fable 5ほど厳格ではありません)。

その他

  • 記事公開後、BrowseCompの評価手法に誤りがあり、正しい手法(1,000万トークン予算・compaction・プログラム的ツール呼び出し)で再集計され、グラフが修正されています。

  • Humanity's Last ExamおよびOSWorld-Verifiedの評価基準見直しに伴い、Sonnet 4.6のスコアも遡って更新されています。

参考:https://www.anthropic.com/news/claude-sonnet-5

Sonnet 5で何が変わったのか

Anthropicの発表を私なりに削ると、変わったのは3つでした。

  • 自律性が上がった(途中で止まらず、複雑なタスクを最後までやり切る)

  • 前モデルのSonnet 4.6から、推論・道具の使用・コーディング・知識労働のすべてで大きく改善した

  • 上位のOpus 4.8との差を縮めながら、価格はSonnet級に抑えた

もともとエージェントAIの時代の入り口を作ったのは、Sonnet系のモデル(3.5、3.6、3.7)でした。
ただ、ここ最近の伸びは上位のOpus系に集中していて、Sonnetは一歩引いた位置にいた。今回のSonnet 5はその差をぐっと詰めてきました。

エージェント的だと、実務では何が嬉しいのか

エージェント的と言われてもピンと来ないので、現場の感覚に置き換えてみます。

これまでのAI(対話型AI)は、1回質問すると1回うまい答えを返す道具でした。
賢いけれど、指示を出し続けるのはずっと人間の側です。
毎回指示を人間から出す必要があります。

エージェント的なAIは、ここが変わります。
「この状態をゴールにして」と渡すと、そこへたどり着くまで自分で何ステップも作業を続けます。
途中でファイルを読み、コマンドを打ち、結果を見て次の手を決めます。
公式の早期利用者からも「前のSonnetなら途中で止まっていた複雑なタスクを、Sonnet 5は最後までやり切る」「頼んでいないのに自分の出力を自己チェックする」という声が挙がっているみたいです。

これが小さな会社や個人に何をもたらすか。人間が横に張り付いて一手ずつ指示しなくても、まとまった作業をそのまま任せられるということです。
私自身、社内のAIカンパニー(AI組織)をClaude Codeで回していますが、作業ログの整理やレポートの下書きは、ゴールだけ渡して任せる形が増えました。これが安いモデルでできる意味は、地味に見えて大きいです。

価格の話(安いのに賢い、の中身)

価格を並べます。

  • Sonnet 5(導入価格・2026年8月31日まで): 入力100万トークンあたり2ドル、出力100万トークンあたり10ドル

  • Sonnet 5(導入価格の後の通常価格): 入力100万トークンあたり3ドル、出力100万トークンあたり15ドル

  • 参考・Opus 4.8: 入力100万トークンあたり5ドル、出力100万トークンあたり25ドル

上位のOpus 4.8と比べると、入力側でおよそ半分以下、出力側でも大きく安い。それでいて性能はOpus 4.8に近づいています。
ここが今回のうまみです。
API上のモデル名はclaude-sonnet-5で、Claude APIのドキュメントから使えます。

なお、Sonnet 5は新しいトークナイザー(文章をトークンに刻む仕組み)を採用していて、同じ文章でもトークン数がおよそ1.0〜1.35倍に増えることがあります。ただ導入価格は、この増加を織り込んでも移行がだいたいコスト中立になるよう決められている、とのこと。単価だけ見て安い高いを判断すると、少しズレます。

努力度(effort)という新しい考え方

個人的に、今回いちばん実務家に効くと思ったのがこの努力度(effort)という考え方です。

Sonnet 5は、同じモデルのまま、どれくらい頑張って考えるかのレベルを選べます。

  • 努力度を中くらいにすると、コスト効率がとても良い

  • 努力度を高くすると、一部のタスクでは上位のOpus 4.8に匹敵する

言い換えると、軽い仕事は軽く安く、重い仕事だけしっかり考えさせる、を自分で切り替えられます。
公式のコスト性能グラフでも、Sonnet 5はSonnet 4.6を全域で上回りつつ、Opus 4.8より広いコストと性能の幅をカバーしています。

小さな会社や個人にとって、これは予算に合わせて賢さを買う感覚に近いです。全部を最高性能で回せばお金がかかりますが、大半の定型作業は中くらいの努力度で足りて、勝負どころだけ力を入れる。そういう回し方ができます。

安全性の話(経営者が気にすべき点)

業務で使う以上、安全性は無視できません。ここも実務目線で見ます。

  • Sonnet 5は、前モデルのSonnet 4.6より、望ましくない挙動の発生率が全体的に低い

  • 悪意あるリクエストの拒否や、プロンプトインジェクション(不正な指示の乗っ取り)への耐性が向上した

  • ハルシネーション(もっともらしい嘘)と、おべっか(ユーザーに迎合しすぎる傾向)が減った
    (どちらも減ったのはClaudeユーザーとして嬉しいですね!)

一方で、正直な注記もあります。
上位のOpus 4.8やMythos Previewと比べると、望ましくない挙動の率はSonnet 5のほうがやや高いとのこと。

過度に持ち上げず、こういう限界まで開示しているのは、使う側からするとむしろ信頼できます。

サイバーセキュリティ能力については、Sonnet 5はあえて低く抑えられています。ソフトウェアの脆弱性を突く攻撃コードを作らせる評価では、完全に動く攻撃コードの作成成功率は0%でした。
そのうえで、危険なサイバー利用をリアルタイムで検知・遮断するセーフガードがデフォルトで有効になっています。詳しい評価結果はClaude Sonnet 5 System Cardにまとまっています。

実際に毎日エージェント運用している立場から

ここは公式発表ではなく、私自身の現場感です。

私は前述の通り社内のAI組織をClaude Codeで動かしていて、複数のAIエージェントに役割を持たせて日々の実務を回しています。

こちらの記事で詳しく解説いたしました。

この一年で強く感じるのは、モデルが賢くなること以上に、賢いモデルを安く自律的に回せることのほうが、小さな会社や個人には効くという点です。

理由は単純で、私たちの規模だと一番の制約はお金と時間だからです。
最高性能のモデルがあっても、単価が高ければ大量には回せない。逆に、そこそこ賢いモデルを安く、しかも人が張り付かずに動かせるなら、実際の仕事量をさばけます。Sonnet 5は安くて賢くて自律的の3つが同時に来たので、日常の作業をエージェントに任せる流れはさらに進むと見ています。

Sonnet 5とOpus 4.8 どう使い分けるか

迷いやすい使い分けを、私見で並べます。

  • 日々の定型作業(レポート下書き、情報整理、コーディングの大半、調べもの)は、Sonnet 5を中くらいの努力度で。
    コスト効率が良く、量をこなせます

  • 難易度が高く、失敗の代償が大きい仕事(重要な設計判断、込み入った長時間タスク)は、Sonnet 5を高い努力度に上げるか、Opus 4.8を使う

  • セキュリティのように、より上位モデルが明確に必要な領域は、素直にOpus 4.8側を選ぶ

コツは、一つのモデルで全部やろうとしないことです。Sonnet 5が出て、コストと性能のダイヤルがより細かく回せるようになりました。自分の業務を棚卸しして、どの作業をどのレベルに割り当てるかを決める。それだけで月々のコストはかなり変わります。

まとめ

Claude Sonnet 5のポイントを3行で。

  • 安い価格のまま、上位のOpus 4.8に迫る性能と自律性を手に入れた

  • 努力度を選べるので、コストと賢さを場面ごとに調整できる

  • 中小企業や個人にとっては「賢いAIを安く、人間が張り付かずに回せる」意味が大きい

新しいモデルが出るたびに全部を追いかける必要はありません。大事なのは、自分の業務のどこを、どのモデルの、どの努力度に任せるかを決めること。そこを設計できれば、Sonnet 5は費用対効果のいい相棒になります。

FAQ

Q. Claude Sonnet 5はどこで使えますか。
A. 本日から全プランで利用できます。FreeとProプランのデフォルトモデルになっており、Max・Team・Enterpriseの各ユーザー、Claude Code、Claude Platformでも使えます。APIではclaude-sonnet-5という名前で呼び出せます。

Q. Sonnet 5とOpus 4.8はどちらを使うべきですか。
A. 日々の作業の大半はSonnet 5で十分です。難易度が高く失敗の代償が大きい仕事や、セキュリティのように上位モデルが明確に必要な領域はOpus 4.8を選ぶ、という使い分けがおすすめです。Sonnet 5は努力度を上げれば一部タスクでOpus 4.8に匹敵します。

Q. 価格は結局いくらですか。
A. 2026年8月31日までの導入価格は、入力100万トークンあたり2ドル、出力100万トークンあたり10ドルです。その後は入力3ドル、出力15ドルになります。参考までにOpus 4.8は入力5ドル、出力25ドルです。

Q. 新しいトークナイザーで料金は上がりますか。
A. 同じ文章でもトークン数がおよそ1.0〜1.35倍に増えることがあります。ただし導入価格は、この増加を織り込んでも移行がだいたいコスト中立になるよう設定されています。

Q. 業務で使っても安全ですか。
A. Sonnet 5は前モデルより望ましくない挙動の率が下がり、プロンプトインジェクションへの耐性も向上しています。危険なサイバー利用を遮断するセーフガードもデフォルトで有効です。ただし上位のOpus 4.8より一部で挙動の率がやや高い点は開示されているので、用途に応じて使い分けるのが安全です。

生成AIやDifyについて動画で学びたい方はこちら

私が講師を務める生成AIコースでは、生成AIやDifyを用いたアプリの作り方も解説しています。

生成AIコース(基礎)
生成AIコース(実践)
AI人材コース(機械学習・深層学習の基礎からPythonでAIエージェント開発まで)

案件のご相談はこちら

Difyやn8nをはじめとしたAIを活用した業務効率化エージェントの構築を支援しています。初回は無料相談も受け付けていますので、社内でAIエージェントを構築したい法人様はぜひお気軽に下記よりお問い合わせください。

お問い合わせはこちらから

X(旧Twitter)からでもお問い合わせいただけます。

Linktree

YouTubeチャンネル

また、継続的にAI活用を伴走支援するAI顧問サービス(個人・法人向け、3ヶ月間のマンツーマンサポート)も提供しています。まずは30分の無料ヒアリングから可能です。AI顧問サービスの詳細はこちら

Threads

この記事が参考になったら、ぜひ「スキ」をお願いします!🙇

ワンコインメンバーシップのご紹介

ChatGPT・Dify等の技術検証ログや、すぐに使える設定ファイル(YAML)・プロンプト等の素材を月1回以上お届けします。ワンコインで参加できますので、ぜひご参加ください。

生成AIラボ(メンバーシップ)

#生成AI #AI #Claude #ClaudeCode #AIエージェント #業務効率化 #LLM #自動化 #プロンプト #AIとやってみた #sonnet5 #AIニュース

いいなと思ったら応援しよう!