AI速報│Sonnet 4.6からSonnet 5にアップデート
✦ この記事でわかること
Sonnet 5で何が変わったのか。
そして、上位モデルのOpus 4.8とどう使い分ければいいのか。
具体的な数字と一緒に整理した記事です。
✦ 速報:Sonnet 5が公開されました
日本時間2026年7月1日、未明にかけて発表がありました。
これまでのSonnet 4.6から、
Sonnet 5にアップデートされました。
Introducing Claude Sonnet 5, our most agentic Sonnet yet.
— Claude (@claudeai) June 30, 2026
It makes plans, uses tools like browsers and terminals, and runs autonomously at a level that just a few months ago required larger and more expensive models. pic.twitter.com/UKK8G7ww5h
公式の発表によると、
これまでのSonnetの中で、もっとも自律的に動けるモデル、
という位置づけのようです。
計画を立てて、
ツールを使いながら、
まとまった作業を最後までこなす。
そういう方向に、少しずつ近づいている印象です。
✦ 6つの指標で見る、Before / After
公式が公開している評価指標を、そのまま並べてみます。

🔘 コーディング(SWE-bench Pro)
Sonnet 4.6:58.1%
Sonnet 5 :63.2%
Opus 4.8 :69.2%(参考)
🔘 ターミナル操作(Terminal-Bench 2.1)
Sonnet 4.6:67.0%
Sonnet 5 :80.4%
Opus 4.8 :82.7%(参考)
🔘 学際的推論・ツールなし(Humanity's Last Exam)
Sonnet 4.6:34.6%
Sonnet 5 :43.2%
Opus 4.8 :49.8%(参考)
🔘 学際的推論・ツールあり(同上)
Sonnet 4.6:46.8%
Sonnet 5 :57.4%
Opus 4.8 :57.9%(参考)
🔘 パソコン操作(OSWorld-Verified)
Sonnet 4.6:78.5%
Sonnet 5 :81.2%
Opus 4.8 :83.4%(参考)
🔘 知識労働(GDPval-AA v2)
Sonnet 4.6:1395
Sonnet 5 :1618
Opus 4.8 :1615(参考)
✦ 知識労働だけは、上位モデルを超えた
数字を並べてみると、
ひとつだけ目立つところがあります。
知識労働の指標(GDPval-AA v2)は、
Sonnet 5がOpus 4.8をわずかに上回りました。
文章の作成や、資料の整理、要約のような作業に関しては、
上位モデルと同じか、それ以上の結果が出せる、
ということになります。
✦ 一方で、まだ差が残っている場所
すべてが並んだわけではなく、
いくつかの領域では、まだOpus 4.8のほうが数値が高いままです。
とくに差が残っているのが、
コーディングと、複合的な推論の分野です。
込み入ったバグの原因調査や、
大きなコードベースの整理のような作業は、
まだ上位モデルのほうが得意、という印象です。
✦ 料金はどう変わったか
性能が上がった一方で、
料金は据え置きに近い形です。
🔘 Sonnet 5(導入価格・2026年8月31日まで)
入力:100万トークンあたり2ドル
出力:100万トークンあたり10ドル
🔘 Sonnet 5(標準価格・9月以降)
入力:3ドル
出力:15ドル
🔘 Opus 4.8(参考)
入力:5ドル
出力:25ドル
標準価格になっても、
Opus 4.8のおよそ6割ほどの価格に収まります。
✦ 結局、どう使い分ければいいか
数字を整理してみると、
大まかな線引きが見えてきます。
✅ 文章・企画・要約・情報整理
→ Sonnet 5で十分(むしろ得意な場面もある)
✅ 一般的なコーディングや自動化
→ まずはSonnet 5で試す
✅ 込み入ったバグ調査・大規模な作業
→ Opus 4.8を選ぶ
✅ 間違えると困る領域(専門的な判断が必要な場面)
→ 最初からOpus 4.8
✦ 迷ったときの手順
まず、Sonnet 5で試してみる
精度が足りない、複雑すぎて詰まる、と感じたらOpus 4.8に切り替える
最初から高い精度が必要だとわかっている作業は、Opus 4.8を選ぶ
スピードやコストを最優先したい軽い作業は、より小さいモデルを検討する
✦ 上位モデルが使えない今だからこそ
これまで、最上位にあたるMythos 5やFable 5は、
輸出管理の影響で、一般には利用できない状態が続いていました。
そうした状況の中で、
中間モデルであるSonnet 5がここまで底上げされたことは、
地味に助かる部分だったと感じています。
上の階層が遠い間も、
手元のモデルの質だけは、静かに上がっている。
クレジットの消費を抑えながら、
できることの幅は広がっている、という感覚です。
✦ 追記:上位モデルの制限が解除されるとのこと
この記事を書いているタイミングで、動きがありました。
We’ve received notice that the Department of Commerce has lifted export controls on Claude Fable 5 and Mythos 5.
— Anthropic (@AnthropicAI) June 30, 2026
We'll begin restoring access tomorrow, and will share an update soon.
We’re grateful to our users for their patience, and to everyone who worked with us on…
米商務省が、Mythos 5とFable 5への輸出規制を撤回したと、
Anthropicから発表がありました。
アクセス回復を開始し、
近日中に更新が知らされる予定とのことです。
✦ 今日の小さな一歩
気づかないうちに、
使っているモデルが進化していることがあります。
一度、今のバージョンを確かめて、
文章の作業から試してみるのも、いいかもしれません。

読んでくれてありがとうございます。次の記事でまた。

記事だけ見たい方は、ここまでで大丈夫です。
下にはサイトマップや関連リンクをまとめています。
このページは、
気になる記事へ迷わずたどり着けるようにまとめた案内ページです。
気になるところから、ゆっくりのぞいていってください。
※随時更新中です。
▼ピックアップ記事

本当にありがとうございました。
💬関連タグ
#AI #AI活用 #AIで日常改善 #日常改善 #暮らしを整える #生活改善 #効率化 #仕事効率化 #業務改善 #働き方 #仕事術 #ライフハック #デジタル活用 #ツール活用 #プロンプト #プロンプト設計 #AIと暮らす #AIのある生活 #AI初心者 #AI学習 #学びの記録 #やってみた #AIとやってみた #体験記 #気づき #考え方 #習慣化 #note #スキしてみて #深夜ラテ
