Claude Sonnet 5.5 レビュー:Medium では優秀、Max は落とし穴

Kira
執筆者

Kira

Katelin Teen
レビュー者

Katelin Teen

最終更新 September 29, 2026

専門家による検証済み
星の評価スコアカード、速度計、コードの本とサポートチケットの山とともに机に向かうレビュアーの手描きイラスト。Claude Sonnet 5.5 のレビュー用

一目でわかる私の結論

ローンチの翌日は、Anthropic の発表とモデルドキュメント、続いて移行ガイド、そして約 550 件のコメントが付いた Hacker News のローンチスレッドを読んで過ごしました。私の仕事は eesel のヘルプデスクチームメイト向けの AI エージェントを作ることなので、「明日このモデルを実際のサポートキューの下に置くか」という一点を念頭に読み込みました。

Claude Sonnet 5.5 の Claude Platform ドキュメントページ。1M のコンテキストウィンドウ、128K の最大出力、100 万トークンあたり $2 と $10 の料金、Fable 5.1・Opus 5.5・Haiku 4.5 との比較を示す。Claude Platform ドキュメントより
Claude Sonnet 5.5 の Claude Platform ドキュメントページ。1M のコンテキストウィンドウ、128K の最大出力、100 万トークンあたり $2 と $10 の料金、Fable 5.1・Opus 5.5・Haiku 4.5 との比較を示す。Claude Platform ドキュメントより

実際に導入するときに重要な項目でつけた採点の要約です。

確認した項目スコア理由
コーディング品質9/10Terminal-Bench 4.0 で 70.6%、Opus 5.5 を上回る
ナレッジワーク8/10GDPval-AA は 1844、Opus 5.5 の 1846 に 2 ポイント差
トークン効率Low/Medium で 9/10、Max で 4/10Balyasny では 1 回答あたり約 121k 対 497k トークン、ただし Max では 1 タスク 193k
速度8/10Sonnet 5 より 30% 以上高速な出力
移行の手間5/10破壊的変更が 5 つ、うち 1 つはサポートボットにとって厄介
サポートへの適合8/10Zendesk はチケット処理が 20% 速くなったと確認
総合8/10ラインナップで最高のコスパ。ただし避けるべき高額な設定が 1 つある

これらのスコアの根拠を明確にするため、方法について簡単に触れます。モデルはまだ公開 1 日目なので、数か月に及ぶ本番運用の検証は行っていません。スコアは、Anthropic が公表した数値、ローンチ時の発表にある実名の顧客結果、公開されている独立したベンチマーク結果、そして API ドキュメントを eesel がチケットワークフローにモデルを組み込む方法と照らして読んだ私自身の見方から成り立っています。数値が Anthropic 由来の場合は、その旨を書きます。

Claude Sonnet 5.5 とは

Claude Sonnet 5.5 は Anthropic の Claude 5.5 ファミリーの中位モデルで、2026 年 9 月 28 日にリリースされました。位置づけは Claude Opus 5.5 の下、Haiku 4.5 の上で、Claude Fable 5.1 がラインナップの最上位です。Anthropic は Opus の "a faster, lower-cost complement" と位置づけ、"well-scoped everyday tasks, fixing bugs, and creating polished documents, slides, and spreadsheets." に最も強いとしています。

仕様面では、モデル概要に 1M トークンのコンテキストウィンドウと 128K の最大出力(Batch では 300K)、2026 年 6 月の知識カットオフ、Claude Sonnet 5 と同じトークナイザーとあります。ローンチの詳細は同僚の Sonnet 5.5 の概要がよくまとめています。この記事は、どちらかといえば結論を扱います。

Claude Sonnet 5.5 が強い点

ローンチ時のデータで目立った点が 3 つあり、そのすべてが Anthropic 自身のグラフだけでなく、実名の顧客結果にも表れています。

Opus クラスのモデルのようにコードを書く

目玉はコマンドライン上で動くエージェント型コーディングテスト、Terminal-Bench 4.0 です。Sonnet 5 は 10.3% でしたが、Sonnet 5.5 は70.6% で、Opus 5.5 の 66.4% を上回ります。誤植ではありません。これまで見た Sonnet モデルの世代間の伸びとしては最大です。

Terminal-Bench 4.0、FrontierCode、CursorBench、GDPval-AA、AA-Briefcase、Humanity's Last Exam、OSWorld、Chartography で Sonnet 5.5、Sonnet 5、Opus 5.5、GPT-6 Sol を比較した Anthropic のローンチ時ベンチマーク表。Anthropic の発表より
Terminal-Bench 4.0、FrontierCode、CursorBench、GDPval-AA、AA-Briefcase、Humanity's Last Exam、OSWorld、Chartography で Sonnet 5.5、Sonnet 5、Opus 5.5、GPT-6 Sol を比較した Anthropic のローンチ時ベンチマーク表。Anthropic の発表より

ほかのコーディングテストでは Opus にやや及びません。CursorBench 4.0 は 55.5% 対 57.8%、FrontierCode は Xhigh で 52.1% 対 54.4% です。トークン単価が半分のモデルなら、2 ポイント差は正直お買い得です。だからこそ、Opus と Sonnet の議論では、多くの人が品質の議論をやめてコストの議論に移りました。

顧客の数字もこれを裏付けています。Base44 は、118 件の実際のアプリ構築で、Sonnet 5.5 が "produced apps that scored level with Opus 5" を 1 ビルドあたり 3.6 回の反復で達成し、Opus 5 は 7.7 回だったと述べました。Unity は、複数ステップのエディタベンチマークでタスクの 90% を完了したと主張しています。そして Claude Code でコードを書くなら、Medium effort で既定として目にするのはこのモデルになります。

はるかに少ないトークンで目的に到達する

トークンあたりの価格は変わっていません。変わったのはトークンの数です。Balyasny Asset Management は 2,441 件の金融タスクを実行し、Sonnet 5.5 が1 回答あたり約 121k トークンを使い、Sonnet 5 は 497k だったと報告しました。Slack は Slackbot の評価でプロンプトを変えずに出力トークンが約 14% 減り、Lovable はツール呼び出しが 3 分の 1 減ったと報告しています。

Anthropic 自身のデモも同じことを示しています。"wind shaping sand dunes" というプロンプトで、Sonnet 5.5 がすでに動くアニメーションを出しているとき、Sonnet 5 はまだコードを書いていました。

並べて比較したテストの途中で、まだ砂丘のプログラムを書いている Sonnet 5。Anthropic の Sonnet 5.5 発表より
並べて比較したテストの途中で、まだ砂丘のプログラムを書いている Sonnet 5。Anthropic の Sonnet 5.5 発表より
同じ並列比較テストで動いている Sonnet 5.5 の完成した砂丘アニメーション。Anthropic のローンチ時比較より
同じ並列比較テストで動いている Sonnet 5.5 の完成した砂丘アニメーション。Anthropic のローンチ時比較より

この効率こそが製品の本質です。Anthropic によれば、Sonnet 5 に比べて "up to 30% less per task" になります。私が話を聞くチームにとっては、トークンが減ればお客様が返信を待つ秒数も減り、そちらのほうが請求額より重要です。

サポートチケットをうまく処理する

私が最も重視する部分です。Zendesk の Director of AI はローンチ時の発表で、"fed Claude Sonnet 5.5 hundreds of real support use cases across replies and escalation requests. It made fewer wrong decisions," と語り、チケットは 20% 速く処理されました。Atlassian 側では、Rovo エージェントが Sonnet 5 より最大 30% 速く動くとしています。

Zendesk AI のような業務では、この 2 つがモデルの良し悪しを決める数字です。誤ったエスカレーション判断が減ること、そして待ち時間が減ること。どちらも良い方向に動きました。

Claude Sonnet 5.5 の手描きスコアカード。2 列で、勝っている点(Terminal-Bench 4.0 の 70.6%、1 回答あたり 121k 対 497k トークン、サポートチケット 20% 高速化)と、つまずく点(Max effort は 1 タスク $7.60 対 Opus の $5.98、ユーザーに確認を求めて止まる、サイバータスクは Sonnet 5 にフォールバック)を示す
Claude Sonnet 5.5 の手描きスコアカード。2 列で、勝っている点(Terminal-Bench 4.0 の 70.6%、1 回答あたり 121k 対 497k トークン、サポートチケット 20% 高速化)と、つまずく点(Max effort は 1 タスク $7.60 対 Opus の $5.98、ユーザーに確認を求めて止まる、サイバータスクは Sonnet 5 にフォールバック)を示す

Claude Sonnet 5.5 の弱点

弱点は懐疑派が言うほど広くありませんが、そのうち 1 つはモデルの動かし方を変えます。

Max effort は Opus より高い

私の結論を変えた発見です。Anthropic 自身のローンチ発表も、Sonnet 5.5 は "complements Opus 5.5 best when running at lower effort settings" であり、"at higher settings, it can perform comparably at a similar cost." と認めています。独立した検証はそれをさらに一歩進めています。

Artificial Analysis では、ある Reddit ユーザーが指摘したとおり、Max での Sonnet 5.5 は 1 タスク $7.60、Max での Opus 5.5 は $5.98 です。Sonnet 5.5 は 1 タスクあたり 193k トークンを使い、Opus は 119k だったためです。Simon Willison はローンチ当日、同じ SVG プロンプトをすべての effort レベルで実行しました。Low は 1.6 セントで 10 秒。Max は $1.28 で 15 分 40 秒かかり、128,000 の思考トークンをすべて使い切ったうえで画像を生成できませんでした。

同じ SVG プロンプトに対する 5 段階の effort の手描き階段図。Low は 1.6 セントと 10 秒、Medium は 1.8 セントと 11 秒、High は 2.3 セントと 17 秒でスイートスポットとして囲まれ、Xhigh は 5.7 セントと 41 秒、Max は $1.28 と 15 分 40 秒で思考トークン切れにより失敗として取り消し線が引かれている
同じ SVG プロンプトに対する 5 段階の effort の手描き階段図。Low は 1.6 セントと 10 秒、Medium は 1.8 セントと 11 秒、High は 2.3 セントと 17 秒でスイートスポットとして囲まれ、Xhigh は 5.7 セントと 41 秒、Max は $1.28 と 15 分 40 秒で思考トークン切れにより失敗として取り消し線が引かれている

Anthropic の FrontierCode の脚注も同じ形をしています。Sonnet 5.5 は Xhigh で 52.1% ですが、Max では 46.2% にとどまります。Max では "more often ran Claude Code's code-review skill" となり、タイムアウトやタスク範囲を超えた編集につながったためです。この場合、より多く考えることが結果を悪化させました。

つまり、ルールは単純です。Sonnet 5.5 では Max を使用禁止にしてください。それほどの推論が必要なタスクは、より少ないトークンで目的に到達する Opus 5.5 向きです。

オープンエンドな判断は Opus が依然として上

Anthropic はこの点でかなり率直です。"Opus 5.5 remains clearly stronger at complex, open-ended work requiring sustained judgment." 初期の使用報告もこれに同意しています。

Hacker News

"Tried Sonnet 5.5 but worse than OPUS for thinking for sure, less error/inconsistency check. I used Opus 5.5 med vs. Sonnet 5.5 High on hermes with the same agent.md, and soul.md"

サポートに置き換えるなら、請求トラブルを抱え、過去に 3 件のチケットがある怒った法人顧客です。そのチケットは、監督なしでは Sonnet 5.5 に任せません。パスワードのリセットや注文状況の確認、「データをエクスポートするには」という質問なら、一日中任せます。

質問のために止まる

エソテリックなプログラミング言語を基にした敵対的ベンチマークを動かしているある開発者がいます。そこで Sonnet 5.5 は Sonnet 5 の 17.8% に対して 7.4% で、その説明は "is more reluctant to keep going to get an answer, instead it returns to ask the user questions whether to keep going." でした。これに対して Base44 は、"rarely stopped mid-build to ask the user a question." と述べています。

私の見方では、対話的な作業なら、確認のために止まるのはむしろ望ましいことが多いです。無人のパイプラインでは事情が違い、質問して止まるモデルはジョブを一晩止めてしまう可能性があります。ヘッドレスで信頼する前に、自分のエージェントループで試してください。

サイバー保護機能と 5 つの破壊的変更

Sonnet 5.5 は Opus 5.5 と同様のサイバー保護機能つきで登場した最初の Sonnet であり、"higher-risk cybersecurity tasks will visibly fall back to Sonnet 5." となります。通常のバグ修正は影響を受けません。それでも、Hacker News で最大のサブスレッドは、認可されたセキュリティ作業をしているのにフラグを立てられた人々からのものでした。

移行ガイドには 5 つの破壊的変更が挙げられており、いずれも 400 エラーを返します。

変更点壊れるもの対処
thinking: disabledthinking を完全にオフにしたリクエスト新しい between_tools 設定を使う
強制的な tool_choice(any または tool)分類ツールを強制するボットモデルに選ばせ、その後で検証する
thinking ブロックより前の履歴の編集過去のターンを書き換えるアプリ履歴を追記のみにする
computer_20251124API と Google Cloud の旧コンピューター操作ツールcomputer_toolset_20260801 を使う
一部のアドバイザーツールの組み合わせSonnet 5.5 のエグゼキューターに Sonnet 5 や Opus 4.8 のアドバイザーOpus 5.5 または Sonnet 5.5 と組み合わせる

サポートチームにとっての落とし穴は、強制的な tool_choice です。多くの AI ヘルプデスク連携は、チケットのトリアージのためにすべてのリクエストで「このチケットを分類する」ツールを強制します。これを直さずにモデル ID を替えると、すべてのチケットがエラーになります。もう 1 つ目立たない変更もあります。ツール呼び出しの間のテキストが thinking ブロックの中に入って届くようになったため、「ご注文を確認しています...」とストリーミングするチャットウィジェットが無言になることがあります。その沈黙がお客様にとって重要な理由は、AI エージェントのハンドオフのガイドで説明しています。

開発者たちの声

ローンチ当日の反応は賛否入り混じっていましたが、有益な形でした。ベンチマークを疑う人はいません。議論は、Opus と並べたときに Sonnet 5.5 がどこに収まるかに集まっています。

Hacker News

"It appears, at least from a quick look, to be noticeably faster than Opus. If true, and you don't need xhigh/max reasoning for your use case (like a well-defined set of code changes), Sonnet might get the job done much more quickly."

懐疑派は価格に注目しており、特にキャッシュ読み取りが Opus 5.5 と同じ $0.20 である点を指摘しています。

Hacker News

"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."

人々が繰り返し戻ってくるユースケースは、Opus のプランナーの下で動く高速な実装役としての Sonnet です。

Reddit

"Firmly places itself as a solid subagent for opus, great work from anthropic, for once I'm interested in what haiku turns out as."

別のコメント投稿者は、自分の使い分けを "80% Sonnet 5.5, Opus 5.5 to finish the last 20%." と表現しました。このパターンは Claude Code のサブエージェントにきれいに当てはまり、私自身がまねたい構成です。

3 枚のカードの手描きフロー。Opus 5.5 が作業を計画し、次に強調表示された Low または Medium の Sonnet 5.5 が 3 つの並列サブタスクで構築の約 80% を担い、最後に Opus 5.5 が残り 20% を仕上げる
3 枚のカードの手描きフロー。Opus 5.5 が作業を計画し、次に強調表示された Low または Medium の Sonnet 5.5 が 3 つの並列サブタスクで構築の約 80% を担い、最後に Opus 5.5 が残り 20% を仕上げる

Claude Sonnet 5.5 の料金を 1 つの表で

100 万トークンあたりの料金は、Anthropic の料金ドキュメントによるものです。

100 万トークンあたりの価格Sonnet 5.5Sonnet 5Opus 5.5Haiku 4.5
入力$2$2$4$1
出力$10$10$20$5
5 分キャッシュ書き込み$2.50$2.50$5$1.25
キャッシュ読み取り$0.20$0.20$0.20$0.10
Batch 入力 / 出力$1 / $5$1 / $5$2 / $10$0.50 / $2.50
コンテキストウィンドウ1M1M1M200K

思考トークンは出力として課金され、そのために effort 設定がこれほど重要になります。Medium でのサポート返信は数百トークンしか考えないかもしれませんが、同じ返信を Max で行うと数万トークン考えることがあり、そのすべてが 100 万あたり $10 で課金されます。モデルの行が AI サポートエージェントのコストの最大の部分になることはめったにありませんが、effort ダイヤルはそれを最大にする最速の方法です。

一般向けのアクセスは簡単です。Anthropic によれば、誰でも Claude.ai で Sonnet 5.5 とチャットでき、有料プランは私の Claude Pro 料金ガイドにあります。初日から Amazon Bedrock、Google Cloud、Microsoft Foundry でも利用できます。プロバイダーを比較検討するなら、まず 3 社 API の比較から始めてください。OpenAI との直接対決は、GPT-6 Sol 対 Opus 5.5 の解説をお読みください。

切り替えるべき人、待つべき人

現在使っているものに応じた、私の判断は次のとおりです。

現在の利用環境私の判断Effort 設定
本番で Sonnet 5移行対応の修正後、今週中に切り替えMedium
日常のコーディングに Opus 5.5定型タスクを Sonnet 5.5 のサブエージェントに移すLow または Medium
オープンエンドな計画に Opus 5.5Opus のままn/a
ツール呼び出しを強制しているサポートボットtool_choice を直すまで待つMedium
セキュリティやペンテストのワークフロー待ち、Cyber Verification Program に申請するn/a
大量のタグ付けとルーティングHaiku 5.5 が出るまで Haiku 4.5 のままn/a

Anthropic は Claude Haiku 5.5 が "in the coming weeks" にファミリーに加わると述べているので、チケットあたりのコストが最大の懸念なら、待つ価値があります。選択肢をより広く見たい場合は、私の Claude カスタマーサービス代替まとめがサポート向けの選択肢を扱っています。一般的なモデルの入れ替えについては、Sonnet の代替の一覧をご覧ください。

賢いモデルでも間違ったナレッジベースは直らない

モデルのレビューでは見せられないことが 1 つあります。私が見てきたサポートボットの失敗の大半は、モデルとは無関係だということです。月に約 200 件の Zendesk チケットを扱う B2B の車両テレマティクスチームは、ボットがデータベースにない自動車ブランドに対応していると顧客に伝えていることに気づきました。ただし、モデルが幻覚を起こしていたわけではありません。ナレッジベースが「すべてのモデル」に対応していると書いていて、ボットはそれをそのまま信じただけです。Sonnet 5 から Sonnet 5.5 に替えても、同じ誤った答えが 30% 速く返ってくるだけでした。

だからこそ、サポート向けのモデルをベンチマークだけで評価することはありません。eesel では、チームメイトが顧客と話す前に、すべての導入を過去のチケットに対してシミュレートします。より良いモデルでも直せないナレッジの問題を見つけられるのは、そこだからです。

Claude クラスのモデルで eesel をキューに試す

移行を自分で抱え込まずに、チケット対応で Sonnet 5.5 の速度を得たいなら、eesel が近道です。AI ヘルプデスクチームメイトは、Zendesk など、すでにお使いのヘルプデスクに参加し、過去のチケットとヘルプセンターから学習して、内部で最先端モデルを使って返信を下書きまたは送信します。このレビューで挙げた effort の調整と破壊的変更への対応は、すべてあなたではなく eesel の仕事になります。

Zendesk 内の eesel AI ヘルプデスクチームメイトのアクティビティビュー。最近のウェブ会話が、保留中と解決済みのステータスおよび関連するチケット番号とともに一覧表示されている
Zendesk 内の eesel AI ヘルプデスクチームメイトのアクティビティビュー。最近のウェブ会話が、保留中と解決済みのステータスおよび関連するチケット番号とともに一覧表示されている

ターミナルでの作業がお好きなら、eesel CLI はダッシュボードと同じチームメイトとワークスペースを操作します。スクリプト化することも、Claude Code のようなコーディングエージェントに操作させることもでき、それは先ほどの「Opus が計画し、Sonnet が構築する」パターンを、そのままサポート環境に当てはめたものです。AI エージェント CLI の記事でさらに詳しく、MCP サーバーの記事でコネクター側を扱っています。

無料プランには 100 クレジットが付き、カードは不要です。有料プランは 500 クレジットで $299 から始まります。実際のチケットの一部で eesel を試し、速いモデルが本当に速い回答として表れるかどうかを確かめてください。

Claude Sonnet 5.5 は価値があるか

はい、ただし 1 つのルールつきです。Low または Medium の effort なら、Claude Sonnet 5.5 は Opus に迫るコーディングとナレッジワークを半額のトークン単価で提供し、30% 以上高速で、トークンもはるかに少なくて済みます。範囲の明確な作業やサブエージェント、そして日常的なサポート返信の新しい既定になります。

Max では Opus より高くつき、それでも失敗することがあるので、そこでは使わないでください。難しくオープンエンドな判断には Opus 5.5 を残し、移行前に強制ツール呼び出しを直してください。そのあとは、請求額を決めるのをモデル名ではなく effort ダイヤルに任せましょう。

よくある質問

Claude Sonnet 5.5 は優れていますか?
はい、適切な effort レベルであれば。今回の Claude Sonnet 5.5 レビューでは、ほとんどのローンチ時ベンチマークで Opus 5.5 に数ポイント差まで迫り、Terminal-Bench 4.0 では上回りました(70.6% 対 66.4%)。問題は Max effort で、タスクあたりのコストが Opus を上回ることがあります。ローンチの全体像は Sonnet 5.5 の概要で解説しています。
Claude Sonnet 5.5 は Sonnet 5 より優れていますか?
明らかに優れています。Terminal-Bench 4.0 は 10.3% から 70.6% に、GDPval-AA は 1449 から 1844 に跳ね上がり、Anthropic によれば同じ $2/$10 の価格で 30% 以上高速です。比較の基準としてはSonnet 5 のレビューをご覧ください。
Opus 5.5 より Claude Sonnet 5.5 を選ぶ価値はありますか?
Low や Medium の effort ならあります。トークン単価が半分で、Anthropic も低い設定のほうが Opus を補完しやすいと述べているためです。High 以上ではタスクあたりのコストが近づき、多くの場合 Opus 5.5 のほうがお得です。料金表は Opus 5.5 の料金ガイドにあります。
Claude Sonnet 5.5 の料金はいくらですか?
Claude Sonnet 5.5 は入力 100 万トークンあたり $2、出力 100 万トークンあたり $10、キャッシュ読み取りが $0.20、Batch が $1/$5 です。これは Sonnet 5 の料金と同じです。全体の表は Anthropic API の料金ガイドをご覧ください。
Claude Sonnet 5.5 ではどの effort レベルを使うべきですか?
Claude アプリと Claude Code の既定である Medium から始め、タスクが失敗したときだけ上げてください。API の既定は High です。オープンエンドな作業には Max を避けてください。128k の思考予算を使い切っても完了しないことがあります。設定の固定方法はモデル選択ガイドをご覧ください。
Claude Sonnet 5.5 はカスタマーサポートに向いていますか?
日常的な返信を支える強力なエンジンに見えます。Zendesk は何百件もの実際のサポート事例で試し、誤った判断が減り、チケット処理が 20% 速くなったと報告しています。ただし、自社のヘルプセンターや過去のチケットに基づかせる必要があり、それを上乗せするのが eesel のような AI ヘルプデスクエージェントです。
Claude Sonnet 5.5 の欠点は何ですか?
強制的なツール選択や thinking を disabled に設定するなど、5 つの API 変更がエラーを返すようになりました。リスクの高いサイバー関連タスクは Sonnet 5 にフォールバックし、あるベンチマーク作者はユーザーに確認を求めて止まることが増えたと報告しています。サポートボットで強制ツールが重要な理由は AI ヘルプデスク API ガイドで解説しています。
Claude Sonnet 5.5 の代替は何ですか?
Anthropic のラインナップ内では、Opus 5.5 が上位、Haiku 4.5 がより安価な下位です。外部では、ローンチ時の比較表での主なライバルは GPT-6 Sol です。より広い選択肢は Sonnet の代替まとめで扱っています。

Share this article

Kira

Article by

Kira

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
ノートPCの前でサポート担当者がチケットの山を素早く片付けている手描きのイラスト。Claude Sonnet 5.5の記事用
Trending

Claude Sonnet 5.5:価格は同じ、トークンは少なく、破壊的変更は5つ

Claude Sonnet 5.5はSonnet 5の$2/$10という価格を維持しつつ、同じ作業をはるかに少ないトークンでこなします。何が変わったのか、何が壊れるのか、サポートにとって何を意味するのかをまとめました。

Riellvriany IndriawanRiellvriany IndriawanSep 29, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5:どちらを使うべきか?

Claude Opus 5はトークン単価がSonnet 5の1.7倍でも、一部のタスクではより安く完了する。価格、ベンチマーク、実際のタスク単価を正面から比較する。

Rama AdiRama AdiJul 27, 2026
AnthropicのマークとサポートワークフローをあしらったClaude Sonnet 5のイラスト
Guides

Claude Sonnet 5とは何か:カスタマーサポートにとっての意味

Claude Sonnet 5は、ミッドティアの価格でOpusに近いコーディング・エージェント性能を実現しました。このモデルがサポートチームにとって実際に何を変え、何を変えないのかを解説します。

Rama AdiRama AdiJul 1, 2026
Claude Mythos 5.1モデルのトークン価格とコストの積み重ねを描いたイラスト
Trending

Claude Mythos 5.1の料金:すべてのレート、キャッシュ読み取りの引き下げ、実際に使えるのは誰か

Claude Mythos 5.1の料金を完全に解説する:基本レート、バッチ、キャッシュ書き込み、そして本当のニュースである0.25ドルのキャッシュ読み取り、さらにMythosがFable 5.1と同じ価格である理由。

Kurnia KharismaKurnia KharismaSep 8, 2026
Claude Mythos 5.1とFable 5.1が、異なる保護レイヤーの背後にある同じ基盤モデルであることを比較したイラスト
Trending

Claude Mythos 5.1レビュー:Anthropicの限定公開フロンティアモデルは追いかける価値があるか

Claude Mythos 5.1の実践レビュー。それが何であるか、Fable 5.1との比較、実際のキャッシュ読み取り価格、実際にアクセスできる人、そして代わりに何を使うべきかを解説する。

Kurnia KharismaKurnia KharismaSep 8, 2026
研究者の小規模な承認済みリストによって金庫のドアが開かれる様子を描いたイラスト。Claude Mythos 5.1への招待制アクセスを表している
Trending

Claude Mythos 5.1とは何か:実体、アクセスできるのは誰か、そして代わりに使うべきモデル

Claude Mythos 5.1は2026年9月1日にリリースされましたが、それを呼び出せる人はほとんどいません。本当のスペックシート、2つのアクセスプログラム、そして実際に使うべきモデルを解説します。

KiraKiraSep 2, 2026
Claude Opus 5スタイルのコントロールストリップ上で、5つの推論エフォートダイヤルの1つを選んでいる人物のイラスト
Trending

Claude Opus 5とは何か、実際にどう使うか

Claude Opus 5は1つのモデルではなく、実質5つのモデルだ。スペック、料金を左右するeffortダイヤル、そして古いコードを壊す2つのAPI変更をわかりやすく解説する。

Kurnia KharismaKurnia KharismaAug 5, 2026
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5:実際にはどちらを使うべきか?

Fable 5の価格はOpus 5のちょうど2倍。両方のシステムカード、ドキュメント、そして独立系ベンチマークを読み込み、その追加の1ドルが何をもたらすのかを検証した。

Rama AdiRama AdiJul 27, 2026
Illustration of a developer at a laptop watching an agentic coding loop run through code, checks and a bot
Trending

Claude Opus 5レビュー:半額でフロンティア級に迫るコーディング性能

Claude Opus 5の実機レビュー。ベンチマークが実際に示す内容、上昇したハルシネーション率、そして実運用のサポートキューに導入すべきかを検証する。

KiraKiraJul 27, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める