この記事を読んでまず思ったのは、Anthropic がいま一番力を入れているのは「最上位モデルの派手さ」よりも、毎日使う場面での手触りなんだな、ということだった。Sonnet 5.5 は Opus 5.5 より下の立ち位置だけど、単なる廉価版というより、「速度」「コスト」「扱いやすさ」のバランスをかなり意識して作られているように見える。
特に気になったのは、価格が据え置きなのに“1タスクあたり”の実質コストは下がる、という説明だ。こういう話はAI製品でよく出てくるけれど、実際には「安い」と言ってもトークン単価の話だけで、使ってみると長々と回って結局高くつくことがある。そこを Anthropic は「少ないトークンで終わるから安い」と言っている。これはかなり実務寄りの発想で、派手なベンチマークよりも、修正依頼やドキュメント作成みたいな地味な作業で効くのだと思う。
一方で、ここは少し引っかかった。ベンチマークでは Sonnet 5.5 が Opus 5.5 の一部で上回る場面もあるのに、複雑で開かれた仕事ではまだ Opus 5.5 が明確に強い、と会社自身が言っている。つまり「新しいSonnetが上位モデルを食った」という単純な話ではない。じゃあ誰に何を勧めたいのかというと、たぶん Anthropic はそこをかなり細かく切り分けている。日常業務は Sonnet、難しい案件は Opus、という住み分けだろう。AIを“万能の一個”として売るより、用途別に揃えた方が現実には使いやすい。そういう方向に市場全体が寄っている感じもある。
それと、サイバーセキュリティ向けの safeguards が強化されている点は地味だけど大事だと思う。モデル性能の話は目立つけれど、実際には「どこまで危ない依頼を断るか」「どういう条件で安全側に倒すか」のほうが、企業導入では効いてくる。AIは賢くなるほど危うさも増すので、能力だけを上げるのではなく、最初からブレーキ込みで出しているのは筋がいい。
参考: Anthropic releases Claude Sonnet 5.5: Details, pricing, how to try it