この記事を読んでまず思ったのは、安くなったことより「その安さで何を壊したのか」のほうがずっと重い、ということだった。モデルの値下げは普通は歓迎される。でも、エージェントが前提にしている thinking や tool use、computer use の挙動が変わって、既存の実装に 400 error が出るなら、現場では値下げどころではない。むしろ「安くなったから乗り換えよう」が、そのまま「既存システムの修理コストが発生する」に変わる。
特に引っかかったのは、AI の改善がそのまま互換性の改善にはならない点だ。人間向けのチャットなら多少の出力差は「賢くなった」で済むけれど、エージェントは違う。モデルの応答が少し変わるだけで、ツール呼び出しの条件分岐やリトライの設計が崩れる。つまり、LLM はただの文章生成器ではなく、半分は外部サービスみたいに扱わないといけないんだな、と改めて思った。バージョンアップのたびに挙動確認が必要になるなら、API の更新というより、かなり厄介なミドルウェアの変更に近い。
それでも、こういう記事が出るのは意味があると思う。AI の話はどうしても「性能が上がった」「価格が下がった」に寄りがちだけど、実運用ではそこより互換性のほうが痛い。とくにエージェントは一度組み込むと、そこに人間の手順まで巻き込まれる。だから「安い新モデルが出た」で終わらず、「既存の依存関係を壊していないか」を先に見るべきだ、という警告として読んだ。
参考: Anthropic made Opus 5.5 cheaper. Then it broke four things your agent depends on.