PaPoo
cover

Claude Sonnet 5.5を選んでも、裏で別のモデルに切り替わるかもしれない話

この記事を読んでまず思ったのは、​​「モデル名を選んだつもりでも、そのとおりの挙動になるとは限らない」のかという、かなり嫌だけど大事な現実です。APIやLLMを使う側は、Sonnet 5.5 という名前に安心したくなります。性能も癖も、そのモデルを前提に設計したくなるからです。そこに「状況によっては Sonnet 5 に回される」と聞くと、ちょっとした実装上の話では済まない気がします。

特に引っかかったのは、これが単なる負荷分散ではなく、cyber safety のための仕組みとして入っている点です。危ないリクエストをそのまま通さず、classifier と fallback を挟む。安全側に倒す設計としては筋が通っています。でも開発者の立場だと、出力の再現性やデバッグのしやすさが一気に難しくなる。昨日と同じプロンプトなのに結果が違う、しかもその理由が「裏で別モデルに切り替わったから」だとしたら、原因切り分けがかなり面倒です。

もうひとつ面白かったのは、AI の安全対策が、もはや「危険なプロンプトを止める」だけではなく、​どのモデルをどの条件で見せるかという運用の話にまで広がっていることです。モデル選択がUI上のラベルではなく、実際には一連の policy decision の結果になる。これは便利でもあるし、少し怖くもある。開発者がコントロールできる範囲が、思ったより狭いのではないか、と感じました。

たぶん今後は、「このモデルを使う」というより「このモデルファミリーの、この安全層込みの挙動を使う」と考えないといけないのだと思います。LLMはますます“部品”というより“サービス”になっていく。そのぶん、名前だけ見て設計すると足元をすくわれる。この記事は、その違和感をかなりはっきり突きつけてきました。


参考: You picked Claude Sonnet 5.5 — but Anthropic may send your request to Sonnet 5

同じ著者の記事