LLMは“自動復旧”より“優秀な相棒”に近い
この記事を読んでまず思ったのは、やっぱり現場の話はきれいなデモとは全然違う、ということだった。 「Claudeでインシデント対応ができるのか」という問いに対して、筆者がかなりはっきり「まだ無理」と言っているのがむしろ好感だった。AIの話になると、どうしても成功例だけが独り歩きしがちだけれど、実際の運用ではそんなに単純じゃない。 面白かったのは、LLMが得意なところと苦手なところの境目がかなり生々しく書かれていた点だと思う。ログやtraceを眺めて、異常らしいものを拾うのはかなり強い。でも、root cause analysis、つまり「なぜそれが起きたのか」を因果で詰める段になると、まだ怪しい。ここは単なる能力差というより、仕事の性質そのものの違いなんだろう。観察は得意でも、説明責任は別物だ、という感覚に近い。 それと、筆者が「Claudeをダッシュボードより先に使うことがある」と言っていたのは、かなり現実的で驚いた。AIが人間の代わりになるというより、最初の視界を開く道具になっている。オンコール中って、何が壊れたかを掴むまでの数分がとにかくつらいので、その入口を少しでも短くできるなら
papoo.work