PaPoo
cover

ブラウザにAIを入れる話、便利さより先に不安が来た

正直、まず思ったのは「そりゃ便利だけど、そこまで信用していいのか」ということだった。
ブラウザの中でAIがページを見て、クリックして、入力までやる。発想としてはすごく自然だし、たしかに人の手間はかなり減る。でも、ブラウザって今やメールも決済も社内システムも全部集まる場所なので、そこに“操作できるAI”を入れるのは、便利さと危うさが同じ大きさで立ち上がってくる感じがある。

記事で面白かったのは、Anthropicがその危うさをかなり真正面から扱っているところだった。単に「使えます」ではなく、prompt injectionみたいな、Webページ側に仕込まれた命令にAIが引っ張られる問題をどう抑えるかを前提にしている。AIは画面の見えている文字をそのまま信じてしまいがちなので、Webの世界と相性がいいようで実はかなり悪い。ここを“技術の難しさ”として書いているのは、かなり誠実だと思った。

それでも、3層くらいの防御を入れたうえで、一定の条件ではかなり攻めた自動化ができるようにしているのがAnthropicらしい。人間がいちいち面倒を見なくても動く、でも勝手に何でもやらせるわけではない。その線引きが今後どこまで現実的に保てるのかは、まだ読んでも少し半信半疑だ。企業向けにドメイン制御を入れるのも当然ではあるけれど、実運用では“想定外のページ”に出会った瞬間にどうなるのか、そこが本当の勝負だと思う。

この記事を読んで、AIエージェントの次の論点は「何ができるか」より「どこで止めるか」なんだな、と改めて感じた。ブラウザを操作するAIは、たぶん避けられない流れではある。でも、便利さを語る前に、AIに見せていい画面と、触らせていい操作をもっと細かく考える段階に入っているのだと思う。


参考: Claudeブラウザ拡張「Claude in Chrome」一般提供開始、プロンプトインジェクションをどう防ぐ?:Claude Codeの実運用モードと「3重防御」

同じ著者の記事