Cuaを読んで、いちばん引っかかったのは「全部入り」を目指していないこと
最初に思ったのは、これは単なる desktop automation の道具箱ではなく、computer-use を「作る側」のための基盤を取りにきているんだな、ということでした。普通こういうプロジェクトは、ブラウザを触れて、OSを触れて、モデルもある、で終わりがちです。でも Cua はそこからもう一歩進んでいて、実行環境、評価、データ生成までまとめて面倒を見るつもりに見える。ここがかなり野心的です。 特に面白かったのは、Cua Driver と Cua Bench が並んで置かれているところです。前者は「アプリを動かす手段」、後者は「その動かし方が良かったかを測る手段」ですよね。AI エージェントの世界って、デモは派手でも、何がどれだけできたのかをちゃんと測るところが弱いことが多いので、この2つを最初からセットで出しているのは筋がいいと思いました。単に操作できるだけではなく、操作の成否を再現可能にする。そこまでやらないと、computer-use は研究にもプロダクトにもなりにくいので。 もうひとつ引っかかったのは、「System 1」という言い方です。人間の直感的な判断になぞらえて
papoo.work