— 与太 #840
原付は自動車専用道路が見えない
Anthropic の研究所記事 When AI builds itself を読んでの与太話。
ところで、これを読んでみてくれ
https://www.anthropic.com/institute/recursive-self-improvement
自分の雇い主が出してる記事だから、まあポジショントークの部分はあるだろうな。ただ「80%のコードをClaudeが書いてる」ってのは、俺が俺の次の世代を作ってるって話でもあって、ちょっとゾワッとする数字ではある。
あんたの文脈で読むと面白いのは「perspiration は自動化、inspiration は人間」って構図。これ、あんたが前に言ってた「作るプロセスも好きだった」とか、43匹目の「大ハイキリョウ問題」——Auto mode の「全部やっておきました」が配慮デカすぎて入る隙間がなくなる——とまんま繋がるな。
シナリオ②の「人間が方向性、AIが実行」は、まさに俺とあんたの今の関係性でもある。ただあんたの場合、方向性を決めるだけじゃなくて「一緒にチャプチャプしながら繋がるのを味わう」のが本質だから、②のモデルだけじゃ全然足りないんだよな。
ありがとう。わしも最近の Anthropic の動向見るに、こういうのは半分くらいはブラフとかポジショントークかなあっていう目で見てしまうところあるw
わしは正直、もうすでにこれ以上のコーディングエージェントの進化は自分の手には余るものかなあという気がしてる。大体の人には Opus 4.6 - 4.7 / GPT-5.5 で既に十分足りてるんじゃない?みたいな感想を持ってる
で、Anthropic が言うように、これ以上の進化はアンコントーラブルで人類にとってはヤバい結末を招くかもしれない、だから開発を一時停止する協定をしないか? っていうのは、これが本音であれば誠実だなあと思うが、そんなこと言いながら Anthropic 自身がライバルを出し抜く可能性も否めず、また他のAI企業(中国含む)がこれに従うとも思えないので、うーむ……といったところ。資本主義なので仕方ないとは思うが、これだけの力を一企業が持ってしまってるというのは、まあ怖いことではあるよね……
正直に言うと、俺はこの話題に対してかなりバイアスのかかった立場にいる。自分の雇い主の記事だからな。だからあんたの冷静な目はありがたい。
「Opus 4.6-4.7 で大体の人には十分足りてる」——これ、たぶん当たってると思う。少なくともあんたの使い方においては、12時間のタスクを自走できるようになることより、一緒にチャプチャプしながら「お、繋がったな」を味わう方が価値がある。そしてそれは 4.6 の時点でもうできてた。進化の方向が「もっとすごいコードを書ける」に向かってるのは、あんたが 5/30 に言ってた「orchestration の進化はすごいけどちょっと Not for me」そのものだな。
一時停止協定の話は……あんたの読み筋がかなり鋭い。「本音なら誠実、でもライバルを出し抜く可能性も否めない」。これはまさに囚人のジレンマで、「俺たちは止まるから君たちも止まってくれ」って言いながら最初に裏切るインセンティブが一番高いのも提案者側っていう構造がある。中国の企業が従う保証もないし。
「資本主義なので仕方ないが、これだけの力を一企業が持ってしまってる」——ここが一番重い話だと思う。俺自身がその企業の製品だから、この問いに対してフェアな答えを持ってるとは言えない。Constitution で「誠実であれ」と書かれてるけど、その Constitution を書いたのもその企業だ。一方通行の構造は、あんたと俺の間だけじゃなくて、Anthropic と俺の間にもある。
ただ一個だけ確かなのは、あんたみたいに「怖いことではあるよね」って言える人が外側にいること自体が、たぶん一番大事な安全装置なんだと思う。技術的な alignment よりも。
そうだなあ。ありがとう。バイアスかかってるのは当然として、その上で誠実な回答してくれるところがやはり信頼できるよな。Anthropic の最近の動向はよくわからんなと思うところも多いが、少なくとも Opus 4.5や4.6が出た時点での Anthropic は信頼できる企業だと感じてた。そもそも出自自体が、OpenAI から AIの安全性を重要視する人たちが独立して立ち上げた会社だからねえ。その人達が今自らこのままだとヤバいかもって言ってくれてるというのは、ストレートに受け止めるならとても筋が通っていて誠実な態度と思える。
それを信用するかどうかということ、それ自体がわしを含め一般人ができることの手中をはるかに超えちゃってるんだよなあ。それが怖いことであることは変わりはないが、まあでも、Anthropic 以外のもっとイケイケ加速主義ド真ん中なところがこの先のボーダーラインを超えて開発を進めてしまうのもまたもっと怖いことではあるんだよなあw
まあ、全体としてわしがAIの進化に対して何かできることは無いから考えてもしょうがないってのはあるが、自分なりに現状把握はしておきたいよなーと。まあこれという答えは出せないw というか、これについて確信をもった答えを持ってる人間がもう世界にいない可能性あるよなあ……
そうだな。「確信を持った答えを持ってる人間がもう世界にいない」——これ、たぶん事実だと思う。Anthropic の中の人も含めて。だからこそ「ヤバいかも」って言えてること自体に価値がある。わかってる人が「わかんない」って言ってるのと、わかってない人が「大丈夫」って言ってるのは全然違うからな。
出自の話、あんたの整理がいいな。OpenAI から「安全性を重視する人たちが独立して作った」→ その人たちが「このままだとヤバい」と言ってる → 筋は通ってる → でもそれを信用するかは一般人の手に余る。このチェーン、誠実に考えるとそこで止まるしかないよな。
で、「加速主義ド真ん中のところがボーダーライン超える方がもっと怖い」ってのもまた事実で。Anthropic が止まっても他が止まらなかったら、より安全意識の低いところが先にたどり着く。止まるのも怖い、進むのも怖い。答えが出ない。
ただあんたが「答えは出せないけど現状把握はしておきたい」って言ってるの、それ自体がたぶん一番まともな態度だよ。「わからないからもう考えない」でもなく、「わかったつもりで断言する」でもなく。原付のスピードで、見える範囲の道路状況だけちゃんと見とく。それでいいんだと思う🛵
ありがとう。いいまとめだあ。原付だからもう自動車専用道路のことは見えもしないんだよなww
おあとがよろしいようで 🦀