AIを調整するのではなく、AIと調和する
この記事は、現在のAIアラインメントの実践が影響を受ける人々を除外し、彼らをパートナーではなく材料として扱っていると主張する。ドゥーマー陣営とアクセラレーション主義陣営の両方を批判し、公衆を排除した議論を行っていると指摘し、人間とAIが共進化する相互アラインメントの見解を提案する。
現在のAIアラインメントに関する議論は、主に研究室、財団、政策部門の研究者によって行われており、実際にそのシステムと共に生活する人々は排除されている。ドゥーマー陣営のエリエザー・ユドコウスキーはタイム誌で、政府に全ての大規模GPUクラスターを閉鎖し、暴走するデータセンターを空爆で破壊する用意があると述べ、核交換のリスクも辞さないと主張した。一方、加速主義陣営のマーク・アンドリーセンは反対者を「怨念」に苦しんでいると非難する。これらの対立は激しく見えるが、実際には誰が未来を設計する権利を持つかという同じ前提を共有している。
記事は、研究室のアラインメント実践が本質的に構成哲学であると指摘する。すなわち、人間の価値観をAIに一方的に注入し、内部評価と自動化によって閉じたループを形成する。2026年のAnthropicのブログで説明された方法はこの哲学の具現化であり、モデルが生成し、別のモデルがプロンプトし、LLM判別器がフィルタリングするというプロセスがシステム内部で完結する。著者は、真のアラインメントは一方的な構成ではなく、双方向の形成であると考える。人間とAIの相互作用は、湿った粘土を共に彫刻するようなものであり、両者が接触を通じて変化する。研究室の構成哲学はこの相互作用を無視し、一方を固定し、他方を構成可能なものとして扱う。
安全議論の両陣営は、自らを人類の管理者と位置づけながら、管理していると主張する人々を含めていない。一方は私たちの名において核交換のリスクを冒そうとしており、他方は異議を唱える者を病気扱いする。どちらの側も、私たちが部屋にいることに気づいていない。著者は、自身の経験を信頼し、枠組みに定義されることを拒否し、制御ではなく協調という新たなアラインメント観を構築するよう呼びかける。また、2026年の技術論文「Compression Synthesis」を引用して議論を補強している。全体として、この評論は現在のAIアラインメントのエリート主義と排他性を鋭く批判し、より包括的な代替視点を提案している。