AI News HubLIVE
サイト内リライト7 分で読了

ループって一体何なんだ?

AIエンジニアリングにおける「ループ」の概念には少なくとも4つの異なるアーキテクチャ(実行ループ、タスクループ、プロダクトループ、システムループ)が存在する。本記事ではそれぞれの特徴、関係性、そして自律性と人間の監督に関する議論を詳述する。

ソースO'Reilly AI & ML Radar著者: Laurie Voss

本記事はLinkedInに最初に掲載され、著者の許可を得て転載されています。

私たちは現在、ハイプサイクルのピークにあります。6月7日、Peter Steinbergerは、コーディングエージェントにプロンプトを与えるべきではなく、エージェントにプロンプトを与えるループを設計すべきだと投稿しました。同じ週に、AnthropicのBoris Chernyはステージ上で、もうClaudeにプロンプトを与えていないと述べました。「私はループを書く。ループが仕事をする。」Addy Osmaniは6月7日に「Loop Engineering」というエッセイを発表し、swyxは6月12日に「Loopcraft: The Art of Stacking Loops」を、LangChainは6月16日に「The Art of Loop Engineering」を発表しました。そしてAI Engineer World's Fairが開催され、この言葉がメインステージを支配しました。Swyxの基調講演はLoopcraftについてであり、ソフトウェアファクトリーに特化したトラック全体があり、次々と講演者が同じ言葉を使い、会議は7月2日に、ループの背後にあるハイプが実際に機能するものを超えてしまったかどうかについての1時間にわたる討論で締めくくられました。

問題は、ループについて話している人々が皆同じことを議論しているわけではないことです。私はその一つの言葉の背後に少なくとも4つの異なるアーキテクチャを数えました。そこでこの投稿は、皆が何を意味しているかをマッピングする試みです。

実行ループ:エージェント自身の行動-観察サイクル

これは「エージェント」と言うときにほとんどの人が思い浮かべるループです。ツールを呼び出し、結果を読み取り、次のアクションを決定し、ツール呼び出しがなくなるまで繰り返します。これがAddyが内部実行ループと呼ぶものであり、エージェントが現在ほぼ自律的に実行できる部分であり、エンジニアリング可能な最も内側のループです。(swyxのスタックにはトークンループがありますが、誰もトークンループを設計しません。それはモデルの一部に過ぎません。)

実行ループは1つのタスク内のステップを反復します。環境からのフィードバック(テスト出力、API応答、ファイル内容)で終了します。人間は通常、途中では不在で、境界(計画の承認や結果のレビュー)に現れます。実行ループは、エージェントが実際に完了したかどうかに関わらず、完了したと判断した時点でも終了します。この分野で最初に見つかった修正策は、このループを、エージェントの言葉を鵜呑みにしない別のループで包むことでした。

タスクループ:仕様が満たされるまでエージェントを再起動する

これは最初に名前が付けられたループで、Geoffrey HuntleyのRalphループです。AI Engineer World's Fairのメインステージで、KeycardのAllie Howeがソフトウェアファクトリートラックを紹介する際にGeoffreyの記事「Everything Is a Ralph Loop」を引用して名前が挙げられました。Ralphループは、コーディングエージェントを同じ仕様に対して何度も再起動し、反復ごとに完全に新しいコンテキストウィンドウを割り当て、ループごとに正確に1つのタスクを実行します。見かけ上の無駄がポイントです。毎回完全な仕様を再供給することで、長時間実行セッションで静かに進行するコンテキストの腐敗と圧縮イベントを防ぎます。

このループが反復するのは単一のアーティファクトです。ループを終了するのは、仕様への準拠とテスト合格です。人間は仕様を書き、完了を判断します。Geoffreyの説明では、人間にはもう1つの仕事があります(後で戻ります)。ループを監視し、失敗パターンを特定し、再発しないように修正することです。会議最終日の閉会討論で、彼はその役割を機関車の運転士に例え、その仕事全体が列車を線路に保つことだと述べました。しかし、単一の仕様からズームアウトすると、さらに大きなループが見えてきます。コードベース全体を実行するループです。

プロダクトループ:ソフトウェアファクトリー

これはAI Engineer World's Fairで最も声高だったバージョンです。FactoryのTereza Tizkovaはソフトウェアファクトリーを「自律的にソフトウェアを開発する全ライフサイクルを含むループ全体」と定義し、WarpのZach LloydはLatent Spaceのインタビューでそのライフサイクルを具体的に述べました:トリアージ、仕様化、実装、レビュー、検証、出荷、監視。Zachの主張は、ソフトウェアエンジニアリングがファクトリーエンジニアリングになり、製品を構築するものを構築することになるというものです。Warpはこれを内部で実践しています。同社は自社のオープンソースリポジトリをファクトリープラットフォームOzの管理下に置きました。Zachは導入の道筋を、低リスクのリポジトリから始め、自動PRマージ率を20%から60%に向けて段階的に引き上げることだと説明しています。Anthropicも社内で同じ実験を行っているようです。同社によると、製品チームのコードの65%は現在、内部バージョンのClaude Tagによって作成されており、Mike KriegerはWorld's Fairで、彼のチームの使用方法を委任型かつプロアクティブ型と説明しました。「このバグを直せ」ではなく、コードベースのこの部分に責任を持ち、このフィードバックチャンネルを監視し、自分でタスクを拾うというものです。

タスクループと実行ループには明確な終了条件があります。プロダクトループはコードベースとそのバックログを継続的に反復し、その終了シグナルはコードベースの外部(新しいIssue、プロダクションログ、ユーザーフィードバック、レビュー結果)から完全に来ます。人間の役割は設定可能になります。Zachのフレーミングでは、ライフサイクルのどの部分を自動化し、どのポイントで人間を関与させるかを選びます。組織によって、高リスクの変更に対してコードレビューを人間に残すかどうかなどが異なります。ファクトリーは製品を改善します。次のループはファクトリー自体を改善します。

システムループ:自動研究

IntrospectionのRoland Gavrilescuはこれを自動研究と呼んでいます。Latent Spaceのインタビューで彼は次のように概念を説明しました:内側のループはユーザー向けの主要システムであり、外側のループは主要システムを研究し維持します。プロンプト、ツール、モデル選択、評価自体を反復します。彼の一言は「ループが製品である」です。

このパターンには現在、スケールの両端に実際の存在証明があります。最小のケースは、Andrej Karpathyの2026年3月の自動研究で、約630行のPythonコードが1つのGPUで一晩に50の仮説-編集-評価実験を実行しました。製品化されたケースは、6月下旬に発表されたMetaのBrain2Qwerty v2で、研究者らはエージェントがコードベースを反復的に変更してより優れたデコードアーキテクチャを発明し、ワードエラーレートを大幅に改善したと報告しています。Metaの注釈は示唆に富んでいます:最終的なトレーニング設定は依然として手動で選択されました。旗艦システムループでさえ、最後のチェックポイントに人間を残しています。

このループを終了させるのは、最も厳しいシグナルセットです:評価、判定、フィルタリングされた製品フィードバック、そしてRolandの設計では、エージェントが新人従業員のように暗黙知を蓄積するための明示的な「人間に質問する」ツールです。これがスタックのトップです。4つを組み合わせると、システム全体の形状が見えてきます。

4つのループの比較

Agentic MapReduceはどうか?

同じ週の有名なパターンの1つが意図的にこのマップから除外されています。CognitionのDevin Security Swarmは、並列の境界付きエージェントをリポジトリ全体に分散し、その発見を集約します。同社はこれをAgentic MapReduceと呼び、ループと呼ばれています。私はそれがループだとは思いません。分散、収集、検証はパイプラインです。フィードバックが次のサイクルに戻ることはなく、フィードバックのないループは単なるfor文です。ファンアウトは4つのループのいずれかの内部で展開できるトポロジーであり、それ自体がループではありません。

名前のないトップのループは監視ループ

swyxのループ図では、最も外側のリング、ループを作るループの上にあるものは、文字通り「????ループ」とラベル付けされています。その動詞は「目標を設定する、割り当てる、間引く」です。終了条件は「なし」とリストされています。

私はそのループに名前があると思います。私はそれを監視ループと呼んでいます:目標が設定され、予算が割り当てられ、作業が間引かれる場所であり、人間が生きるべき唯一のリングです。AddyはAIEWFのステージで言いました:「その内側のループは能力です。外側のループは主体性です。」主体性こそが監視ループが保持するものです。

AIEWFでの最も鋭い意見の相違は、すべて翻訳すれば、誰がそのトップリングを運営するかについての議論でした。ZachとRolandはダイヤルを上げることを主張します:意識的にチェックポイントを選び、信頼が蓄積されるにつれて自律性を段階的に引き上げ、Rolandの記憶に残る区別では、工場の前にオーケストラを構築します。オーケストラは人間の指揮者を維持するシステムです。反対陣営はダイヤルにストップがあると言います。NotionのGeoffrey LittはXでファクトリーを憂鬱なビジョンと呼び、後にエッセイとして公開した講演で、理解をエージェントに委任する者はエージェントに取って代わられると主張しました。Paul Bakausはそれを簡潔に述べました:「自動はない、そして自動は決してないだろう。」彼の議論は品質だけではなく、所有権に関するものです。人々は目的を必要とし、自分が創造するものに役割を持ちたいと望んでいます。

閉会討論は、Latent Spaceの会議レポートで取り上げられ、両方の立場を同じステージに置きました。HumanLayerのDex Horthyは自分がアンチループではないと強調し、Kubernetesは制御ループ上に構築されているが決定論的であると指摘しました。彼の懸念は、熱意がエンジニアリングを追い越していることであり、彼のアドバイスは抽象化レベルを上げるのではなく下げることでした。Geoffreyは反対側に立ち、ループは不可避だと述べました。Mikeは最も正直なデータポイントを提供しました:Anthropic内部でも、Tagを実行しているチームは、レビューとシステムの動作を概念化する人間の能力がボトルネックになっていると報告しています。彼らが自分たちのために残したチェックポイントが今や制約になっています。

自律性は4つのループのそれぞれに独立して存在するダイヤルです。高度に監督されたプロダクトループ内で完全に自律的な実行ループを実行できます。システムループをエージェントに委ねつつ、目標設定は完全に人間に委ねることができます。興味深いエンジニアリング上の問題は「どの陣営が勝つか?」ではなく、「各ダイヤルを正しく設定するためにどの情報が必要か?」です。

上記の表は、それらの空白を埋める私の試みです。すべてのループ(トップのループを含む)には名前付きの終了条件があり、トップのループはあなたです。しかし、シグナルに名前を付けることは、それを配線することと同じではありません。シグナルのないループは収束しません。それは外部の何かが止めるまでただ実行され続けます。ループが実際に閉じているかどうかを本番規模で知るには、トランスクリプトをスポットチェックする代わりに、トレースを継続的にスイープし、失敗をクラスタリングする必要があります。これはまさにArize AXが構築された仕事です。

あなたはどれを構築していますか?

今やループには名前があります。それが問うべき質問です。「ループ」という言葉は今月、多くの仕事をしています。なぜなら、この分野は次のホットなものに飛びつくことを何よりも愛しているからです。しかし、4つのループすべての背後には実際の実践があり、それぞれで同じ実践が行われています:人々は抽象化のレベルを上げ、人間の判断をスタックのさらに上に押し上げています。それがループの実際の教訓です。スタックを登ることで、私たちはより多くのことを成し遂げます。そして今、あなたには地図があります。どこに登るべきかがわかります。