AI News HubLIVE
サイト内リライト2 分で読了

私たちは恐ろしい間違いを犯した

著者はAIの支援を借りてコスト削減のためのGoベースのキャッシュ層を構築したが、探索的テスト中に根本的な設計上の欠陥を発見した。IP情報をプレフィックスレベルでキャッシュしていたが、VPN出口ポイントにはIP単位の精度が必要だった。複数回のコードレビューとテストを経ても、すべてのAIモデルがこの問題を見逃していたが、「恐ろしい間違いを犯した」とClaudeに促すと、即座に問題を特定した。これは、AIが「構築モード」にあり、問題自体の正しさを検討していないことを示しており、人間が問題定義において主導権を握る重要性を強調している。

ソースHacker News AI著者: petesergeant

ここ数日、私は賢い節約術を実現していました。有料サービスに対する、Goベースのアグレッシブなキャッシュ層です。シャワー中のひらめきからAIエージェントとの詳細計画、大規模だが迅速な構築、そして複数層のコードレビューと強化に至るまで、完璧に見えました。エッジケースも発見・修正され、私とAIによる回帰テストもパスし、私は勝利を確信していました。

しかし、探索的テスト中に、よくある悪寒が突然襲ってきました。全体に根本的な設計問題があることに気づいたのです。微妙だが致命的な、キャッシュ対象サービスの考慮漏れでした。IP情報をプレフィックスレベルでキャッシュしていたのですが、これはほとんどの場合は問題ありませんが、私が気にするいくつかのカテゴリ、特にVPN出口ポイントでは、IP単位の精度が必要でした。「ホスティングIP」はプレフィックスレベルで問題ありませんが、「VPN出口ポイント」は多くの場合、個別のIPアドレス単位で扱う必要があります。

Claudeに入力しようとして「私たちは恐ろしい間違いを犯した」と打ったところ、誤ってEnterキーを押してしまいました。しかし、Claudeは私が何を言う前に、正確にその恐ろしい間違いを特定しました。これまで何度もコードベースは本質的に完璧だと宣言し、CodexやGrokからも承認を得ていたにもかかわらずです。Claudeの反応は驚くほど迅速でした。

何が起こったのか?Claudeよ、もしこれがそんなに明白で根本的な間違いなら、なぜ設計段階の何度ものラウンドで一度も見つからなかったのか?なぜ他のLLM——設計時に何度も意見を求めた——も気づかなかったのか?Claudeの意見(私も同意見)では、私たちは賢い解決策からスタートしたため、問題を広く見渡す一歩を踏み出す必要がなかったのです。構築に没頭しすぎて、実装は素晴らしかったが、根本的な設計欠陥を見逃した。すべてのモデルは「うまく構築する」モードにあり、「正しい問題を解いているか」のモードではなかった。私たちが「どう失敗したか」に切り替えた瞬間、Claudeは難なく問題を特定しました。

人間なら気づいたでしょうか?結局私が気づいたので、より良い質問は「別の人間がトークンを消費する前に気づいたか」でしょう。他の人間を巻き込まなかった利点の一つは、あまり時間を無駄にしなかったことです。本来なら少なくとも1週間かかるサービスが、1営業日で構築されました(上記の問題は別として)。今、私は最近手がけたすべてのコードベースに戻り、「恐ろしい間違い」があると主張して、Claudeが見つけられるか試しています…

この物語は、AIが協調開発において持つ重要な盲点を浮き彫りにしています。AIは実装の最適化には優れていますが、問題の根本的な前提を疑問視することは苦手です。これは、どれほどAIが強力であっても、人間が問題定義の主導権を握り続ける必要があることを思い出させてくれます。システムを設計する際には、時々一歩下がって「私たちは正しい問題を解いているか?」と自問することが不可欠です。そうしなければ、精巧な間違いを構築してしまうかもしれません。