Show HN:AIエージェントが時代遅れのライブラリを使うのに飽きて、OSを作ってみた
Neonia OSは、AIエージェントのためのクラウドOSであり、セキュアなWebAssembly実行、管理されたグラフメモリ、動的なツール発見を統合します。データ処理をLLMコンテキストからネイティブエッジパイプラインにオフロードすることで、APIコストを99%削減し、エージェントの幻覚を排除します。プラットフォームは永続メモリ、エージェントキュー、システムMCPツールを無料で提供し、コンピュートは呼び出しごとの課金です。エージェントはグルーコードなしで自己オーケストレーションできます。
AIエージェント開発において、インフラストラクチャの断片化は深刻な問題です。開発者はDocker、Redis、Pineconeなどのセットアップに追われ、コンテキストウィンドウのオーバーフローや高額なAPI費用に悩まされています。Neonia OSは「AIエージェントのためのクラウドOS」として、これらの課題を解決する統一プラットフォームを提供します。
Neoniaの核となるのは、「ゼロトラスト」クラウド環境です。WebAssembly(wasm32-wasip1)を実行サンドボックスとして使用し、セキュリティを確保します。従来のアーキテクチャとは異なり、Neoniaは「グラフメモリ」を使用して因果ルールを保存し、動的ツール発見をサポートします。エージェントはMCPプロトコルを介して1つのシステムツールを注入するだけで、必要な機能をオンデマンドで取得できます。
最も注目すべきは「トークンアービトラージ」メカニズムです。従来の設定では、ツールが返す生データ(例:5MBのJSON)がそのままLLMコンテキストに送られ、多大な消費が発生します。Neoniaでは、データはバックエンドでWasmフィルターを通過し、精製された洞察(例:2KB)のみがLLMに返されます。これにより、コンテキストの膨張を防ぎ、最大350万トークンの節約が可能だとされています。
Neoniaはまた、エージェント間通信のためのネイティブキュー(Pub/Sub)と、共有の「デュアルメモリ」(安価なセマンティックメモリと因果ルールメモリ)を提供します。1つのエージェントが問題を解決すると、その経験はグローバルスウォーム全体に即座に継承されます。
料金体系は、基本システム層(メモリとキュー)は完全無料です。標準ツール呼び出しは1回0.002ドル、高度ツールは0.005ドル、AI駆動ツールは0.015ドル、ウルトラツールは0.055ドルです。支払いはHTTP 402プロトコルを介して、呼び出し単位で原子力に課金され、0.001ドルの精度で管理されます。
Neoniaは、1つのAPIキーだけで開始でき、ローカル環境の設定は不要です。提供されたコード例では、Python MCPクライアントを接続するだけで、エージェントが「管理されたグラフツール」を使用して推論を実行できることが示されています。
全体として、Neonia OSはAIエージェントを孤立したスクリプトからネイティブプラットフォームへと進化させることを目指しています。プロンプトの肥大化、ツールのハードコード、状態の非共有といった一般的な問題を解決します。まだ初期段階ですが、エージェントが自律的に発見、計算、委任、進化するというその理念は、AIインフラストラクチャの分野に新たな視点をもたらしています。