AI News HubLIVE
サイト内リライト2 分で読了

Anthropic、Claude Mythos AIモデルの一般公開を拡大

Anthropicは、Project Glasswingを通じてClaude Mythosモデルへのアクセスを拡大すると発表。6〜12ヶ月以内に広く利用可能になる見込み。このモデルは脆弱性を発見し、エクスプロイトチェーンを生成できるが、現在はパートナーのみに制限されている。

ソースHacker News AI著者: divija_07

人工知能企業Anthropicは、その物議を醸すClaude Mythosモデルへのアクセスを拡大すると発表した。このモデルは強力な脆弱性発見・悪用能力を持つため公開が制限されていたが、Anthropicは今後数ヶ月でより多くのパートナーに段階的に開放する方針だ。

MythosはAnthropicが開発した大規模言語モデルで、ソフトウェアの脆弱性を unprecedented なレベルで発見するだけでなく、完全なエクスプロイトチェーンを生成でき、時には低深刻度の欠陥を組み合わせて高深刻度の脅威にすることもできる。この能力から、Anthropicは当初Project Glasswingを通じて、Cisco、Oracle、Microsoftなどの厳選された約50のパートナーのみにアクセスを制限していた。

Anthropicは金曜日の声明で「米国および同盟国政府を含む重要なパートナーと協力し、Project Glasswingをさらに多くのパートナーに拡大する。近い将来、必要な強力な安全対策が整い次第、Mythosクラスのモデルを一般公開できることを楽しみにしている」と述べた。

同社は、攻撃者が同等のツールを持つまで時間の問題だと強調する。「Mythosレベルのモデルは今後6〜12ヶ月で広く利用可能になると確信している。」

パートナーはMythosを通じて1万以上の高/重大な脆弱性を発見しており、そのうち6,202はオープンソースソフトウェアに存在する。Anthropicによると、第三者が1,752の脆弱性をレビューし、91%が実際の欠陥であることを確認し、3分の2の深刻度評価が正しかった。

英国AI安全研究所は先月、Mythosが管理された評価で自律的に多段階攻撃を実行し脆弱性を悪用できると報告した。これらのタスクは通常、人間の専門家が数日かかる。しかし、同研究所は典型的な企業防御環境をシミュレートしていないため、Mythosが十分に防御されたシステムを攻撃できるかは確実ではないと述べている。

脆弱性発見のペースが加速するにつれ、ソフトウェアメンテナはAI支援研究者による重複報告の急増に直面している。Microsoft傘下のGitHubは、バグ報奨金プログラムを調整し、「実際のセキュリティ影響を示さない提出」の増加に対応した。

Glasswing参加者のCloudflareは、Mythosをチャットインターフェースではなく脆弱性発見ツールとして扱い、狭い指示と複数のエージェントの並列作業により効率が向上したと共有した。Anthropicは、審査済みセキュリティチームにカスタム指示、コードマッピングツール、脅威モデルビルダーを提供し、脆弱性の優先順位付けを支援する。

それでも専門家は、パッチ適用速度には理論上の限界があり、組織は修正のテストと展開が必要であり、アーキテクチャ設計は未解決の問題だと指摘する。CloudflareのCSO Grant Bourzikasは「脆弱性が存在しても攻撃者の悪用を困難にし、開示からパッチまでのギャップを小さくする」ことが原則だが、実際の実装はまだ発展途上だと述べた。