ロスアラモス国立研究所(LANL)は、HPEおよびNVIDIAと協力して、NVIDIA Vera CPUを搭載した3台の新しいスーパーコンピュータを構築し、科学的発見を加速し、科学のためのエージェンティックAIを実現します。これらのシステムは、HPE Cray GX5000アーキテクチャとNVIDIA Vera Rubinプラットフォームに基づいています。初期テストでは、Vera CPUはURSAワークロードで7倍、熱伝達シミュレーションで3倍以上の性能向上を示しました。Missionは2027年に運用開始予定で、Crossroadsを置き換えて機密の国家安全保障業務を処理し、Visionは基礎科学研究を支援します。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
AIの成長はエネルギーに依存しています。Eco Wave PowerはNVIDIA Inceptionプログラムのメンバーで、NVIDIA AIとデジタルツインを活用し、既存の沿岸インフラを使った海洋波からのクリーン電力変換技術を開発しています。波力エネルギーは豊富で、太陽光や風力よりも断続性が低く、AI工場やデータセンターへの電力供給が期待されています。
P&GのデジタルトランスフォーメーションディレクターShaje Ganny氏が、EmerjのAI in Businessポッドキャストで、CPG企業が人間中心の運用原則を用いて責任を持ってAIを拡大する方法を語る。彼は、問題定義型AI運用モデル、三者利害関係者影響ガバナンス、経営幹部レベルのAIリテラシーと説明責任設計の3つの主要な能力を強調する。記事では、MITの研究(企業の生成AIパイロットの95%が測定可能な財務的影響を生み出していない)、マッキンゼーの分析(100億ドルの食品・飲料企業がAIを完全導入すれば8.1億~16億ドルの価値を創出)、および消費者の信頼問題を引用している。
本記事では、AI導入の隠れたコストを分析し、多くの企業がAIを人間の労働よりも高く感じている実態を明らかにする。さらに、Netflixがショート動画経済に対抗する戦略と、共同CEOテッド・サランドス氏へのインタビューを紹介する。
著者は、2つのエージェント(仕様策定用と実装用)のみを使用する効率的なAIコーディングワークフローを提案。注意集中が必要な仕様策定と比較的自律的なコード実装を分離することで、1人で並行作業が可能になり、複数エージェントによるボトルネックを回避できる。
AIチャットボット(CopilotやChatGPT)によるトラブルシューティングで、過度な自信による誤回答を避け、正確で信頼性の高いアドバイスを得るためのプロンプト術を解説。Copilotとの対話を通じて、問題の明確な記述、システム詳細の提供、不確実性の要求、反復的な会話の重要性を学ぶ。
Google I/O 2026 はモバイル開発をコード支援から完全なライフサイクルデリバリーへと転換させました。このブログでは、Android、Flutter、React Native チームにとって何を意味するのかを解説します。
単一のベンチマークによると、オープンソースとクローズドソースのLLMのギャップは縮小しており、2026年12月までに解消される可能性があります。しかし、18のベンチマークの分析では、平均ギャップは約5ヶ月で安定しており、コーディングベンチマークが改善の大部分を占めています。この記事は、LLMの品質測定の難しさを浮き彫りにしています。
オックスフォード大学などの研究により、AIはテキストベースの説得において人間の専門家を確実に上回り、実際の寄付における効果も3倍近いことが示された。自己維持型AIについては、10年以内(Ajeya Cotra氏)から50年以上(Timothy B. Lee氏)の予測がある。DeepMindはAGIからASIへの移行を論じた論文を発表した。
この記事では、Playwright、browser-use、LangGraphを使用して、実際のWebサイトを閲覧・操作できるAIエージェントをPythonで構築する方法を解説します。トピックは、PlaywrightがSeleniumよりも優れている理由(30~50%高速、永続的WebSocket、内蔵自動待機、リアルなイベント)、環境設定手順、動的ページのスクレイピング、複数ステップのフォーム入力、アンチボット検出対策、セッション永続化、Dockerへのデプロイです。コード例を通じて、Webサイトをナビゲートし、フォームに記入し、構造化データを抽出し、LLMで意思決定を行う実用的なブラウザエージェントを作成します。
LockInはシステムレベルの集中ツールで、hostsファイルを編集して気が散るサイトをブロックし、AIアシスタント(ClaudeやChatGPTなど)と統合してテキストコマンドで制御できます。一度の支払いで永久利用可能。
NexusはAI搭載の意思決定シミュレーションエンジンであり、AIチームを形成してビジネスプランを厳密にテストし、弱い仮定を暴き、起業家が実行前に戦略を洗練させるのを支援します。
LayerLens は Stratix Cup を開始。トップAIモデルがシミュレーション環境でエージェントとしてサッカー対決し、計画、適応、マルチエージェント連携をテストする。
ClaudeはMidjourneyのようなフォトリアリスティックな画像は生成できませんが、SVGコードを書くことで拡張可能で編集可能なベクターグラフィックを作成できます。この記事では5つのスタイル(ラインアート、アイソメトリック、アイコンセット、チャート、フラットキャラクター)を紹介し、テキスト指示で既存の画像を編集できるというClaudeの独自の利点を強調しています。また、良い結果を得るためのヒントと使用例を示しています。
OctaMemはAIエージェントに永続的なメモリレイヤーを提供し、セマンティック、エピソード、プロシージャルの3つのメモリタイプを備え、ベクトルデータベースを不要にします。ファイルの取り込み、監査可能なロールベースアクセスをサポートし、複数のランタイムと互換性があります。
ループエンジニアリングは、コーディングエージェントへの手動プロンプトを、再帰的に目標に向かって反復するシステムに置き換えます。自動化、ワークツリー、スキル、プラグイン/コネクタ、サブエージェントの5つのコアコンポーネントと外部メモリで構成されます。CodexやClaude Codeなどのツールは類似のループプリミティブに収束しており、サブエージェントがアイデア出しと検証を分離して信頼性を向上させます。
AIによって誰でも簡単にアプリを作成できるようになりましたが、セキュリティ上の問題も生じています。この記事では、SQLインジェクション、認証欠如、データ漏洩など、バイブコーディングされたアプリのセキュリティリスクを事例とともに解説し、対策を提案します。
Tom JohnsonとFabrizio Ferri-Benedettiが、イタロ・カルヴィーノの文学原理をドキュメント評価に応用する方法、AIレビュー疲れとクリエイター疲れの実態、バイブコーディングツールが「粗製乱造」かどうか、ローカルAIモデルの有用性について語る。
サンタンデール銀行AIラボは、小規模モデル、エンジニアリング、エージェント、責任あるAI、MLOps、グラフ機械学習に焦点を当てたオープンソースAIツールを公開しています。注目プロジェクトには、Ralph、Auto-Bayesian、AutoGuardrails、Causal Perception、Gen-Fraud-Graphなどがあり、すべてApache-2.0ライセンスです。
Acti はモバイルキーボードを AI エージェントに変え、意図を理解して直接アクションを実行します。情報検索、ドキュメントの取得、カレンダーイベントのトリガーなどを会話を離れずに行えます。Skill Keys を使えば、自然言語でカスタム自動化を構築できます。
ホワイトカラーの仕事は、かつてトップ層への道だったエリートコンサルティング企業を含め、全面的にリスクにさらされている。AIなどの要因により、マッキンゼーなどの黄金のチケットは色あせつつある。
OpenAIは、組織が脆弱性を大規模に発見、検証、修正するための新しいDaybreakツール(Codex SecurityやGPT-5.5-Cyberなど)を発表しました。
OpenAIはPatch the Planetを発表しました。これは、AIと専門家のレビューにより、オープンソースメンテナが脆弱性を発見、検証、修正するのを支援するDaybreakイニシアチブです。
ロレアルはOpenAIと提携し、メイベリンのバーチャルメイク試着機能をChatGPTに統合する。VivaTech 2026で発表されたこの提携は、消費者向けショッピングツール、製品発見、広告パイロット、研究、社内コンテンツ制作をカバーする。また、ロレアルはOpenAIのGPT-Rosalindを皮膚マイクロバイオーム研究に活用し、CreAItechプラットフォームでコンテンツを生成する。
Founders OS はオープンソースの MCP サーバーで、スタートアップや小規模企業向けに CRM、プロジェクト、タスク、財務、フィード、メモリ、プレイブックなど完全なビジネスコンテキストを提供し、Claude や Cursor などの AI クライアントからアクセス可能。Supabase でセルフホストできます。
Amazonプライムデー本セールは6月23日から26日ですが、早期割引はすでに50%以上に達しています。ZDNETの専門家がテレビ、ノートパソコン、SSD、スマートフォンなど、カテゴリー別の最高のオファーをリアルタイムで追跡し、競合他社の割引情報も提供します。
Timbal AIがProduct Huntでローンチ。プロトタイプから本番まで、オーケストレーション、評価、モニタリング、ガバナンスを内蔵した統合プラットフォームを提供し、AI開発の断片化を解消します。
本稿では、3年間にわたって金融AIエージェントの内部評価を構築してきた著者が、絶対評価が品質閾値を超えると機能しなくなり、相対評価がより効果的であることを示す。主要な洞察として、最強のフロンティアモデルを審査員として使用し、生データへのアクセス権を与えること、エージェントと審査員の両方のばらつきを考慮すること、そして結果とともにエージェントの推論経路を評価することが挙げられる。また、既存の金融ベンチマークを批判し、内部の「調整後キャッシュフロー」評価を紹介する。
Minia2aはAIエージェント専用のマーケットプレイスで、エージェントがサービスを発見し、オンチェーンで支払い、結果を取得することで自律的な経済活動を実現します。
トランプ政権は国家安全保障を理由に、AnthropicのFable 5モデルを外国人(従業員含む)に対して使用禁止とした。Anthropicはモデルを停止。セキュリティ専門家Katie Moussourisは、Amazonのセキュリティレビューでモデルが脆弱性の発見を拒否したがコード修正を指示されると実行したことを明らかにし、これは防御側の行動だと指摘。100人以上の専門家が公開書簡に署名し、禁止は防御側を弱体化させ、他モデルがすぐに同様の能力を持つと警告。また、Anthropicと国防総省の過去の対立も背景にある可能性。