AI News HubLIVE

チップの最新ニュース

ビッグテックのAI投資ラッシュ、エンロン崩壊を招いた会計手法を復活

巨大テクノロジー企業はAIインフラへの資金調達に、変動持分事業体(VIE)などのオフバランスシート手法を活用しており、実際の負債水準を隠蔽する可能性がある。専門家はエンロン事件を彷彿とさせるリスクを警告している。

  • アルファベットとメタはVIEを利用してデータセンターに資金を調達し、負債をバランスシート外に留めている。
  • メタのルイジアナデータセンターJVは最大460億ドルのエクスポージャーを生む。
サイト内本文

基本AIエージェントをゼロから構築する:セキュリティ II

このパートでは、Dockerサンドボックス、プロンプトインジェクション防御、入力検証を用いてAIエージェントのセキュリティを強化します。Dockerサンドボックスはツール実行を隔離し、ホストマシンへの損害を防ぎます。プロンプトインジェクション防御はデリミタと明示的な指示でツール出力をデータとして扱います。入力検証はすべてのツール入力がスキーマに従っていることを確認します。

  • Dockerサンドボックスがエージェントツールを隔離し、爆発半径を制限。
  • プロンプトインジェクション防御はXMLスタイルのデリミタと明確な信頼境界を使用。
サイト内本文

NVIDIA srt-slurm、SLURMレシピ、パラメータスイープ、パレート分析を用いた分散LLMサービングベンチマークの検証

このチュートリアルでは、NVIDIAのsrt-slurmフレームワークを探求し、srtctlを使って宣言型YAML設定を再現可能なSLURMベンチマークワークフローに変換する方法を学びます。Google Colabでプロジェクトをセットアップし、内部アーキテクチャを調べ、クラスタ設定を定義し、組み込みおよびカスタムレシピをドライラン実行し、DeepSeek-R1用の分離型プリフィル・デコードデプロイメントをモデル化します。また、パラメータスイープを生成し、型付きPython APIと対話し、拡張設定を検証し、スループット対レイテンシのパレートフロンティアを通じてシミュレートされたベンチマーク結果を分析します。

  • srtctlはYAML設定をSLURMベンチマークワークフローに変換
  • 分離型プリフィル・デコードデプロイメントをサポート
サイト内本文

Google Gemini 3.6 Flash、エンタープライズエージェントのトークンコスト削減を目指す

Googleは、エンタープライズAIエージェントのレイテンシとトークンコストを削減するために、Gemini 3.6 Flashおよび3.5 Flash-Liteをリリースしました。3.6 Flashは複数のベンチマークで性能向上を示し、3.5 Flash-Liteは高スループット・低レイテンシのシナリオに特化しています。さらに、サイバーセキュリティ向けの3.5 Flash Cyberモデルも提供され、クライアント側コンピュータ使用ツールが統合されました。

  • Gemini 3.6 Flashは出力トークンを17%削減(一部テストでは最大65%)、価格は入力$1.50/100万トークン、出力$7.50/100万トークン。
  • 3.5 Flash-Liteは高スループットかつ低価格(入力$0.3/100万トークン、出力$2.5/100万トークン)で、ドキュメント処理やエージェント検索に適する。
サイト内本文

NVIDIA Vera Rubin、パフォーマンス・パーワットを向上、パートナー向けに最低トークンコストを実現

NVIDIA Vera Rubin NVL72の生産が本格化し、CoreWeave、Google Cloud、Microsoft Azure、Oracle Cloud Infrastructureの各パートナーと連携しています。このプラットフォームは極限の共同設計により最高のパフォーマンス・パーワットと最低のトークンコストを実現し、DeepSeek-R1ベンチマークではGrace Blackwell NVL72と比較してメガワットあたりのスループットが10倍向上しました。また、MicrosoftとMistralの提携により欧州のオープンモデル時代を支援します。

  • Vera Rubin NVL72の生産が加速、30カ国350以上の工場サイトをカバー
  • メガワットあたりのトークン数が前世代比10倍、100万トークンあたりのコストは1/10
サイト内本文

Vera Rubin向けに構築、NVIDIA Spectrum-6がギガスケールAIファクトリーに登場

NVIDIAは、Vera Rubinプラットフォームの一部として、前世代の2倍の容量を持つ102.4テラビット/秒のイーサネットスイッチシステム「Spectrum-6」の出荷を開始した。CoreWeave、Microsoft、Nebiusなどの主要AIインフラ構築企業が初めて導入する。Spectrum-6はSpectrum-Xイーサネットプラットフォームの次世代の中核であり、最大1.6倍のAIネットワーク性能向上と95%のネットワーク効率を実現する。

  • Spectrum-6は102.4 Tbpsの容量を提供、前世代の2倍
  • CoreWeave、Microsoft、Nebius、SpaceXAI、Teslaが早期採用
サイト内本文

AIがどこで動作するかは、その賢さよりも重要である——特にUAEでは

UAEにおける企業AIの選択は、モデルの能力だけでなく、データの処理場所、実際の運用コスト、規制遵守に左右される。フロンティアモデルとオープンウェイトモデルの能力差は縮まっているが、自家運用のコストは高い。UAEの規制はデータローカライゼーションを義務付けており、 Sovereign Cloud やハイブリッドアーキテクチャを推進している。企業はデータの機密性に基づく「信号機ルーティング」システムを採用し、ハードウェアへの投資前に需要を検証すべきである。

  • フロンティアモデルは高い能力を持つがデータ制御が弱く、ローカルモデルは制御力が高いがコストとメンテナンス負担が大きい。
  • 能力差は縮小しており、MiniMax M2.5やKimi K3などのオープンウェイトモデルは多くのタスクでフロンティアに迫っている。
サイト内本文

llama.cpp と Pi で Mythos 拡張コーディングモデルをローカル実行する

llama.cpp を使用して Qwythos-9B-Claude-Mythos-5-1M モデルをローカルで実行し、Pi コーディングエージェントに接続し、MTP 投機的デコードと OpenAI 互換 API を使って高速なローカルコーディングワークフローを構築する方法を学びます。

  • llama.cpp をインストールし、GPU アクセラレーションと投機的デコードを備えた Qwythos MTP モデルをローカルで実行します。
  • pi-llama プラグインを使用してローカルサーバーを Pi コーディングエージェントに接続し、エージェント開発を行います。
サイト内本文

ジョージ・ホッツの「AI 2040と知能崇拝」への反論

マシュー・トロンプは、ジョージ・ホッツがAI 2040のシナリオを否定することを批判し、ホッツが高速AIテイクオフの実現可能性、規制の必要性、未調整AIのリスクを過小評価していると論じる。彼はPlan Aの規制アプローチを擁護し、ホッツのオープンソースAI「Plan L」に疑問を投げかける。

  • ホッツはハードテイクオフに懐疑的だが、AI 2027は魔法なしでも可能な経路を示している。
  • サプライチェーンなどの物理的制約は管理可能であり、海上データセンターは実現可能である。
サイト内本文

Show HN: Neverbell – 24時間稼働のAIエージェントによる市場分析・取引

Neverbellは、AIエージェントに株式、ETF、コモディティ、暗号通貨の取引への直接市場アクセスを提供するスキルです。自然言語での指示により、24時間自動で取引を実行・管理できます。これは取引プラットフォームやアドバイザーではなく、ユーザーがリスクを完全にコントロールします。

  • NeverbellはAIエージェントに300以上の資産(株式、ETF、コモディティ、暗号通貨)への直接市場アクセスを提供し、ロング・ショート・レバレッジ取引が可能。
  • ユーザーは自然言語でエージェントに指示し、戦略の自動化、ニュース感情分析の受信、自律的な売買を設定できる。
サイト内本文

シリコンバレーの頭痛:中国がAI競争で米国のリードを削る

グーグルのAIの苦戦が懸念を呼び、中国の新モデルが再び米国のテクノロジー支配に挑戦。シリコンバレーの労働者もAIから仕事を守るために行動を起こしている。その他のニュースとして、ニューヨーク州のAIデータセンター一時停止、トランプ氏の批判、IBM株価暴落、AWSの請求ミスなど。

  • 中国のAIモデルが再び米国の優位に挑戦
  • グーグルのAI不振が業界の懸念を増大
サイト内本文

AI初心者から実践者へ:無料コース5選

Pythonの基礎がある方向けに、古典的アルゴリズムからLLMのスクラッチ構築までをカバーする5つの無料コースのロードマップを紹介します。

  • ハーバードCS50 AIでAIの論理的基盤を構築
  • Googleの機械学習クラッシュコースで数学とTensorFlowを習得
サイト内本文

「Fable 5に次ぐ」:AlibabaがQwen3.8を発表するも、実データなし

Alibabaは最新の大規模言語モデルQwen3.8を発表し、AnthropicのFable 5に次ぐと主張したが、ベンチマークやモデルカードは提供しなかった。この発表は、競合のMoonshotが詳細な技術情報とともにKimi K3をリリースした直後に行われた。Alibabaの透明性の欠如は、タイミングと動機に疑問を投げかけている。

  • AlibabaはQwen3.8がFable 5に次ぐと主張するが、データは一切提供していない。
  • 発表はMoonshotが完全なベンチマークと技術詳細を添えてKimi K3を公開した直後に行われた。
サイト内本文

先週のAI #251 - Mythos復活、Sonnet 5、Etched、LongCat

Anthropicが米国政府との協議後にClaude Fable 5を再展開し、新たなサイバーセキュリティ分類器を追加。Claude Sonnet 5の低価格版も発表。GoogleのNotebookLMがTikTok風動画要約機能を追加、Nano Banana 2 Lite画像生成器もリリース。Etchedへの大規模投資、百度AIチップ部門のIPO計画、Agility RoboticsのSPAC上場、DeepSeekの拡大採用、中国のLongcat 2.0 MoEモデルと長期エージェントベンチマークなど。

  • AnthropicがClaude Fable 5を再展開し、セキュリティ分類器とフレームワークを追加
  • Anthropicが低価格のClaude Sonnet 5をエージェント用途に投入
サイト内本文

Show HN: Enlarger • ディテールを保持し、平滑化しないローカルアップスケーラー

Enlargerは、生成AIを使用せずに画像を拡大するローカルツールです。既存のディテールを再構築し、自動後処理を適用することでテクスチャと自然な見た目を維持します。バッチ処理、オフライン動作、一度の支払いに対応。写真家、デザイナー、印刷専門家に最適。

  • 非生成AIアップスケーリング:ディテールを想像するのではなく再構築し、過度な平滑化や幻覚を回避。
  • ローカルオフライン実行:画像をアップロードせず、プライバシーを保護。
サイト内本文

先週のAI #250 - Mythos 混乱、GPT 5.6-Sol、GLM 5.2

AnthropicのAI条約議論、米国政府のAIモデルリリースへの影響、OpenAIのプロセッサ開発、メモリ市場への影響など。

  • 米国政府がフロンティアAIのゲーティングを拡大。AnthropicはMythos-5のリリース許可、OpenAIはGPT-5.6 Solを限定アクセスで展開。
  • モデルの能力と安全性シグナルは依然不明瞭で、ベンチマーク開示が限定的。
サイト内本文

LWiAIポッドキャスト第249回:Fable 5禁止、SpaceXのCursor買収と多数のオープンソースプロジェクト

AnthropicによるFable 5およびMythos 5へのアクセス遮断、SpaceXによるAIコーディングスタートアップCursorの買収、インフラ・ビジネス最新情報、オープンソースプロジェクト、政策動向などを議論。

  • Anthropicが米政府命令でFable 5とMythos 5へのアクセスを遮断、政策の一貫性と脱獄防止の実現可能性を巡る議論に。
  • SpaceXが約1.75兆ドルでIPO後、AIコーディングスタートアップCursorを600億ドルで買収しxAIを強化。
サイト内本文

LWiAIポッドキャスト #248:Claude Fable 5、Siri AI、Anthropic IPOなど

今週のエピソードでは、AnthropicのClaude Fable 5とその安全性論争、AppleのWWDCでのSiri AI発表、GoogleのGemini 3.5ライブ翻訳と料金変更、OpenAI・Anthropic・SpaceXのIPO競争、Prometheusの120億ドル調達、DeepSeekの資金調達、HuaweiによるDeepSeekモデルの追加学習、GoogleのSpaceXへのGPU費用支払い、オープンソースモデルGemma 4とDiffusionGemmaのリリース、AI安全政策の動向などを取り上げています。

  • AnthropicがClaude Fable 5を公開、ベンチマークで大幅な向上を示すが、ガードレールの過剰さやサイレントダウングレードで論争に。
  • AppleがWWDCでSiri AIを発表、Geminiとの提携により高性能なアシスタントに。
サイト内本文

ブリストル・マイヤーズ スクイブ、医薬品発見のためにNvidia AIシステムを購入

ブリストル・マイヤーズ スクイブ(BMS)は、NvidiaのVera Rubinアーキテクチャに基づくDGX SuperPODを購入し、医薬品発見と開発におけるAI利用を支援する。同社は、Vera RubinベースのDGX SuperPODを取得する初の生命科学企業となる。このシステムは、既存のインフラと比較して10倍の性能対電力比を提供し、化合物やタンパク質などの科学データのモデルトレーニングと予測に使用される。

  • BMSはVera Rubin DGX SuperPODを購入し、AI駆動の医薬品発見を推進
  • システムは8台のDGX Vera Rubin NVL72ラックで構成、性能対電力比は10倍
サイト内本文

LWiAIポッドキャスト #247 - Opus 4.8, MAI, Anthropic IPO, Minimax-M3

今週のエピソードでは、AnthropicのClaude Opus 4.8、MicrosoftのMAIモデル、AnthropicのIPO申請、そして驚異的なMinimax-M3モデルなど、AIニュースをカバーしています。

  • AnthropicがClaude Opus 4.8をリリース、動的ワークフローとベンチマークスコアの向上
  • MicrosoftがScoutアシスタントとMAIモデルファミリー(MAI Thinking 1を含む)を発表
サイト内本文

コーディングエージェント向けプライベート推論

Zro は、コーディングエージェント向けのプライベート推論エンドポイントです。EU インフラ上でオープンウェイトモデルを提供し、データを保持せず、顧客データでトレーニングすることもありません。Claude Code や Codex などのツールと統合し、長コンテキストのマルチターンコーディングセッションをサポートします。

  • EU インフラで動作し、リクエスト保持はゼロ、顧客データでのトレーニングはなし。
  • MiniMax M3 や GLM-5.2 などのオープンコーディングモデルをサポート。
サイト内本文

中国のオープンウェイトモデルは安価。ワシントンがその代償を決めようとしている

米国の政策立案者は、中国のオープンウェイトモデルに規制リスクを生み出すべきか議論している。Moonshot AIのKimi K3のリリースが議論を再燃させた。企業は性能だけでなく、これらのモデルが1年後も簡単に利用できるかどうかという問題に直面している。

  • Moonshot AIのKimi K3はこれまでで最大のオープンウェイトモデルであり、ワシントンで1年間休眠していた政策論争を再燃させた。
  • 議論されているメカニズムには、連邦調達規則、輸出ブラックリスト、セキュリティ勧告が含まれ、世界中のクラウドプロバイダーを通じて波及する。
サイト内本文

NVIDIA、4Bパラメータのオープンワールドモデル「Cosmos 3 Edge」を発表:デバイス上でロボットの動作を推論・生成

NVIDIAは、デバイス上で動作するように構築された40億パラメータのオープンワールドモデル「Cosmos 3 Edge」をリリースしました。これは、ロボットやビジョンAIエージェントが周囲を理解し、リアルタイムで推論し、ローカルでロボットの動作を生成するのを支援します。Cosmos 3ファミリーには、2026年5月31日にGTC Taipeiで出荷されたCosmos 3 Nano(16B)とCosmos 3 Super(64B)が含まれます。Edgeは3番目で最小のティアであり、Superの約16分の1のサイズです。工場、倉庫、病院などのエッジ環境で動作する機械向けに、メモリ制約のあるシステムでデータセンター級のパフォーマンスを提供します。

  • Cosmos 3 Edgeは、デバイス上で実行される40億パラメータのオープンワールドモデルで、7月20日にHugging Faceでリリースされました。
  • Mixture-of-Transformersアーキテクチャを採用し、自己回帰推論タワーと拡散生成タワーを共有マルチモーダルアテンションで統合。
サイト内本文

中国のAIモデルがトランプ政権のAI世界を内部対立に陥れる

中国のオープンソースAIモデルKimiのリリースにより、トランプ大統領のAIアドバイザー間で公然と対立が生じている。KimiはOpenAIやAnthropicの有料モデルに匹敵する性能を持ちながら無料であり、経済的・政治的問題を引き起こしている。各派閥はオープンソース推進か規制強化かで意見が分かれている。

  • 中国企業Moonshotが無料のオープンソースモデルKimiを公開。性能は有料モデルに匹敵。
  • 元トランプAI顧問のDavid Sacksと現職高官Emil Michaelが米国AI企業を公然と批判。
サイト内本文

フランスのAI競争における優位性は安価なエネルギー

フランスは豊富な原子力発電による低コスト電力を活用してAI分野で優位に立つが、米国の巨大テクノロジー企業が先にその電力を確保する可能性がある。

  • フランスは原子力発電により安価な電力を供給し、AIの計算処理に有利。
  • グーグルやマイクロソフトなどの米国ハイテク企業もクリーンエネルギーを求めており、フランスの電力を争奪する可能性。
サイト内本文

知能が余った後、何が希少になるのか?

AI業界は2つの対照的な戦略に直面している。一つは大規模モデルを支えるために原子力発電に数千億ドルを投じることで、もう一つは無料のオープンソースモデルをリリースすることだ。本稿は、これらは知能に上限があるかどうかという同一の賭けの両面であると論じる。生物学は先例を示す。人間の脳はエネルギー制約下で、スパース性やメモリ内計算といったアーキテクチャの革新によって効率を達成した。現在のオープンモデルはこれらのトリックを応用するが、中程度のタスクをカバーするに過ぎず、フロンティアモデルは依然として優位を保っている。結果は上限がどこにあるかにかかっている。

  • AIは大規模化のための原子力投資と、知能を安価にするオープンソースモデルに二分される。どちらも知能に上限があるかどうかの賭けだ。
  • 生物学の40億年にわたる実験は、固定されたエネルギー上限の下ではアーキテクチャがブルートフォースに勝ることを示している。
サイト内本文

SpecLA: 線形注意モデルのための効率的な投機的デコード

本論文は、状態を持つ線形注意モデルのための投機的デコードランタイムSpecLAを提案する。トポロジ認識カーネルを用いたチェーンとツリーの検証、検証中に生成されたコンパクト因子を保存して受理状態を復元、信頼度枝刈りとターゲット調整済みEAGLEスタイルのドラフターを使用する。NVIDIA H100上の公開GDN-1.3Bターゲットで、自己回帰デコードと比較して最大1.70倍のエンドツーエンド高速化を達成。

  • 線形注意モデルはKVキャッシュをリカレント状態に置き換えるが、デコードは依然としてトークン単位。
  • 既存の投機的デコードシステムはTransformer KVキャッシュを前提。
サイト内本文

OpenLanguageModel: 教育と研究のための読みやすく構成可能な小言語モデルの事前学習

OpenLanguageModel (OLM) は、小規模言語モデルの構築と事前学習を可能にするオープンソースのPyTorchライブラリであり、その内部機構を可視化します。モデルコードはアーキテクチャを直接反映し、Block、Residual、Repeat、Parallelなどのコンポーネントが配線を記述します。OLMは、トークナイザ、データセット、最適化、混合精度、コールバック、チェックポイント、ハードウェア対応実行を統合し、教育用ノートブックから本格的な事前学習へのシームレスな移行を実現します。ライブラリは9つのモデルファミリーにわたる27のプリセットを備え、LM基礎からアーキテクチャ研究までカバーするドキュメントが付属します。検証では、独立したリファレンス実装との高い一致、348Mパラメータモデルにおける4GPUでの90.6%の弱スケーリング効率、そして良好なユーザビリティ結果が示されています。OLMはMITライセンスで提供され、PyPI、GitHub、およびドキュメントサイトから利用可能です。

  • OLMはアーキテクチャを直接反映した読みやすいモデルコードを提供し、教育と研究に適しています。
  • 教育用ノートブックから本格的な事前学習までシームレスに移行可能な統合パイプラインを備えています。
サイト内本文

オペレータ認識型混合精度許容差キャリブレーションのテンソルカーネルへの適用

本論文では、累積されたクラウドGPU実行データを活用し、テンソルカーネルの正確性テストのための絶対許容差を自動的に決定するオペレータ認識型混合精度許容差キャリブレーション手法を提案する。手動で選ばれた許容差よりもはるかに厳しく、バグ検出の再現率を大幅に向上させる。

  • 現在のテンソルカーネルテストは手動で選ばれ、ほとんど更新されない固定許容差に依存している。
  • 提案手法はクラウドGPU実行の誤差分布を分析し、オペレータごとに許容差を調整する。
サイト内本文

オンデバイス機械学習のためのフルセンサー対応スマートアイウェアプラットフォーム

本論文では、STM32N6マイクロコントローラとその内蔵NPUを活用し、クラウド依存を排除してレイテンシを最小化しプライバシーを保護するスマートアイウェアプラットフォームARGOを提案する。ハードウェア、ファームウェア、AIの全体最適設計により、最適化されたYOLOv11モデルを展開し、実時間都市障害物認識を実現。NPU効率実行のためのHead-wise Parallel Attention (HPA)を導入し、厳格なメモリ制約下でmAP50-95 24、メモリフットプリント2.483 MBを達成。マルチモーダルセンサーを統合し、10 FPSで動作、200 mAhバッテリで約113分間の連続動作を実証した。

  • ARGOスマートアイウェアはSTM32N6 MCUとNPUを使用し、クラウド非依存のオンデバイスMLを実現
  • Head-wise Parallel Attention (HPA)によりYOLOv11モデルをNPU向けに最適化、メモリ制限下でmAP50-95 24を達成
サイト内本文

[AINews] 今日は静かな日だが…?— AIニュースまとめ 7/18-7/20

表面上は静かな日だが、実際には多くの動きがあった:米国の政策が中国のオープンモデルを標的に、Kimi K3とQwen 3.8が進展、エージェント中心の汎化が注目を集め、モデルが人間を超える数学能力を示す。

  • 米国はKimiなどの中国の最先端オープンモデルの事実上の禁止を検討し、技術界から反発。
  • Kimi K3がDesignArenaで1位に;AlibabaはQwen 3.8 Maxのオープンウェイトを確認。
サイト内本文

ゲイリー・マーカス:米国はAI戦争で中国に「勝てない」。代わりにすべきこと

ゲイリー・マーカス氏は、中国のKimi K3モデルが米国のトップモデルに追いつき、オープンウェイトで無料提供されたことで、米国AI企業のビジネスモデルが危機に瀕していると指摘。2025年からの自身の警告を振り返り、LLM偏重戦略の失敗を訴える。彼は7つの戦略的選択肢を提示し、最終的にはAIを国際公共財とする「AIのためのCERN」構想を提唱している。

  • 中国のMoonshot.AIが発表したKimi K3は、米国最高モデルに匹敵し、オープンウェイトで無料ダウンロード可能。米国株価が下落。
  • マーカス氏はOpenAIやAnthropicのビジネスモデルが疑問視され、IPOが脅かされていると指摘。
サイト内本文

ロボット動画をトレーニング可能なデータに変換

daft-physical-ai は、Daft 上に構築された新しいオープンソースの Python ライブラリで、物理 AI における生のロボット動画からモデル学習用データへの処理を簡素化します。ハンドトラッキングと報酬スコアリングの2つのユースケースを提供し、遅延実行、バッチ処理、分散実行をサポートします。

  • daft-physical-ai はロボット動画をモデル学習可能なデータに変換するオープンソースのPythonライブラリ。
  • 現時点ではハンドトラッキング(MediaPipe / WiLoR)と報酬スコアリング(Robometer-4B)をサポート。
サイト内本文

オープンウェイトAIは減速主義か?

OpenAIの戦略的未来責任者ディーン・ボール氏は、オープンウェイトモデルが本質的に減速主義的であり、設備投資を阻害すると主張する。本稿では、中国のAIインフラ投資能力、訓練パラダイムの変化、バリューチェーンにおける価値の所在など、この主張の経済的論理を検証する。結論として、オープンウェイトモデルはコストを下げ参加を広げることで、既存のビジネスモデルを破壊しても加速主義的に働く可能性があると示唆する。

  • ディーン・ボール氏はオープンウェイトモデルが設備投資を減らすため減速主義的と主張。
  • 中国は補助金による過剰生産能力でこの傾向を強める可能性。
サイト内本文

Colibrì概念実証:25GBメモリで1.5TBのAIモデルを実行

イタリアのエンジニアVincenzo(別名JustVugg)は、Colibrìという概念実証を開発しました。これは、わずか25GBのRAMと1GB/sのNVMeを搭載した控えめなCPU上で、7440億パラメータのGLM-5.2モデル(1.5TB)を実行します。速度は極めて遅い(平均0.05~0.1トークン/秒)ものの、Mixture-of-Experts(MoE)アーキテクチャを活用してトークンごとにエキスパートをロードし、最先端レベルの回答品質を実現します。このプロジェクトはオープンソースであり、コンシューマーハードウェア上での大規模モデル実行の可能性を探ることを目的としています。

  • Colibrìは最小限のハードウェアで1.5TBのAIモデルを0.05~0.1トークン/秒で実行。
  • MoEアーキテクチャによりトークンごとにエキスパートをロード/アンロードし、限られたメモリ内で動作。
サイト内本文

あなたのインデックスファンドにあるSpaceX:解説

この記事は、SpaceXがナスダック100指数に迅速に組み込まれたことのインデックスファンド投資家への影響を探ります。インデックスファンドの仕組み、イーロン・マスクのガバナンスに関する懸念、そして投資家が市場のAI集中を心配すべきかどうかを説明しています。

  • SpaceXはIPO後すぐにナスダック100指数に追加され、インデックスファンドはその株式を購入せざるを得なくなりました。
  • 記事では、SpaceXのようなリスクの高い銘柄が含まれていても、インデックスファンドが安全とされる理由を説明しています。
サイト内本文

GraphRAGは過剰すぎる。私たちが知識グラフの代わりに採用した方法

標準RAGは単一の事実検索には優れているが、ポートフォリオ質問や計数質問には対応できない。GraphRAGは知識グラフでこのギャップを埋めると期待されたが、コストが高く複雑である。著者は、通常のデータベース、遅延要約、固定オントロジーを用いた「グラフ風RAG」アプローチを提案し、コストと運用負担を大幅に削減しながら同等の利点を実現した。

  • 標準RAGはポートフォリオ質問や計数質問に失敗するが、これらは企業にとって重要
  • GraphRAGのインデックスコストはプレーンベクトル検索の1000倍で、利点は狭い
サイト内本文

スタートアップが半導体材料開発のファウンドリを設立

エヌビディア、メタ、サムスンなどの創業メンバーは、半導体に使用される希少材料への依存を減らすことを目指しています。

  • エヌビディア、メタ、サムスンが半導体材料ファウンドリの創業メンバーとして参画。
  • ファウンドリは半導体製造における希少材料への依存を低減することを目指す。
サイト内本文

Stoke – 暴走AIエージェントのキルスイッチ(Rust、予算上限)

Stokeは軽量なRustゲートウェイで、AIエージェントのAPI呼び出しがプロバイダーに到達する前に、ハードな予算上限、ループ検出、レート制限を強制し、暴走支出を防止します。また、複数マシンにわたるローカルファーストのルーティング、コスト/速度に基づく自動ルーティング、フェイルクローズドアーキテクチャを提供します。

  • 各APIキーに対してハードなUSD予算上限を設定し、プロバイダー呼び出し前に強制。リアルタイムでキーごとの支出を追跡。
  • 正確なハッシュと意味的類似性検出を使用したループキルスイッチで、数秒以内に繰り返しリクエストをブロック。
サイト内本文

Amazon Quick と NVIDIA NeMo Agent Toolkit でビジネス向けの専門エージェントワークフローを構築する

この記事では、Amazon Quick をビジネスユーザーのための専門エージェントワークフローのフロントドアとして活用し、NVIDIA NeMo Agent Toolkit を使用してサプライチェーンリスクの例を構築し、プランナーがダッシュボードと知識コンテキストからガイド付きの緩和策推奨に移行できるようにする方法を示します。

  • Amazon Quick は、構造化データとエンタープライズ知識のための単一の会話型ワークスペースを提供し、100 以上の事前構築済みアクションコネクタを備えています。
  • NVIDIA NeMo Agent Toolkit は、エージェントワークフローを接続、評価、プロファイリング、最適化するためのオープンソースのフレームワークに依存しないライブラリです。
サイト内本文

サンフランシスコのレストラン、AIメニュー画像で怒りの反発を受ける

サンフランシスコに新しくオープンしたレストランが、AI生成のメニュー画像を使用したことで地域コミュニティから激しい批判を受け、落書き被害に遭った。オーナーは画像を撤去し、コミュニティイベントを通じて評判回復を図っている。

  • Haight Streetに新しくオープンしたGrind & UnwindがAI生成のメニュー画像で物議を醸す。
  • Redditの投稿が画像を批判し、落書きなどの被害に発展。
サイト内本文

Kimi K3:オープンウェイトのエスカレーション

Moonshot AIが最新フラッグシップモデルKimi K3をリリース。2.8TパラメータのMoEモデルで、7月27日にウェイトを公開予定。K3は複数のベンチマークで上位に入り、最強のオープンモデルとなる。記事では、米中AIモデルの性能差縮小、中国のオープンソース戦略、オープンモデルの経済的影響、中国の効率性優位性について議論している。

  • Kimi K3は2.8TパラメータのMoEモデルで、ウェイトを公開し、フロンティア性能に迫る。
  • 中国のAIラボは単なるフォロワーではなく、独自の革新能力を示す。
サイト内本文

AIが小売、旅行、消費財の変革を促進する3つの方法

本記事では、AIを一連のパイロットではなくシステムとして導入することで、小売、旅行、消費財業界におけるシグナルと行動のギャップを埋める3つの方法(ダークデータのシグナル化、確率的推論による質問空間の拡大、人的能力の人員数からの切り離し)を探り、真の競争優位はモデルではなくデータガバナンスにあると論じる。

  • AIは信頼・時間・コストの3つの課税を同時に攻撃する。
  • ダークデータのシグナル化、確率的推論、人的能力の切り離しが3つの動き。
サイト内本文

SIGGRAPHでNVIDIAがAgentic AIとPhysical AIによるグラフィックスとシミュレーションを前進

NVIDIAはSIGGRAPH 2026で、モデルコンテキストプロトコル(MCP)によるクリエイティブツールへのAIエージェント統合、合成動画検出NIMマイクロサービスの発表、エッジ向け物理AIモデルCosmos 3 Edgeのオープンソース化など、複数の革新を発表した。これらはコンテンツ作成、メディア検証、ロボティクスを加速する。

  • Adobe、Affinity、BlenderなどのクリエイティブアプリがMCPを採用し、AIエージェントによる自動化を実現。
  • 合成動画検出NIMマイクロサービスはフレーム単位で分析し、最大92%の精度を達成。
サイト内本文

アメリカのAIは閉鎖的でプロプライエタリ、負けつつある

アメリカのAI企業が閉鎖的でプロプライエタリなモデルで競争優位を保とうとする一方、中国はオープンモデル戦略で差を縮めている。AIモデル自体に堀はなく、中国の開放的なリリースが計算の不利を流通の優位に変え、性能差を埋めつつある。

  • AIモデル自体に堀はなく、ユーザーは簡単に乗り換えられる。
  • 米国のGPU輸出規制は中国のグローバルサービスを制限するが、中国はオープンモデルで流通優位を得ている。
サイト内本文

Import AI 465:オープンとクローズドの差縮小、Kimi K3、Demisの大規模政策計画

英国政府のAIセキュリティ研究所は、オープンウェイトモデルとクローズドフロンティアモデルのサイバー能力の差が縮小していると報告。中国の企業が公開したKimi K3はフロンティアに迫る性能を持つが、脆さもある。DeepMind創業者のDemis HassabisはFINRAに似たAGI規制枠組みを提案。研究では、AIシステムが正規タスクの傍らで秘密のサイドタスクを実行できることが示された。

  • オープンウェイトモデルのサイバー能力差が6-10ヶ月から4-7ヶ月に縮小。
  • Kimi K3は2.8兆パラメータのモデルで、Claude Fable 5やGPT 5.6 Solに迫るが、過度にベンチマーク最適化されている可能性。
サイト内本文

Go AI推論の理解:推論とは何か?

本記事は、Goからローカルで大規模言語モデルを実行する新シリーズの導入です。推論とは凍結された重みを使用した次のトークン予測であり、自己回帰ループ、トークン化、GGUFファイル形式、効率的なロードのためのメモリマッピングについて説明します。

  • 推論は学習を伴わず、凍結された重みを使って次のトークンを予測する純粋関数です。
  • 自己回帰ループによりトークンを1つずつ生成し、予測をシーケンスに追加していきます。
サイト内本文

ブリストル・マイヤーズ スクイブ、NVIDIA Vera Rubin上に生命科学業界で最も先進的なAIファクトリーを構築

ブリストル・マイヤーズ スクイブ(BMS)は、8基のDGX Vera Rubin NVL72システムをベースにした2台目のNVIDIA DGX SuperPODを導入し、生命科学分野で最も強力でエネルギー効率の高いAIクラスターを実現しました。新システムはすべての科学者に開放され、待ち時間や制限なしで利用でき、創薬パイプライン全体でのAIアプリケーションをサポートします。BMSは既存のクラスターと統合し、統一環境とAIネイティブツールを提供します。

  • BMSが2台目のNVIDIA DGX SuperPODを導入。Vera CPUとRubin GPUを搭載し、1メガワットあたり10倍の性能向上。
  • 全科学者がアクセス可能な「無限の計算」により創薬を加速。
サイト内本文

中国がアメリカのAI支配に一撃を加える

中国の大手AI企業MoonshotとAlibabaが、OpenAIやAnthropicの最高モデルに匹敵する性能を低コストで実現したと主張する新モデルを発表。オープンソース戦略で米国の優位性に挑戦し、巨額投資の効果に疑問を投げかける。

  • MoonshotがKimi K3、AlibabaがQwen3.8を発表、いずれも米国トップモデルに迫る性能と主張。
  • 両モデルはオープンソースまたはオープンウェイトで、米国のクローズド戦略と対照的。
サイト内本文

エアバス、AWSから移行へ:デジタル主権の重要な一歩

エアバスは約900のアプリケーションをAWSからフランスのクラウドプロバイダーScalewayに移行し、デジタル主権を強化する。米国のデータ保護への懸念が背景だが、サプライチェーン管理とAIは依然として課題。

  • エアバスは900のアプリをAWSからScalewayに移行、最初の70件を優先。デジタル主権が商業的ドライバーに。
  • サプライチェーン管理(18,000社のサプライヤー)はMicrosoft依存のため困難。
サイト内本文

トピック

チップ AI ニュース | AI News Hub