AI News HubLIVE

AI ニュース速報

リアルタイム監視

今日の AI で最も重要な変化

105 件の信頼できるソースから抽出。最終更新 2026-06-01 17:01 UTC+9。

リアルタイム監視

最新ニュース

信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。

最新ニュース

リセット
今後の機械学習・AIセミナー:2026年6月版

2026年6月1日から7月31日までに開催される7つの無料AIセミナーをまとめました。ドローン群知能、タンパク質動力学、メディアリテラシー、極端降水予測など、最先端のトピックをカバーします。すべてのイベントはオンラインで無料参加可能です。

AIhub研究 / ロボットサイト内本文
本日より無期限無料!世界初のフルモダリティAPIを公開、トップ10 AIラボが動く

Agnes AI(世界トップ10のAIラボ)は、テキスト、画像、動画をカバーするコアモデルのAPIを無期限で無料開放すると発表した。テキストモデルAgnes-2.0-Flash、画像モデルAgnes-Image-2.0-Flash、動画モデルAgnes-Video-2.0が含まれる。開発者やクリエイターの障壁を下げ、高頻度のテストや実験を可能にする。

量子位Agent / チップサイト内本文
AI生成UI向けの無料オープンソースDESIGN.mdファイルライブラリ

Cursor、Claude、GeminiなどのAIツールで一貫性のあるUIを構築するためのDesign.mdシステムを発見・共有できるオープンライブラリ。現在14のデザインシステムを収録し、モバイルファースト、エンタープライズSaaS、フィンテックなど多様な分野をカバーしています。

Hacker News AIAgentサイト内本文
MiniMax M3:3つのフロンティア機能を統合した初のオープンウェイトモデル

MiniMax は M3 モデルを発表。コーディングとエージェント能力、スパースアテンションによる100万トークンコンテキスト、ネイティブマルチモーダルを統合した初のオープンウェイトモデルです。SWE-Bench Pro などで優れたベンチマークを達成し、API は初週50%割引で利用可能。ウェイトとテクニカルレポートは約10日後に公開予定。

Hacker News AIAgent / 研究サイト内本文
GrafoPropagation:幾何学的注意機構を用いたコンパクトなテキスト分類アーキテクチャ

GrafoPropagation は約99万パラメータのテキスト分類アーキテクチャで、フォン・ミーゼス・フィッシャー(vMF)二重スケール注意機構、リーマン時間埋め込み、動的グラフ接続、グローバルワークスペースメモリ、システム2潜在探索、量子学習率変調を特徴としています。AG Newsで微調整後、検証精度93.1%を達成。

Hacker News AIチップ / 政策サイト内本文
私のAIスキルが、私のAIスキルを説明するこのビデオを編集しました – Arcturus Labs

著者はAIツールCursorとAssemblyAIを使用して、メタプロセスで自動動画編集ツールを作成し、その仕組みを説明するデモ動画を自身のツールで編集することに成功しました。記事では発想から実装、最終成果までの全過程を詳細に説明し、関連コードを公開しています。

Hacker News AIAgentサイト内本文
OpenAI、ロボティクスに復帰!4つの主要ポジションを募集

OpenAIはロボット工学エンジニアを積極的に採用しており、電気工学、シミュレーション、アクチュエータ設計、制御システムソフトウェアの4つの主要職種を募集。年俸は最大310,000ドル(約4,500万円)に加え株式オプションも。同社は2020年にロボットチームを解散していたが、再び具現化AIに注力する。

量子位Agent / チップサイト内本文
エンタープライズAI支出を再形成する価格設定の変化 – UpperEdgeのAdam Mansfield氏

シートベースのライセンスからハイブリッドおよび消費ベースのAI価格設定への急速な移行により、企業のテクノロジー支出の予測と管理が大幅に困難になっています。Adam Mansfield氏は、これらの新しい価格モデルが買い手にどのような財務的リスクをもたらすか、また主要ベンダーとの交渉において明確な予測、透明性、交渉力を確保することがなぜますます難しくなっているかを考察します。彼は、現在の使用状況の監査、十分に活用されていない支出の特定、早期のベンダーとの関わりなど、リーダーが今すぐ取るべき実践的なステップを強調しています。

Emerj AI Researchスタートアップサイト内本文
トークンが高いのは、モデルにゴミをたくさん与えているから|@アマゾン王暁野 AIGC2026

2026年中国AIGC産業サミットで、アマゾンウェブサービスの製品技術部門テクニカルディレクターである王暁野氏は、企業の87%がAIを大規模に展開していると宣言しているが、実際に価値を得ているのはわずか10%であると指摘した。彼は個人と企業レベルのエージェント導入の大きな違いを強調し、企業はコンピューティング、モデル、データ・知識、エージェンティックプラットフォーム、アプリケーションの5層に注目すべきだと述べた。また、トークンコストが高いのは、モデルに無関係な情報を多く与えすぎていることが原因であると指摘した。

量子位モデル / Agent / チップサイト内本文
NVIDIA、RTX Sparkを発表-コンシューマーPCチップ市場に参入

NVIDIAは、コンシューマーPC向けの初の完全なコンピューティングチップ「RTX Spark」シリーズを正式発表した。ノートPCやミニPC向けで、Armアーキテクチャを採用し、CPU、GPU、AIエンジンを統合。最も効率的なPCチップと主張し、多数のPCメーカーが今秋発売を予定している。

Hacker News AIAgent / チップサイト内本文
材料版AlphaFold登場!40の産業タスクでSOTA達成、AI4Sに大きなブレークスルー

Deep Principleが発表した材料基盤モデルMPAは、大規模言語モデルから着想を得た3段階訓練手法を採用し、40の実産業タスクでSOTAを達成。中期訓練による物理アライメントとハイブリッド読み出しヘッドにより、未知の構造予測で優れた性能を発揮し、AI for Scienceにおける重要な進歩を示している。

量子位モデル / Agent / チップサイト内本文
NVIDIA AIクラウドエコシステム、世界的に拡大し、グローバルなAIコンピュート需要に対応

NVIDIA AIクラウドエコシステムは、AIファクトリーインフラのグローバルな構築を加速しています。パートナーは、エンタープライズ、スタートアップ、国家、AIラボ、開発者がエージェンティックAIアプリケーションをスケールする需要の高まりに対応するため、容量を拡大しています。これらのクラウドは、NVIDIAのフルスタックAIインフラと共同設計され、トレーニング、ファインチューニング、推論、物理AI、主権AIの展開をサポートします。

NVIDIA BlogAgent / チップサイト内本文
NVIDIA工場運用ブループリント:工場に新たなAIブレインを提供

NVIDIAはGTC Taipeiで工場運用ブループリント(FOX)を発表しました。これは自律工場管理エージェントを構築するためのリファレンスデザインで、リアルタイムデータ、品質管理、作業指示、運用アラートを統合し、工場全体のインテリジェンスを実現します。ブループリントはNemoClaw、AI-Q、Nemotronオープンモデルに基づき、工場システムの接続、モデルトレーニングの自動化、インテリジェントワークフローの運用を可能にします。Foxconn、Pegatron、Advantech、Wistronなどの台湾メーカーが先行導入し、生産性向上とコスト削減を実現しています。

NVIDIA BlogAgent / チップサイト内本文
台湾産業の巨人がNVIDIAと連携し、世界のAIインフラ構築を加速

台湾には500以上のNVIDIAエコシステムパートナーが拠点を置き、NVIDIA Vera Rubinインフラ向けのMGXラックコンポーネント100万以上が台湾の25工場で組み立てられています。Vera Rubinが本格生産に入り世界中のエージェンティックAI工場を支える中、そのエコシステムはTSMC、SPIL、Kinsus、KYEC、UMTCなどのウェハー・チップパートナーから、Foxconn、Pegatron、Quanta Cloud Technology(QCT)、Wistron、Inventecなどの製造・システムリーダーにわたるサプライチェーン全体をカバーしています。これらのパートナーはAI工場を建設するだけでなく、自社の運用に加速コンピューティング、シミュレーション、AIエージェント、フィジカルAIを適用し、AIが高度な製造をより迅速、効率的、適応的にする方法のモデルを生み出しています。

NVIDIA BlogAgent / チップサイト内本文
英国、若年亡命希望者の年齢評価にAI利用へ、慈善団体が非難

100以上の難民児童組織が連合し、英国政府が若年亡命希望者の年齢評価にAI顔認識年齢推定技術を導入する計画を非難。これにより、より多くの子どもが誤って成人刑務所や収容施設に送られる可能性があると警告している。

The Guardian AIツールサイト内本文
Show HN:アイデアを構築可能な仕様書に鍛え上げる、あなたが持っているAIエンジンで

Hephaestus' Forge は、5フェーズのガイド付きウィザードでアイデアについてインタビューし、プロジェクト設計書、PRD、技術仕様書、見積もりを含む構築可能なドキュメントパックを生成する、セルフホスト型のWebアプリです。生成されたドキュメントは、AI IDEにそのままコンテキストとして投入できます。複数のAIエンジン(Claude Code、Codex、Gemini CLI、Ollamaなど)に対応し、プライベートで100%ローカル動作し、オープンソース(MIT)で多言語対応です。

Hacker News AIAgent / 政策サイト内本文
NVIDIAとMicrosoft、パーソナルAI時代のWindows PCを再定義

NVIDIAは、パーソナルAIエージェント向けに設計された新しいスーパーチップ「RTX Spark」を発表。1 petaflopのAI性能と最大128GBのユニファイドメモリを提供。Microsoftとの協業により、デバイス上で安全にエージェントを実行可能。120Bパラメータの大規模言語モデルや大規模3Dレンダリング、高解像度動画編集、AAAゲームをサポート。Adobeなどのソフトウェアメーカーが最適化を進め、今秋より主要OEMからRTX Spark搭載のノートPCとデスクトップが発売予定。

Hacker News AIAgent / チップサイト内本文
Cosmos 3 が物理AIの行動前思考をどのように支援するか

NVIDIA が発表した Cosmos 3 は、視覚推論、マルチモーダル生成、行動予測を統合したオープンな世界基礎モデルです。ロボット、自動運転車、視覚AIエージェントが現実世界の変化を理解し予測することを可能にし、混合トランスフォーマーアーキテクチャを採用して合成ビデオやロボット動作データなどを生成します。スマートシティから産業オートメーションまで幅広い用途に対応し、複数のベンチマークで首位を獲得。オープンライセンスで提供されています。

NVIDIA BlogAgent / チップサイト内本文
2026年5月のニュースレター

Simon Willisonが2026年5月のスポンサー限定月次ニュースレターを公開。AIコストの上昇、Anthropicの好調、モデルリリースの不振、Datasette Agentのローンチなどを取り上げている。

Simon Willison's Weblogモデル / Agent / 研究サイト内本文
NVIDIA Cosmos 3 公開:物理AIの推論と行動を実現する初のオープンオムニモデル

NVIDIAは、世界生成、物理推論、行動生成を統合した世界基盤モデルCosmos 3を発表しました。Mixture-of-Transformersアーキテクチャに基づき、テキスト、画像、動画、アクションなど複数のモダリティを処理します。8BパラメータのNano版と32BパラメータのSuper版の2種類を提供し、Hugging Face Diffusersと統合されています。物理AI向けの合成データ生成データセットも同時公開されました。

Hugging Face BlogAgent / チップサイト内本文
Parallax: ソフトマックスを維持し、学習された共分散補正ブランチを追加するパラメータ化された局所線形注意機構

Parallaxは、ソフトマックス注意を維持し、学習された共分散補正ブランチを追加する新しい注意機構で、局所線形注意(LLA)のクエリごとの共役勾配解法を置き換えます。FlashAttentionのキー・バリューストリームを再利用することで演算強度を2倍にし、0.6Bおよび1.7BスケールのLLM事前学習でより低いパープレキシティを達成します。ただし、その利得はMuonオプティマイザーに強く依存し、AdamWでは大幅に減少します。

MarkTechPostチップ / 研究サイト内本文
NVIDIA、RTX PCとDGX Spark全体でローカルAIエージェントを強化

個人エージェントの人気が急上昇しており、OpenClawやHermesなどのオープンソースプロジェクトがGitHubのAI開発者コミュニティで急速に採用されています。これらのエージェントは個人の好みやワークフローに適応し、アプリケーションとの対話、コンテンツ生成、反復作業の自動化、マルチステップタスクの管理をデバイス上でローカルに実行できます。本日、COMPUTEX台北のNVIDIA GTCで、NVIDIAは個人エージェント専用に設計された新しいクラスのWindows PC「NVIDIA RTX Spark」を発表し、ローカルエージェントをNVIDIA RTXおよびDGXエコシステム全体に拡張する一連のアップデートも行いました。

NVIDIA BlogAgent / チップサイト内本文
ZAPS-DA:強化学習における連続制御のためのゼロ位相アクションポリシースムージングと分離アクター

ZAPS-DAは、分離アクターとゼロ位相フィルタリングを組み合わせ、位相遅れや後処理なしに強化学習の連続制御ポリシーの高周波動作ジッタを大幅に低減するフレームワークです。運転シミュレーターで14~21倍のステアリングジッタ削減を達成し、タスク成功率はほぼ変わりません。

arXiv Roboticsモデル / 政策 / 研究サイト内本文
ARISTOハンド:センシング駆動型遠位過伸展による微細操作

ARISTOハンドは、腱駆動ロボットハンドであり、能動的遠位過伸展とハイブリッド指先センシングアーキテクチャ(剛性爪取り付け力・トルクセンサと柔軟な静電容量触覚アレイの組み合わせ)を統合し、薄物体の引き抜き力を2.76倍に向上させ、SDカードの抜き差しタスクを成功させた。

arXiv Robotics研究 / ロボットサイト内本文
VLM-GLoc: ビジョン言語モデルによるモンテカルロ位置推定の強化 - 雑然とした準静的環境でのロバストな意味的グローバル位置推定

VLM-GLocは、オープン語彙ビジョン言語モデル(VLM)を統一的な意味観測フロントエンドとして活用する階層的意味モンテカルロ位置推定手法を提案する。食料品店やオフィスなどの幾何学的に曖昧な準静的環境でのグローバル位置推定問題に対処する。この手法は、高識別性テキスト特徴抽出、暗黙的品質フィルタリング、永続性推論によるデータ拡張、およびテキストからマップへの検索による逆意味提案メカニズムを特徴とする。3,500平方フィートの食料品店と3,700平方フィートの実験室での評価では、それぞれ70%と74%の成功率を達成し、従来のベースラインを大幅に上回った。

arXiv Roboticsモデル / 研究 / ロボットサイト内本文
CoMo3R-SLAM:学習された3D再構成事前分布を用いた協調単眼密SLAMと屋外マルチエージェントシステム

CoMo3R-SLAMは、ロバストな学習済みフィードフォワード3D再構成事前分布を活用する初の協調単眼密RGB SLAMシステムで、屋外マルチエージェントのマッピングを実現する。各エージェントは事前分布誘導のフロントエンドでリアルタイム追跡と局所密融合を行い、コーディネータは密ポイントマップマッチング、閉形式Sim(3)ゲージ同期、GPU高速化グローバルバンドル調整を実行する。深度センサやパラメトリック内部パラメータを必要とせず、単眼RGBのみでロバストなエージェント間制約とグローバル一貫性のあるメトリックマップを生成する。Tanks and TemplesおよびWaymoデータセットにおいて、4シーンのうち3シーンで最良のATEを達成し、Waymoでも競争力のある精度を示し、最先端のRGB-D手法に匹敵または凌駕しつつ、オンラインで8 FPSで動作する。

arXiv Roboticsモデル / Agent / チップサイト内本文
ELAN4D:プラグアンドプレイ適応による身体中心の4D監視を用いた視覚言語行動モデル

ELAN4Dはロボット操作用のトレーニングフレームワークであり、将来のロボットキーポイントトラックを予測的時空間監視としてVLAポリシーに組み込みます。順運動学のみを使用し、推論時に破棄されるプラグアンドプレイの補助分岐を備えています。複数のベンチマークと実世界タスクでの実験により、分布外摂動下での一貫した改善が示されています。

arXiv Roboticsモデル / 政策 / 研究サイト内本文
屋内移動ロボットのための学習ベースナビゲーション

本論文は、教師ありニューラルグローバルプランナーと学習ベースのDWAローカルプランナーを組み合わせた屋内移動ロボットナビゲーションフレームワークを提案する。グローバルプランナーはコスト考慮型A*のエキスパート軌跡で訓練され、ローカルプランナーは行動模倣で初期訓練後、PPOで洗練される。シミュレーションと実環境での実験により、障害物回避のための実行可能な経路と信頼性の高い運動指令が生成されることを実証。ソースコードは公開予定。

arXiv Robotics政策 / 研究 / ロボットサイト内本文