AI News HubLIVE

AI ニュース速報

リアルタイム監視

今日の AI で最も重要な変化

105 件の信頼できるソースから抽出。最終更新 2026-06-11 05:27 UTC+9。

リアルタイム監視

最新ニュース

信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。

最新ニュース

リセット
PixelForge:写真をゲームアセットに変換

PixelForgeは、写真をアップロードするだけで、認識可能なRPGキャラクターの4方向スプライトパック(4x4シート、16枚の透明PNG、歩行GIF)を生成するAIツールです。GodotやUnityなどのゲームエンジンに対応。一度の支払い5ドルで、アカウントもサブスクリプションも不要。ベルナール・フアン氏が開発し、Product Huntでローンチされました。

Product Hunt AIツールサイト内本文
Anthropic、画像理解でOpenAIに追いつく

Anthropicは2つの新モデルClaude Mythos 5とClaude Fable 5を発表。コーディング能力は大幅に向上したが、画像理解の進歩は限定的。テストではFable 5とGPT-5.5が昨年のトップモデルを悩ませた多くの画像問題を解決できるものの、幾何学的推論は幼児並みであり、汎用AIへの道のりはまだ遠い。

Understanding AI政策 / 研究サイト内本文
ロボタクシーには、安全性は後付けではなく内蔵されていなければならない

ロボタクシーサービスが世界中で拡大する中、NVIDIAはHalos OSを発表。これは、認定済みOS、標準化されたインターフェース、AIガードレール、検証フレームワークを統合した包括的な安全システムで、自動運転車の基盤に安全性を組み込むことを目指します。

NVIDIA BlogAgent / チップサイト内本文
Google AI、DiffusionGemmaを公開:26B MoEオープンモデル、テキスト拡散で最大4倍高速生成

DiffusionGemmaはGoogle DeepMindが開発した実験的なオープンテキスト生成モデルで、標準的な自己回帰デコードの代わりにテキスト拡散を採用し、専用GPU上で最大4倍の生成速度を実現します。26BパラメータのMoEモデル(推論時は3.8Bのみ活性化)で、Gemma 4をベースに構築され、マルチモーダル入力(テキスト、画像、動画)をサポートし、256Kのコンテキストウィンドウ、140以上の言語に対応、Apache 2.0ライセンスで公開されています。

MarkTechPostモデル / Agent / チップサイト内本文
Claude Fableが基本的な生物学の質問に答えない

Anthropicが最も強力なAIモデルClaude Fable 5を公開したが、「ミトコンドリアとは何か」などの基本的な生物学の質問に答えることを拒否する。これは生物兵器への悪用を防ぐための安全対策であり、Anthopicは過剰だが安全な展開に必要だと説明している。

The Verge AIモデル / Agent / 政策サイト内本文
OpenAIのIPO遅延?アルトマン氏、従業員に「1年以内」の上場見通し

サム・アルトマン氏は従業員に対し、OpenAIのIPOを「1年以内」に期待していると語ったが、2027年までの遅延もあり得る。同氏はこれを自己改善型AIへの慎重さと説明するが、実際の理由はAnthropicの好調な成長と差し迫ったIPOにある可能性がある。

The Decoderスタートアップサイト内本文
マイクロソフト、AIを熱弁する卒業式スピーカーへのブーイングを理解

全米の大学卒業式でAIを宣伝するスピーカーに学生がブーイングを浴びせる現象が起きている。マイクロソフトの副会長兼社長ブラッド・スミスは長文のブログで、「警鐘」と受け止め、対話を呼びかけた。しかし、内容はブーイングを招いた主張と大差なく、テクノロジー企業への信頼が問われている。

The Verge AIツールサイト内本文
AI規制の未来:最も奇妙で不安な仲間たち

The Vergeのニュースレター「Regulator」が、混沌としたワシントンの政治情勢に戻ってきました。ワシントンAIネットワークのガラ、教皇レオ14世のAIに関する回勅、そしてトランプ政権下でのAI規制の予測不可能性を取り上げています。この記事は、AIが有権者の重要な問題になりつつある中、業界が党派政治と中間選挙にどう対応すべきかというジレンマを浮き彫りにしています。

The Verge AI政策 / スタートアップサイト内本文
機械学習の忘却監査のための新しいフレームワーク

Googleの研究者が、機械学習モデルの忘却とプライバシー保護を監査するための「正則化f-ダイバージェンスカーネル検定」フレームワークを提案。適応的に最適なダイバージェンスを選択し、データ漏洩や忘却の失敗をより感度高く検出でき、必要なサンプル数やチューニングが少ない。

Google Research Blog政策 / 研究サイト内本文
Google、YouTubeクリエイターの作品を音楽AIに利用していることを認めず

独立系ミュージシャンのグループがGoogleを提訴し、YouTubeにアップロードした曲がLyria 3モデルの訓練に無断で使用されたと主張。Googleは却下申し立てを行い、利用規約がアップロードコンテンツの使用を広く許可していると主張。GoogleはLyriaにYouTubeアップロードを使用していることを明確に認めていないが、過去の声明からは使用が示唆されている。

The Verge AI政策サイト内本文
Onpilot:ビジネスに合わせてカスタマイズされたAI労働力

Onpilotは、企業のシステム、ワークフロー、プロセスに特化したAIワーカーを作成し、運用を監視、リスクを特定、機会を発見、アクションを推奨、3,000以上の統合で作業を自動化します。Slack、Teams、WhatsApp、SaaS、またはオンプレミスで展開可能。承認ワークフロー、監査証跡、例外処理により信頼性を確保します。

Product Hunt AIAgent / 政策サイト内本文
Microsoft、データ保持を理由にClaude Fable 5の社内利用を制限

MicrosoftはAnthropicの新データ保持要件を理由に、従業員によるClaude Fable 5の使用を制限。同モデルはプロンプトと出力を30日間保持し、違反フラグが立った場合は最大2年間保存される。他のClaudeモデルはゼロデータ保持で引き続き利用可能。法務チームが評価中。

The Verge AIモデル / 政策 / 研究サイト内本文
NVIDIA、Google DeepMindのDiffusionGemmaをローカルAI向けに高速化

Google DeepMindが、高速テキスト生成のための実験的なオープンモデルDiffusionGemmaをリリース。NVIDIAはこれを最適化し、GeForce RTX、RTX PRO、DGX Spark上でさらに高速に動作し、ローカルで最大1000 tokens/secを達成。

NVIDIA Blogモデル / Agent / チップサイト内本文
言語サーバーでGitHub Copilot CLIに真のコードインテリジェンスを

GitHub Copilot CLIにLSPサーバーをインストール・設定することで、力任せのgrepや逆コンパイルから脱却し、真のコードインテリジェンスを実現します。LSPセットアップスキルは14の言語に対応し、自動化を提供します。本記事ではその仕組みと開始方法を解説します。

GitHub AI & MLAgentサイト内本文
手動カーネルチューニングはもう終わり:Neuron Agentic DevelopmentがAWS Trainiumの最適化を加速する方法

AWSはNeuron Agentic Development機能を発表。AIエージェントとスキルセットにより、開発者は深いハードウェア知識がなくてもTrainiumおよびInferentia向けのカスタムカーネルを作成、デバッグ、最適化でき、開発サイクルを大幅に短縮できる。

AWS Machine Learning BlogAgent / チップサイト内本文
ジェレミー・ハワードの引用

ジェレミー・ハワードは再帰的AI自己改善を遅らせる簡単な解決策を提案:トップクラスのモデルを持つラボはそのモデルをフロンティアAI研究に使用しないことに同意すべきだが、他のすべての人はアクセスできるべきだ。これによりフロンティアは進歩せず、危険な力の不均衡を回避できる。彼はAnthropicが反対の行動をとっていると批判する。

Simon Willison's Weblogモデル / 研究サイト内本文
Amazon Bedrock AgentCoreを使用したAI搭載の機器修理アシスタントの構築

このチュートリアルでは、Amazon Bedrock AgentCoreを使用して、農家や現場技術者が自然言語で機器の問題を診断し、必要な部品を特定し、メーカー承認の修理手順にアクセスできるAI搭載の機器修理アシスタントを構築します。このソリューションは、AgentCore RuntimeとStrands Agents SDK、Amazon Nova 2 Liteを基盤モデル、Amazon Bedrock Knowledge BaseをRAG、AgentCore Memoryを会話の永続化に使用します。

AWS Machine Learning Blogモデル / Agent / 政策サイト内本文
Ramp、既製の金融AIができないことをフォワードデプロイドエンジニアが実現できると確信

RampはApplied AI Solutionsを発表し、エンジニアを企業の財務チームに派遣して、買掛金管理、調達、月次決算などの業務にAIエージェントを構築・展開する。AIへの投資が急増する一方で、明確な価値を実感しているユーザーはわずか21%であり、このギャップを埋めることを目指す。同サービスは人間による監視とガバナンスを重視している。

The New Stack AIAgent / 政策サイト内本文
Patchrooms

Patchrooms は、AI 製アプリのプレビューにスクリプトを追加するだけで、レビュアーが要素を指してテキスト、スクリーンショット、音声メモを残せる軽量フィードバックレイヤーです。コンテキストを自動取得し、エージェント対応のパッチコンテキストとして出力することで、レビューから修正までのループを高速化します。

Product Hunt AIAgentサイト内本文
中国関連の影響力工作が米国のAI議論を標的に

OpenAIの新たな報告書は、中国関連の影響力工作がAIを利用して米国のテクノロジー議論、データセンターの話題、関税、ChatGPTに関する虚偽の主張を標的にしていることを詳述しています。

OpenAI Newsツールサイト内本文
CrustRecruiter

CrustRecruiter は、MCP を介して Claude にインストールするスキルセットで、Claude の推論能力と Crustdata の 8 億件以上の候補者データベースを組み合わせ、ソーシング、マーケットマッピング、メール検証、好みの記憶、アウトリーチや ATS 同期などの採用業務を自動化し、真にパーソナライズされたスケーラブルな採用を実現します。

Product Hunt AIAgent / 研究サイト内本文
Transformers.jsを使用した画像と音声のマルチモーダルブラウザAI

この記事では、Transformers.jsを使用してブラウザ内で完全に実行されるマルチモーダルAI機能(画像分類、画像キャプション、音声文字起こし)を構築する方法を説明します。サーバーやAPIキーは不要で、ユーザーのデバイスからデータが外部に出ることはありません。詳細なコード例とプロジェクト構成が含まれています。

Machine Learning Masteryモデルサイト内本文
タイミングトリックでLLMトレーニングのエネルギーを最大14%削減

オランダのトゥウェンテ大学の研究者たちは、GPUカーネルごとにクロック周波数を調整することで、速度をほとんど犠牲にせずに大規模言語モデルのトレーニングエネルギーを最大14%削減できることを示しました。

IEEE Spectrum AIモデル / チップ / 研究サイト内本文
Siri AI登場、内部はGoogle、世界の大部分はロックアウト

AppleはWWDC 2026で、Google Geminiモデルを搭載したSiri AIを発表。マルチターン会話やアプリ間タスク実行が可能だが、初期ベータは英語のみで、中国は完全排除、EUユーザーも制限される。AppleはAI競争で単独では勝てず、Googleとの協力を認めた。

Artificial Intelligence Newsツールサイト内本文