AI News HubLIVE

AI ニュース速報

リアルタイム監視

今日の AI で最も重要な変化

105 件の信頼できるソースから抽出。最終更新 2026-06-11 20:03 UTC+9。

リアルタイム監視

最新ニュース

信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。

最新ニュース

リセット
コンテキスト崩壊時:エージェントに記憶喪失の検出と復旧を教える

本稿はエージェンティックエンジニアリングシリーズの第8回目であり、複雑なマルチステップ作業を行うAIエージェントにおけるコンテキスト喪失問題を扱います。著者は外部化・認識・再水和(ERR)パターンを提案します:エージェントの状態をディスクに保存し、コンテキストの劣化を検出し、ファイルから復旧します。歴史的な類推(640Kメモリ制限)と実際のCopilotクラッシュ事例を用いて問題を説明します。記事では、実行継続性(現在のステップ)とタスク継続性(全体的な目標)という2層の状態外部化を詳細に説明します。

O'Reilly AI & ML RadarAgentサイト内本文
Xebia:AIエージェントが適切なデータ基盤なしに失敗する理由

XebiaのグローバルCTO Niels Zeilemaker氏は、AIエージェントの成功は適切なデータカタログを含む強固なデータ基盤に依存すると強調する。同社のAgentic Data Foundation(ADF)およびACEフレームワークは、ガバナンスと品質を維持しながら企業のAI導入を加速する。

Artificial Intelligence NewsAgent / 政策サイト内本文
AI絶対主義が私たちの脳を壊している。売り込まれている終末的な未来は必然ではない

人工知能に関するすべての情報は矛盾しており、耳にせざるを得ない。AIは恐ろしく、素晴らしく、世界を壊し、未来を変える。受け入れることが不可欠であり、使用を控えることは道徳的義務だ。AI絶対主義——極端な楽観論と悲観論の両方——が私たちの思考を歪めており、真の未来はそれほど単純ではない。

The Guardian AIツールサイト内本文
AIが代行しようとする面倒な用事や家事?実はそれらは健康維持に役立っている | マヌシュ・ゾモロディ、キース・ディアス

AIの効率化が人間を健康的な活動へと導くという幻想に対し、歴史的に省力技術が健康習慣を促進した例はほとんどないと指摘。ドライブスルーや電子レンジ、エスカレーターといった過去の便利さが徐々に身体活動を減らし、健康を損ねてきたことを警告する。

The Guardian AIチップサイト内本文
Nous Research、Hermes Agentプロファイルビルダーをリリース:ダッシュボードフローでID、モデル、スキル、MCPサーバーを一元管理

Nous Researchは、Hermes AgentのローカルWebダッシュボード内にプロファイルビルダーを搭載しました。これにより、複数のCLIステップを要したエージェント設定が単一のガイド付きフローで完了します。ユーザーはID、モデル/プロバイダー、スキル、MCPサーバーを定義し、分離されたプロファイルディレクトリを生成して、状態衝突なく複数エージェントを実行できます。

MarkTechPostAgent / チップサイト内本文
AAAIフェロー、ターニャ・バーガー=ウルフ氏インタビュー:生態学、生物多様性、保全のためのAI

本インタビューでは、AAAIフェローに選出されたターニャ・バーガー=ウルフ氏が、AIと生態学の交差点における先駆的な研究、特に生命の樹の基盤モデルBioCLIPの開発、生物多様性モニタリングや保全への応用、そして科学におけるAIの将来について語ります。

AIhub政策 / 研究サイト内本文
データプロダクトを構築するのをやめ、データサービスを始めよう

買収による成長とエージェント型ワークフローの台頭により、従来のデータプロダクトモデルは機能しなくなりつつある。HowdenのグループCDOであるBarry Panayiは、データサービス層への移行、データガバナンスの左シフト、インサイトラグの削減、そして統一データモデルと会話型分析の採用を提唱している。

Databricks BlogAgent / 政策サイト内本文
「North Mini Code」登場:Cohereの30BオープンウェイトMixture-of-Expertsモデル、アクティブパラメータ3Bでエージェンティックコーディングを実現

Cohereは初の開発者向けコーディングモデル「North Mini Code」を公開しました。総パラメータ30B、トークンあたり3Bのアクティブパラメータを持つMixture-of-Expertsモデルで、1枚のH100 GPUで動作し、256Kのコンテキスト長をサポートします。コード生成、エージェンティックソフトウェアエンジニアリング、ターミナルタスクに最適化され、ウェイトはApache 2.0で公開されています。

MarkTechPostモデル / Agent / チップサイト内本文
SmithDBにおける全文検索:オブジェクトストレージ向け転置インデックスの設計

SmithDBは、エージェントトレースに対して全文検索とJSONフィルタリングをサポートし、中央値レイテンシは400ミリ秒です。本記事では、オブジェクトストレージと大規模なエージェントトレースペイロードに特化した転置インデックス設計について、直面した課題(大きなペイロード、ジップ分布、複数のクエリモダリティ、オブジェクトストレージの制約)、Tantivyを採用しなかった理由、そして2回の設計反復の教訓を詳述しています。

LangChain BlogAgent / 政策サイト内本文
エージェントとアプリケーションの間の欠落したリンク

ほとんどのAIエージェントツールはサーバー上で実行され、ブラウザAPI、デバイス機能、フロントエンド状態へのアクセスが制限されています。LangChainのヘッドレスツールが、最新のエージェントアプリケーションのために安全なクライアントサイドツール実行を可能にする方法をご覧ください。

LangChain BlogAgent / 研究サイト内本文
Deezerが他のストリーミングサービス向けAI音楽検出機能を開始

Deezerは、他のストリーミングプラットフォームのプレイリストをスキャンしてAI生成音楽を検出できるようになりました。Deezerは大手ストリーミングサービスの中で初めてAI生成音楽にラベルを付け始め、その技術を他のプラットフォームにも提供しましたが、多くの買い手はいなかったようです。今回、Deezerは直接一般向けに検出ツールを提供します。

The Verge AIツールサイト内本文
AEVS:AIエージェントの実行証明を提供

AEVSは、AIエージェントのツール呼び出しを記録し、改ざん防止の実行レシートを生成するドロップインSDKです。チャット履歴や脆弱なログに頼らず、エージェントが実際に実行したことを検証できます。

Product Hunt AIAgent / 政策サイト内本文
asyncinject 0.7 リリース

asyncinject 0.7 がリリースされました。このライブラリは asyncio 依存性注入をサポートします。Claude Fable 5 が依存関係のバグを検出し、自動で修正しました。

Simon Willison's WeblogAgent / 研究サイト内本文
Cloudskill

Cloudskill は AI スキルを管理するプラットフォームであり、散在するスキルファイルをバージョン管理、個人ごとのアクセスポリシー、完全な監査ログを備えた管理カタログに変換します。Claude、Cursor、Copilot などのエージェントを統合し、すべての変更がレビューおよび承認されることで、スキルの安全性と一貫性を保ちます。

Product Hunt AIAgent / 政策サイト内本文
Anthropic、Claude利用のAI研究者を「妨害」する可能性があった方針を撤回

Anthropicは批判を受けてClaude Fable 5の安全対策を変更し、フロンティアLLM開発への制限を可視化した。以前はユーザーに知らせずにリクエストの効果を制限していたが、今後はフラグ付きリクエストがOpus 4.8にフォールバックし、APIでは拒否理由が返される。

Simon Willison's Weblogモデル / 政策 / 研究サイト内本文
【AINews】オープンモデル、モデルラボ vs エージェントラボ、そして訓練不可能なもの — Sarah Guo

Sarah Guoによるオープンモデル、モデルラボとエージェントラボの違い、訓練不可能な価値についての深いエッセイを振り返ります。また、AnthropicのFable/Mythos展開と信頼の反発、Fable 5のベンチマーク強度、GoogleのDiffusionGemmaリリース、エージェントツールの進展、そして最適化や検索、科学モデリングの技術アップデートをカバーします。

Latent SpaceAgent / 政策サイト内本文
なぜAIはソフトウェアエンジニアを置き換えていないのか、そして今後も置き換えない

本稿では、AIがソフトウェアエンジニアの大量解雇を引き起こしたというナラティブをデータとケーススタディで反論する。AIによる解雇とされるものは財務上の理由による「AIウォッシング」であることが多く、実際の雇用データは、AIが「実行」層を圧縮しても「意思決定」と「提供」層は人間に依存することを示している。「決定-実行-提供サンドイッチ」モデルを提示し、これらのボトルネックはAIの能力向上だけでは解消されないと論じる。

AI Snake OilAgent / 研究サイト内本文
フロンティアチームがAIネイティブ開発をどのように再発明しているか

フロンティアチームはAIを使ってコードを速く書くだけでなく、ソフトウェアの構築方法そのものを再設計している。その結果、4.5倍、場合によっては10倍以上の生産性向上を実現している。この記事では、Amazon Bedrock、Prime Videoなどの事例を通じて、フロンティアチームになるための5つの実践を明らかにし、ツールよりもワークフローの変革が重要であることを強調している。

AWS Machine Learning BlogAgent / スタートアップサイト内本文
Ollama、MLXでApple Silicon上で最高のパフォーマンスを実現

OllamaのMLXエンジンがアップデートされ、Apple Silicon上でこれまでで最高のパフォーマンスを発揮します。AppleのユニファイドメモリとMetalバックエンドのMLXフレームワークをより活用することで、モデルは高品質な応答を出力し、より高速に応答し、メモリ使用量を削減します。NVFP4フォーマットのサポート、最大20%の出力速度向上、エージェントワークフロー向けのスナップショットシステムを導入。

Ollama Blogモデル / Agent / チップサイト内本文
PyTorch プロファイリング (第2部): nn.Linear から融合 MLP へ

本記事は PyTorch プロファイリングシリーズの第2部であり、nn.Linear レイヤーの内部機構(転置操作、バイアス融合エピローグ技術、torch.compile の影響)を掘り下げます。その後、GeGLU 活性化関数を含む多層パーセプトロン (MLP) のパフォーマンス特性を解析し、GPU カーネルのスケジューリングと実行を示します。

Hugging Face Blogチップ / 研究サイト内本文
OpenAIがOnaを買収へ

OpenAIは、安全で永続的なクラウド環境をCodexに統合し、エンタープライズワークフローでの長時間稼働AIエージェントを実現するため、Onaを買収する計画を発表しました。

OpenAI NewsAgent / スタートアップサイト内本文
Microsoft SkillOptのコーディング実装:インストゥルメント化されたプロンプト最適化、スキル進化分析、ベースライン比較

このチュートリアルでは、Microsoft SkillOptの完全なワークフローを実装します。環境設定、ベースライン評価、ロールアウト・リフレクション・集約・選択・更新・検証ゲーティングを含む最適化ループ、トレーニング履歴の可視化、最終的なスキル比較を行います。最終的にデプロイ可能な最適化スキルファイルが得られ、精度の向上が示されます。

MarkTechPostAgent / 研究サイト内本文