Mnemoは、会話からエンティティと関係を抽出して知識グラフを構築し、LLMに永続的なメモリを提供するサイドカーサービスです。ローカルまたはクラウドのLLMに対応し、応答時間は50ms未満、クラウド依存はありません。Docker、バイナリ、Python SDKでデプロイ可能。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
Linux Foundationは、AIトークン消費の経済学に関するオープンスタンダード、ベンチマーク、ベストプラクティスを策定するTokenomics Foundationの設立を発表した。Google、Microsoft、IBMなど多くの企業が支援する一方、OpenAIやAnthropicなどのフロンティアモデルプロバイダーは参加していない。トークン使用量の急増とコスト上昇の中、同財団はAI支出の透明性と標準化を目指す。
Google DeepMindが公開したGemma 4 12Bは、テキスト、画像、音声をネイティブに処理するオープンソースモデルで、16GBのRAMでノートPC上で動作します。ベンチマークでは2倍のサイズの26Bモデルに迫る性能を発揮し、商用利用可能なApache 2.0ライセンスで提供されます。
Googleは初めて、Search ConsoleでAI概要やAIモードなどのAI検索機能をオプトアウトするトグルをウェブサイト運営者に提供する。これらの機能はすでに月間35億人以上のユーザーにリーチしている。新しいパフォーマンスレポートではインプレッションが個別に表示される。この動きは、ウェブサイト運営者が深刻な不利益を被っていると見なす英国の競争・市場庁(CMA)によって促された。
創業7か月のスタートアップAxiomが、名門数学試験Putnamで満点を達成し、検証型AIの力を示しました。CEOのCarina Hong氏は、Leanを使った形式的検証によって知能のスケーリングと複利効果が可能になり、非公式AIのボトルネックを克服できると説明します。Verinaベンチマークで99%のスコア(OpenAI o3は4.9%)を達成し、AGI実現への鍵となる可能性があります。
このチュートリアルでは、iiiエンジンを使用してドキュメントインテリジェンスワークフローを構築する方法を紹介します。エンジンのインストール、モジュール関数の登録、分析パイプラインの構成、そして直接呼び出し、HTTPエンドポイント、fire-and-forget実行、スケジュールされたcronトリガーを介した同じロジックの再利用を網羅します。
本記事では、AIの過剰使用と完全回避の両極端を避け、チームのワークフローにおける適切なAI活用のタイミングを決めるための「AIボウタイ」フレームワークを紹介する。5つのフェーズ(調査、統合、思考(AIなし)、計画、実行)から成る。
この記事は、人工知能、特に大規模言語モデルは、人工的な人格ではなく、計算の一形態として理解されるべきだと主張している。ループ、構成性、エージェンティックハーネスが計算を可能にする役割を考察し、「Verplankalkül」を非公式プログラミング言語として紹介する。
AIがチャットボットから自律エージェントへ移行する中、CPUは「航空管制官」としてタスクを調整し、サンドボックスを管理し、軽量モデルを実行する重要な役割を果たしています。ArmとGoogleの専門家は、CPUの効率性とエージェントワークフローにおける重要性を強調しています。
Google DeepMind は Gemma 4 12B をリリースしました。これは120億パラメータの高密度マルチモーダルモデルで、従来のエンコーダーを排除し、視覚と音声を直接LLMのバックボーンに取り入れます。16GB RAMのコンシューマーノートPCでローカル実行可能で、Apache 2.0ライセンスで提供されます。テキスト、画像、音声、ビデオをネイティブに処理し、音声入力をネイティブサポートする初の中型Gemmaモデルです。
Ideogramはテキストから画像を生成するモデルのバージョン4.0をオープンウェイトモデルとしてリリース。ネイティブ2K解像度、バウンディングボックス制御、テキストレンダリングの改善を実現。DesignArenaリーダーボードではオープンモデルの中でトップ。商用利用には有料ライセンスが必要。
研究によると、AIを使用すると仕事量が増え、認知疲労につながる可能性がある。専門家は、ツールを絞り、ガイドラインに従い、出力を洗練することで、効率と品質のバランスを取ることを推奨している。
労働党議員のジェス・アサト氏は、イーロン・マスク氏のAI企業が開発したツール「Grok」によって、本人の同意なく作成された偽の性的画像がX上に拡散されたとして、訴訟を起こした。アサト氏はこうした画像の作成を批判していた経緯がある。
本稿は、GoogleのGemini SparkのようなAI生産性ツールを批判し、それらがテクノロジー企業が自ら作り出した問題を解決している一方で、賃金停滞や雇用不安といった体系的な経済問題を無視していると論じる。著者は、AI主導の生産性向上が労働者に利益をもたらしておらず、適切なセーフティネットなしでは不平等を悪化させる可能性があると主張する。
この記事では、Kiro IDE を Databricks に接続する 2 つの方法を紹介します。4 つの Databricks 管理 MCP サーバーを使った迅速なセットアップと、新しい Databricks AI デブキットパワーを使ったワンクリックインストールです。どちらの方法も Unity Catalog のメタデータに基づいており、AI アシスタントが許可されたデータのみを参照し、幻覚を減らします。また、統一されたガバナンス、単一のデータコピー、統合 AI スタックなど、AI 支援開発における Databricks の利点を強調しています。
本記事では、リーン生産方式の原則をAI推論に適用し、LLM推論における7つのムダを特定し、ジャストインタイムコンテキスト、標準作業、タクトタイム、プロンプトキャッシングなどの核となる原則を提案する。リポジトリ分析エージェントのケーススタディでは、コストを13倍削減し、レイテンシを3.3倍改善した。
シンプルなSaaSからAIネイティブプラットフォームへの移行のための実用的なフレームワーク。MCPサーバーと個人アクセストークンから、埋め込みチャット、会話履歴、カスタムUI生成、そして最終的に計画とスケジューリングを備えたエージェントハーネスまでの5つのレベルを解説。著者は複数の内部エージェント構築と既存フローへのAI組み込みの経験を基に洞察を共有。
DeepLearning.AIとRed Hatが提携し、Red HatのシニアデベロッパーアドボケイトであるCedric Clyburnが講師を務める無料中級コース「vLLMによる高速・効率的LLM推論」を提供。量子化、vLLMによるサービング、ベンチマークをカバーし、9本のビデオレッスン、3つのコード例、1つのクイズを含む。
本記事では、AIエージェントの可観測性ツールとして広く使われているLangSmith、Langfuse、Arizeの3つを比較します。LangChainベースのテストエージェントを設定し、各ツールの統合方法、トレース機能、評価ワークフローを実演します。LangSmithはLangChainとのネイティブ統合が容易で、完全な実行ツリービューとプロンプトデバッグ機能を提供します。Langfuseはオープンソースでフレームワークに依存せず、セッショングルーピングと事後スコアリングをサポートします。Arizeはプロダクション向けML可観測性に特化し、OpenInference標準を採用しています。開発ニーズに応じた最適なツール選択を支援します。
ホワイトハウスは、国防総省やCISAなどの機関に30日以内にAIツールを活用したサイバー防御強化を求める大統領令を発令した。AI開発者は自主的にモデルをセキュリティテストに提出できるが、強制的な承認は明示的に除外されている。最近の政府によるAI企業への圧力を考えると、この協力が実際にどの程度自発的であるかは疑問が残る。
英国の競争監視機関CMAは、GoogleがAI搭載検索結果でパブリッシャーのコンテンツを使用する方法の変更を命じ、ニュースサイトがAI要約へのコンテンツ利用をブロックできる権限を与える決定を下した。世界的な波及効果が予想される。
バレンシアを拠点とする防水専門会社Impermeabilizaは、人工知能を統合して診断、計画、実行を改善し、住宅、産業、商業施設の耐久性を確保しながら、漏水、湿気、カビを防ぎます。
マイクロソフトCEOのSatya Nadellaが、Microsoft BuildでNo PriorsとLatent Spaceの合同ポッドキャストに登場。フロンティアインテリジェンスプラットフォーム、MAIモデル、AI投資対効果、そしてエンタープライズAIのハーネス概念について語った。
この記事では、LangChainのcreate_agentとミドルウェアを使用してカスタムエージェントハーネスを構築する方法を説明します。ハーネスはモデルを現実世界に接続する足場であり、そのカスタマイズがエージェントの有用性を左右します。ミドルウェアはエージェントループの各ステップにフックし、決定論的ロジック、ツールライフサイクル管理、カスタム状態、ストリーム処理を可能にします。タスクとハーネスの適合度が効果を決めます。
欧州委員会は、クラウドコンピューティング、AI、半導体生産における外国供給業者への依存を減らし、外国政府や企業が欧州の重要技術サービスを「キルスイッチ」で停止させることを防ぐための技術主権提案を発表した。
MicrosoftのCopilot Healthプレビューでは、ユーザーが医療記録を共有して個別化されたAI健康アドバイスを受けられます。著者がテストしたところ、技術的な不具合により結果はまちまちで、プライバシー保護措置はあるものの、AIに医療判断を委ねることへの注意を促しています。
Microsoftは常時稼働する自律型AIエージェント「Autopilot」を発表。最初のエージェント「Scout」はユーザーの行動を監視し、自動的にタスクを実行して業務を効率化する。ただし、OpenClawベースであることからセキュリティ上の懸念があり、プロンプトインジェクション攻撃のリスクも指摘されている。現在は限られた顧客のみがプレビューにアクセス可能で、GitHub Copilotのサブスクリプションが必要。
生き残るための鍵は、AIに適応するだけでなく、積極的にコンテキストを構築し、これらの技術を自社の提供物に統合することです。
Nesrine Malikの記事に応えた読者の手紙。AIが執筆や証拠に与える影響を指摘し、偽の引用や信頼性の低い研究が真実と公共の信頼を脅かすと警鐘を鳴らす。
Meta内部チームTBDのリーダーWang氏は、専有モデルとスタートアップ文化を推進するが、会社のレイオフや追跡ソフトウェアへの抗議に直面。AIモデルMuse Sparkは視覚理解で高評価を得る一方、コーディング能力で競合に劣り、今後のモデルはコーディング、エージェントタスク、動画生成に注力する。