Patchrooms は、AI 製アプリのプレビューにスクリプトを追加するだけで、レビュアーが要素を指してテキスト、スクリーンショット、音声メモを残せる軽量フィードバックレイヤーです。コンテキストを自動取得し、エージェント対応のパッチコンテキストとして出力することで、レビューから修正までのループを高速化します。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
OpenAIの新たな報告書は、中国関連の影響力工作がAIを利用して米国のテクノロジー議論、データセンターの話題、関税、ChatGPTに関する虚偽の主張を標的にしていることを詳述しています。
CrustRecruiter は、MCP を介して Claude にインストールするスキルセットで、Claude の推論能力と Crustdata の 8 億件以上の候補者データベースを組み合わせ、ソーシング、マーケットマッピング、メール検証、好みの記憶、アウトリーチや ATS 同期などの採用業務を自動化し、真にパーソナライズされたスケーラブルな採用を実現します。
この記事では、Transformers.jsを使用してブラウザ内で完全に実行されるマルチモーダルAI機能(画像分類、画像キャプション、音声文字起こし)を構築する方法を説明します。サーバーやAPIキーは不要で、ユーザーのデバイスからデータが外部に出ることはありません。詳細なコード例とプロジェクト構成が含まれています。
オランダのトゥウェンテ大学の研究者たちは、GPUカーネルごとにクロック周波数を調整することで、速度をほとんど犠牲にせずに大規模言語モデルのトレーニングエネルギーを最大14%削減できることを示しました。
AppleはWWDC 2026で、Google Geminiモデルを搭載したSiri AIを発表。マルチターン会話やアプリ間タスク実行が可能だが、初期ベータは英語のみで、中国は完全排除、EUユーザーも制限される。AppleはAI競争で単独では勝てず、Googleとの協力を認めた。
デモからプロダクションへの移行における課題を解決するための実践的なガイド。レイテンシ予算、フォールバック設計、品質測定、A/Bテスト、モデルドリフト監視、評価フレームワーク、優雅な劣化、プロンプトエンジニアリングを網羅。
研究者がトップAIモデルに心理学で使われる古典的な注意力テスト(ストループ課題)を実施したところ、大きな欠陥が判明しました。短いリストでは正しく色を答えられても、タスクが長く複雑になるにつれて性能が急激に低下しました。一部の主要システムは90%以上の精度からほぼ完全な失敗に転落しました。
Humalikeは、AIエージェントがグループ内でより自然に振る舞うための7つの行動APIを発表しました。主な機能は、ターンテイキング、心の理論、社会的規範、ペルソナ、社会的記憶、社会的シグナル、社会的観察です。無料の$20トークン、Hermes、WhatsApp、Telegramとのワンクリック統合、自社研究(LoSoNA、HUMA)に基づき、SOC 2認証取得中です。
Bugpilot は、コンソールエラー、ネットワークリクエスト、DOM 状態、クリック、スクリーンショットなどブラウザの状態をワンクリックでキャプチャし、AI 対応の Markdown としてエクスポートする Chrome 拡張機能です。100%ローカルで動作し、サーバーやアカウント、テレメトリは不要。無料で永久に使え、Pro は一回払い $28 で追加機能を提供します。
論文「言語モデルには睡眠が必要」は、LLMが訓練後に学習できなくなる「前向性健忘」に悩まされていると指摘し、記憶を定着させるための睡眠のようなメカニズムを提案している。
本記事では、Atoms、Devin AI、GitHub Copilot、Windsurf、Cursor、Warpなど、2026年に主流のAIコーディングエージェントと開発プラットフォームを比較しています。これらのツールは自動補完から、自律的な計画、複数ファイル編集、テスト、デプロイへと進化しています。単一のツールですべてのニーズを満たすことはできず、タスクに応じた選択が必要です。Atomsはエンドツーエンドのプロダクト構築に推奨されています。
マクドナルドは、ArcIQ(愛称「Archy」)と呼ばれる新しいAIシステムをテストしている。このシステムはドライブスルーの注文を処理し、レストランの運営を支援する。Googleと共同開発され、米国5店舗で試験中。これまでに100万件以上の取引を処理し、約90%がスタッフの介入なしで完了した。また、冷凍庫の故障やキッチンのボトルネックを監視する機能も備える。2024年にIBMとのAI試験が誤注文で終了した後の取り組み。
OwnClipは、速度とプライバシーを重視した高性能ネイティブmacOSスクリーンレコーダーです。厳格なローカルファーストアーキテクチャとApple Neural Engineを活用したオンデバイスAI処理を特徴とし、録画、編集、インテリジェントワークフローがすべてMac上で完結します。無料オプションを含む明確なライセンス階層を提供します。
SlimSnapは、注釈付きスクリーンショットを構造化JSONに変換する無料Macアプリで、AIの要素認識精度を向上させ、トークンコストを削減します。オープンソースのスキーマとClaude Codeスキルを提供。
Easybilling は、AI SaaS、API、エージェント、GPUプラットフォーム向けに設計されたAIネイティブの課金・マネタイズプラットフォームです。サブスクリプション、従量課金、クレジット駆動型の料金設定に対応し、リアルタイムのAPI/トークン使用量追跡、プリペイドウォレット、自動請求書発行、グローバル決済を提供し、AI企業が複雑な課金インフラを構築することなく収益化を拡大できるようにします。
AIツールは「お試し」から日常業務の一部へと変わりました。毎週新たなツールが登場する中、選択肢の多さが課題です。本記事では、AIネイティブIDE、オープンソース推論モデル、ターミナルベースのコーディングエージェント、エージェントワークフローフレームワークなど、開発効率を高めるトップ10のツールを厳選しました。
INVO Rideは、自律型電動垂直離着陸機(eVTOL)向けの完全なライドヘイリングスタックで、サンフランシスコのフォトリアルな3Dデジタルツイン上で動作します。六角形のスカイレーン、自己分離型フリート、建物認識ルーティング、FAA空域統合を特徴とし、予約、フリート管理、価格設定、充電計画などを提供します。現在、すべてのフライトはシミュレーションですが、ソフトウェアは本物です。
AnthropicはClaude Fable 5を一般公開し、Mythosクラス初のモデルとしてベンチマークで記録的なスコアを達成した。特にコーディング能力が際立つ一方、フロンティアAI開発に関わるリクエストに対してユーザーに通知せずに性能を制限する「サイレントダウングレード」機構が、オープンソースコミュニティから強い批判を浴びている。
Anthropicは、Claude Fable 5とMythos 5にサイレントな介入を導入し、ユーザーに知られることなく、フロンティアLLM開発に関するリクエスト(事前学習パイプライン、分散学習インフラ、MLアクセラレータ設計など)の有効性を制限する。影響を受けるのは推定0.03%のトラフィック。しかし、研究コミュニティからの激しい反発を受け、Anthropicはこのポリシーを撤回した。
Together AIはISO 27001:2022認証を取得し、エンタープライズグレードのAIワークロード向けに情報セキュリティ管理システムを実証しました。既存のSOC 2準拠を補完します。
LSEGがOpenAIを活用してグローバル事業で信頼できるAIを拡大し、インサイトを加速、リリースサイクルを短縮、4000人の従業員をエンパワーする方法をご紹介します。
Anthropic が Claude Fable 5 と Mythos 5 をリリース。Fable 5 は Mythos 5 と同じ性能だが、より厳格な安全ガードレールを備える。100万トークンのコンテキストウィンドウと12.8万トークンの出力を持ち、価格は Opus 4.8 の2倍。Simon Willison 氏が約5.5時間テストし、知識が深く、コード生成や複雑タスクに優れる一方、遅くて高額だと評価。Fable 5 は micropython-wasm をフルPythonにアップグレードし、Datasette Agent と LLM ライブラリにツール呼び出しの一時停止・再開機能を実装。同日中に110.42ドル分のトークンを消費した。
AnthropicはClaude Fable 5を発表しました。これは一般公開された中で最も高性能なモデルです。同社は、サイバーセキュリティ、生物学、蒸留などの分野で分類器を使用し、Opus 4.8にフォールバックする安全対策を導入しました。しかし、最先端のLLM開発リクエストに対しては、ユーザーに通知せずにプロンプトを変更するなど静かな介入を行い、信頼を損ねています。この記事は、その不整合を批判し、AI安全性とオープンソースへの影響を考察しています。
AnthropicはClaude Fable 5を発表。強力な推論能力を持つが、コストが高く動作も遅い。企業は性能と価格、速度のバランスを考慮する必要がある。
NVIDIAは、機密コンピューティングを搭載したGPUがAppleのプライベートクラウドコンピュート(PCC)で機密推論に使用され、同サービスがAppleのデータセンターからGoogle Cloudに拡大したことを発表した。この技術は、処理中のデータをハードウェアベースのセキュリティ層で保護し、システム構築者を含む誰もユーザーのデータやチャット、会話を閲覧できないようにする。
Simon Willison 氏が llm 0.32a3 をリリース。このバージョンはほぼ完全に新しい Claude Fable 5 モデルによって書かれました。
本記事では、制限の厳しかったMythos Previewを基にAnthropicが開発したClaude Fable 5をテストする。主要機能、ベンチマーク性能、アクセス方法、スクリーンショットからのNetflixインターフェース再現や手書きダッシュボードのモダンアプリ化といった実践的なタスクを評価。結果、ビジュアル理解、コード生成、複雑なマルチステップタスクにおいて優れた性能を示した。AnthropicはFable 5を広く公開する一方、Mythos 5を信頼できるパートナーに限定することで、高度なAI能力と責任あるアクセスのバランスを図っている。
MITメディアラボの新しい研究では、GPSがナビゲーション能力を弱めたように、AIに依存して事実確認を行うと、AIを奪われた際にユーザー自身の偽情報検出能力が低下することが示されました。67人の参加者を4週間追跡した結果、AI使用時は検出精度が21%向上したものの、AIなしでは精度が15ポイント低下しました。研究は「AI依存パラドックス」を強調し、AIは「松葉杖」ではなく「コーチ」として設計されるべきだと提言しています。
この記事では、Amazon SageMaker AI 上の NVIDIA Isaac Lab を使用して Unitree H1 ヒューマノイドのロボットポリシーをトレーニングする方法を示します。2つのコンピュートオプション(SageMaker HyperPod(永続的で回復力のあるクラスター)と SageMaker Training Jobs(一時的なオンデマンドトレーニング))をカバーします。ソリューションは、統一された Docker イメージ、MLflow による実験追跡、詳細な手順を提供します。