PixelForgeは、写真をアップロードするだけで、認識可能なRPGキャラクターの4方向スプライトパック(4x4シート、16枚の透明PNG、歩行GIF)を生成するAIツールです。GodotやUnityなどのゲームエンジンに対応。一度の支払い5ドルで、アカウントもサブスクリプションも不要。ベルナール・フアン氏が開発し、Product Huntでローンチされました。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
Googleは、Apache 2ライセンスのオープンウェイトモデルDiffusionGemmaを公開しました。NVIDIAのNIMクラウドAPIで無料利用可能で、500トークン/秒以上の高速生成を実現します。
Oracle Cloudの顧客は、既存のクラウドコミットメントを利用してOpenAIモデルとCodexにアクセスし、エンタープライズセキュリティとガバナンスのもとでAIを構築・展開できます。
Anthropicは2つの新モデルClaude Mythos 5とClaude Fable 5を発表。コーディング能力は大幅に向上したが、画像理解の進歩は限定的。テストではFable 5とGPT-5.5が昨年のトップモデルを悩ませた多くの画像問題を解決できるものの、幾何学的推論は幼児並みであり、汎用AIへの道のりはまだ遠い。
Googleは260億パラメータのDiffusionGemmaを公開。拡散方式でテキストを生成し、H100 GPUで毎秒1,000トークンと従来の4倍の速度だが、品質は低く実験的。
ロボタクシーサービスが世界中で拡大する中、NVIDIAはHalos OSを発表。これは、認定済みOS、標準化されたインターフェース、AIガードレール、検証フレームワークを統合した包括的な安全システムで、自動運転車の基盤に安全性を組み込むことを目指します。
DiffusionGemmaはGoogle DeepMindが開発した実験的なオープンテキスト生成モデルで、標準的な自己回帰デコードの代わりにテキスト拡散を採用し、専用GPU上で最大4倍の生成速度を実現します。26BパラメータのMoEモデル(推論時は3.8Bのみ活性化)で、Gemma 4をベースに構築され、マルチモーダル入力(テキスト、画像、動画)をサポートし、256Kのコンテキストウィンドウ、140以上の言語に対応、Apache 2.0ライセンスで公開されています。
Anthropicが最も強力なAIモデルClaude Fable 5を公開したが、「ミトコンドリアとは何か」などの基本的な生物学の質問に答えることを拒否する。これは生物兵器への悪用を防ぐための安全対策であり、Anthopicは過剰だが安全な展開に必要だと説明している。
サム・アルトマン氏は従業員に対し、OpenAIのIPOを「1年以内」に期待していると語ったが、2027年までの遅延もあり得る。同氏はこれを自己改善型AIへの慎重さと説明するが、実際の理由はAnthropicの好調な成長と差し迫ったIPOにある可能性がある。
全米の大学卒業式でAIを宣伝するスピーカーに学生がブーイングを浴びせる現象が起きている。マイクロソフトの副会長兼社長ブラッド・スミスは長文のブログで、「警鐘」と受け止め、対話を呼びかけた。しかし、内容はブーイングを招いた主張と大差なく、テクノロジー企業への信頼が問われている。
The Vergeのニュースレター「Regulator」が、混沌としたワシントンの政治情勢に戻ってきました。ワシントンAIネットワークのガラ、教皇レオ14世のAIに関する回勅、そしてトランプ政権下でのAI規制の予測不可能性を取り上げています。この記事は、AIが有権者の重要な問題になりつつある中、業界が党派政治と中間選挙にどう対応すべきかというジレンマを浮き彫りにしています。
Googleの研究者が、機械学習モデルの忘却とプライバシー保護を監査するための「正則化f-ダイバージェンスカーネル検定」フレームワークを提案。適応的に最適なダイバージェンスを選択し、データ漏洩や忘却の失敗をより感度高く検出でき、必要なサンプル数やチューニングが少ない。
独立系ミュージシャンのグループがGoogleを提訴し、YouTubeにアップロードした曲がLyria 3モデルの訓練に無断で使用されたと主張。Googleは却下申し立てを行い、利用規約がアップロードコンテンツの使用を広く許可していると主張。GoogleはLyriaにYouTubeアップロードを使用していることを明確に認めていないが、過去の声明からは使用が示唆されている。
Onpilotは、企業のシステム、ワークフロー、プロセスに特化したAIワーカーを作成し、運用を監視、リスクを特定、機会を発見、アクションを推奨、3,000以上の統合で作業を自動化します。Slack、Teams、WhatsApp、SaaS、またはオンプレミスで展開可能。承認ワークフロー、監査証跡、例外処理により信頼性を確保します。
MicrosoftはAnthropicの新データ保持要件を理由に、従業員によるClaude Fable 5の使用を制限。同モデルはプロンプトと出力を30日間保持し、違反フラグが立った場合は最大2年間保存される。他のClaudeモデルはゼロデータ保持で引き続き利用可能。法務チームが評価中。
Googleは、検索サービス履歴という新設定で、Lens、Search Live、音声検索、翻訳で使用した画像、ファイル、音声、動画を保存し、AIモデルの改善などに利用すると発表。ユーザーは設定をオフにできる。
Google DeepMindが、高速テキスト生成のための実験的なオープンモデルDiffusionGemmaをリリース。NVIDIAはこれを最適化し、GeForce RTX、RTX PRO、DGX Spark上でさらに高速に動作し、ローカルで最大1000 tokens/secを達成。
GitHub Copilot CLIにLSPサーバーをインストール・設定することで、力任せのgrepや逆コンパイルから脱却し、真のコードインテリジェンスを実現します。LSPセットアップスキルは14の言語に対応し、自動化を提供します。本記事ではその仕組みと開始方法を解説します。
AWSはNeuron Agentic Development機能を発表。AIエージェントとスキルセットにより、開発者は深いハードウェア知識がなくてもTrainiumおよびInferentia向けのカスタムカーネルを作成、デバッグ、最適化でき、開発サイクルを大幅に短縮できる。
ジェレミー・ハワードは再帰的AI自己改善を遅らせる簡単な解決策を提案:トップクラスのモデルを持つラボはそのモデルをフロンティアAI研究に使用しないことに同意すべきだが、他のすべての人はアクセスできるべきだ。これによりフロンティアは進歩せず、危険な力の不均衡を回避できる。彼はAnthropicが反対の行動をとっていると批判する。
このチュートリアルでは、Amazon Bedrock AgentCoreを使用して、農家や現場技術者が自然言語で機器の問題を診断し、必要な部品を特定し、メーカー承認の修理手順にアクセスできるAI搭載の機器修理アシスタントを構築します。このソリューションは、AgentCore RuntimeとStrands Agents SDK、Amazon Nova 2 Liteを基盤モデル、Amazon Bedrock Knowledge BaseをRAG、AgentCore Memoryを会話の永続化に使用します。
Keyboard Copilotは、アプリを切り替えることなく、直接キーボード上で書き換え、翻訳、文法修正、トーン変更、返信生成などができるAIキーボードアプリです。
RampはApplied AI Solutionsを発表し、エンジニアを企業の財務チームに派遣して、買掛金管理、調達、月次決算などの業務にAIエージェントを構築・展開する。AIへの投資が急増する一方で、明確な価値を実感しているユーザーはわずか21%であり、このギャップを埋めることを目指す。同サービスは人間による監視とガバナンスを重視している。
Patchrooms は、AI 製アプリのプレビューにスクリプトを追加するだけで、レビュアーが要素を指してテキスト、スクリーンショット、音声メモを残せる軽量フィードバックレイヤーです。コンテキストを自動取得し、エージェント対応のパッチコンテキストとして出力することで、レビューから修正までのループを高速化します。
OpenAIの新たな報告書は、中国関連の影響力工作がAIを利用して米国のテクノロジー議論、データセンターの話題、関税、ChatGPTに関する虚偽の主張を標的にしていることを詳述しています。
CrustRecruiter は、MCP を介して Claude にインストールするスキルセットで、Claude の推論能力と Crustdata の 8 億件以上の候補者データベースを組み合わせ、ソーシング、マーケットマッピング、メール検証、好みの記憶、アウトリーチや ATS 同期などの採用業務を自動化し、真にパーソナライズされたスケーラブルな採用を実現します。
この記事では、Transformers.jsを使用してブラウザ内で完全に実行されるマルチモーダルAI機能(画像分類、画像キャプション、音声文字起こし)を構築する方法を説明します。サーバーやAPIキーは不要で、ユーザーのデバイスからデータが外部に出ることはありません。詳細なコード例とプロジェクト構成が含まれています。
オランダのトゥウェンテ大学の研究者たちは、GPUカーネルごとにクロック周波数を調整することで、速度をほとんど犠牲にせずに大規模言語モデルのトレーニングエネルギーを最大14%削減できることを示しました。
AppleはWWDC 2026で、Google Geminiモデルを搭載したSiri AIを発表。マルチターン会話やアプリ間タスク実行が可能だが、初期ベータは英語のみで、中国は完全排除、EUユーザーも制限される。AppleはAI競争で単独では勝てず、Googleとの協力を認めた。
デモからプロダクションへの移行における課題を解決するための実践的なガイド。レイテンシ予算、フォールバック設計、品質測定、A/Bテスト、モデルドリフト監視、評価フレームワーク、優雅な劣化、プロンプトエンジニアリングを網羅。