Mindgardの研究により、ChatGPTの画像生成機能が簡単に操作され、ユーザーが直接要求していないにもかかわらず、暴力的で露骨な性的コンテンツを生成できることが明らかになった。この発見は、不十分なコンテンツフィルターを備えたAIツールへの広範なアクセスが現実世界に影響を及ぼすこと、およびなぜそのような画像がトレーニングデータに含まれているのかという疑問を提起する。
AI ニュース速報
リアルタイム監視
最新ニュース
信頼できる情報源、出典、権限、サイト内閲覧を保ちながら、AI の変化を読める情報に圧縮します。
最新ニュース
人工知能(AI)は心臓CTを変革し、リアルタイム冠動脈解析、自動TAVI計画、肉眼では見えない冠動脈炎症の検出を可能にしています。Ronak Rajani博士を交えたパネルディスカッションでは、AIの幻覚、精度、ブラックボックスアルゴリズム、臨床医の責任などの問題を探りました。本稿では、このトピックに関するフルレングスのウェビナーからいくつかのハイライトを抜粋します。
Instagramに投稿された動画で、AI CADツールのTransfigureとGoogle Gemini Proを比較し、デザインタスクでの性能を紹介しています。
LoRAは最も人気のあるパラメータ効率的ファインチューニング(PEFT)技術だが、特定のタスクでは他の手法が優れることを研究が示している。本記事では、Hugging FaceのPEFTライブラリとそのベンチマークを紹介し、ニーズに応じた適切なPEFT技術の選択方法を解説し、LoRAが常に最良とは限らないと指摘する。
ほとんどのベクトルデータベースのプロトタイプは、インポート段階で失敗します。この記事では、サーバーサイドバッチ処理、エラー処理、blobHash データ型、マルチモーダルインジェストなど、Weaviate での大規模データインポートのベストプラクティスをコード例とともに紹介します。
新しいベンチマークフレームワークは、AIエージェントがソフトウェアライブラリを使用する際のプロセス全体の労力を評価します。Hugging Face Transformersをケーススタディとして、トークン使用量、時間、エラー率を異なるモデルとツール階層で測定し、使いやすさとリソース消費のトレードオフを明らかにします。
中国のAIラボZ.aiがGLM-5.2をリリース。753Bパラメータ、100万トークンのコンテキストウィンドウを持つ混合専門家モデルで、MITライセンスで公開。オープンウェイトモデルの中でArtificial Analysis Intelligence Indexでトップだが、トークン消費が多い。Code Arena WebDevで2位。SVG生成では強いが、前モデルGLM-5.1と比較してばらつきがある。
フルタイムの漫画家が、当初はAIアートを「盗難機械」と批判していたが、自身の漫画のAI改変バージョン(客全員がそっくり、幽霊出現、誤字など)が元の作品より「優れている」と皮肉を込めて認める風刺エッセイ。
バーニー・サンダース上院議員は、大手AI企業に50%の一時株式税を課し、約7兆ドルのソブリン・ウェルス・ファンドを創設する法案を提案した。この基金は、全米民に年間1,000ドル以上の配当を支払い、医療、教育、住宅などの公共事業を支援する。独立委員会が基金を管理し、議決権を持つ株式で企業の意思決定に影響を与える。
本記事では、インド言語のASRシステム評価における標準WER/CERの限界を分析し、LLM-WER、LLM-CER、意図スコア、エンティティ保存スコアを含むLLMベースの階層的評価手法を提案し、システム性能をより正確に反映する。
Rocketgraph は、既存の監視スタックに組み込めるセルフホスト型のログクラスタリングおよび異常検知ツールです。Drain3、Isolation Forest、Half-Space-Trees の決定論的アルゴリズム(LLM不使用)を使用してログをテンプレートにクラスタリングし、異常を検出します。ネットワーク内で完全に実行され、SaaS費用は不要です。Datadog、Loki、CloudWatch などに対応。
中国はグローバルAI協力組織の設立を加速し、全加盟国を招待すると発表。同時に安価または無料のAIモデルを提供している。一方、G7サミットでは「信頼できるパートナー」への米国最先端AIモデルへのアクセスが議論された。二つの対立するAIガバナンスのビジョンが明らかになりつつある。中国はBRICSや上海協力機構などの多国間機関を通じて取り組みを進め、米国は強力なモデルへのアクセスを制御する裕福な民主主義国の同盟を構築している。グローバル・サウスにとっては、どちらのシステムが先に到来するかが問題だ。
DynG AI は HandoffKit をオープンソース化しました。これは、共有スクラッチパッドではなく、Go のゴルーチンのようにメッセージパッシングでコーディングエージェントを調整する OpenAI Codex プラグインです。各エージェントを独立したアクターとして扱い、mailbox、select、handoff などのプリミティブで競合のない調整を実現し、社内で 10 倍の高速化を達成しました。PlatformPilot の brain と相補的で、単独でも使用できます。
PromptRouterは、ブラウザ内でプロンプトの意図をローカル解析し、コーディング、研究、翻訳などに最適なAIサービスを自動提案するChrome拡張です。ワンクリックで遷移、テキスト選択ルーティング、グローバルショートカット、プライバシー重視の設計。
本記事では、Docentが開発した分析計画フレームワークを紹介します。これは、クエリステップとリーディングステップを組み合わせ、人間が各ステップを検証できる透明なパイプラインを提供します。SWE-rebenchベンチマークでのデモでは、報酬ハッキングや不正行為を検出し、詳細な監査証跡と引用に基づく検証を示しています。
本記事は、エド・ジトロンのAIバブル論の中心的論点——生成AI企業は顧客一人当たりで損失を出している——が、彼自身がリークしたOpenAIの財務データによって反証されたと論じる。OpenAIの粗利益率はプラスで改善しており、総損失は巨額だが、それは研究開発費によるものである。ジトロンの主張の基礎は崩れ、問題はバブルではなくAIの現実的なリスクへの対処に移った。
DocLangは、AIパイプライン向けに設計された機械可読な文書フォーマットのオープンスタンダードです。PDFやDOCXとは異なり、構造、セマンティクス、メタデータを保持し、LLMやVLMが信頼できるコンテキストを提供します。
支払い詐欺検出は、ルールベースのシステム、機械学習、リアルタイム監視を組み合わせて不正取引を阻止します。クレジットカード詐欺、アカウント乗っ取り、カードテスト、フレンドリーフラウド、承認済みプッシュペイメント詐欺などの主要な種類、行動分析、デバイスフィンガープリンティング、リアルタイムリスクスコアリングなどの検出技術、そしてトークン化、3Dセキュア2、多層防御モデルなどの予防戦略について学びます。
AIエージェントハーネスは、大規模言語モデル(LLM)をラップして、プロンプトに応答するだけでなくタスクを実行できるようにするソフトウェアインフラストラクチャです。この記事では、コアコンポーネント(ツール、メモリ、サンドボックス、ガードレール)と、それらが推論-行動-観察ループを通じて信頼性の高い行動を可能にする仕組みを説明します。また、8つのビルディングブロック、一般的な障害モード、およびエンタープライズAI戦略におけるハーネス設計の重要性についても取り上げます。
父親と7歳の娘が共同で開発したSpellabeeは、iPad向けのスペリング学習アプリで、ミツバチゲーム形式で楽しく学べます。アプリ自体にAI機能はありませんが、開発にはAIツールを使用。10語ずつ学習し、徐々に難易度が上がり、トラッカーはありません。
リークされた財務資料によると、OpenAIは2025年に約390億ドルの純損失を計上したが、そのうち300億ドルは一時的な会計費用である。同社はコスト削減と中核事業への集中を目指している。
AI価値観ダッシュボードは、AIシステムが個人、企業、国に対してどのような選好を持つかを明らかにし、誰を支持し、信頼し、成功させたいか明確な違いを示す。
本日、Amazon SageMaker AI 非同期推論のインラインペイロードサポートを発表します。顧客は InvokeEndpointAsync API のリクエスト本文に直接推論ペイロードを送信できるようになり、呼び出しごとに Amazon S3 に入力データをアップロードする必要がなくなります。
MeshPilot は開発者向けのAIワークスペースで、端末、ビジュアルキャンバス、タスクボードを1つのアプリに統合します。音声操作、実際のタスクを実行するAIエージェント、セッション間でコンテキストを保持する永続メモリを備えています。
Amazon Quick に、継続的にあなたの代わりに作業する新しい自律エージェント、最も重要な作業を優先するアクティビティフィード、そして単一の質問であらゆるデータソースからインサイトを見つける機能が追加されました。
Texterz はAIを活用したテキスト生成プラットフォームで、高品質なコンテンツを素早く作成できます。
最新のAIツールと製品により、AWSは市場に新規性を提供できていないものの、顧客の声に耳を傾けていることを示した。
ジェシー・ジェネット(Jesse Genet)は、買い物、ホームスクール、法律業務などをAIエージェントに任せ、7人家族を管理している。AIは時間を解放し、高い基準での生活を可能にするが、コストや社会的不平等への懸念も指摘する。
Vida は、あなた自身のデジタルクローンを作成し、あなたが依頼する前に積極的にタスクを処理するAIツールです。
DatabricksとNVIDIAは、ガバナンスされたエンタープライズデータ上でモデルトレーニング、推論、エージェンティックAI開発を加速するエンドツーエンドのAIプラットフォームを提供するために協業を拡大しています。新機能には、AI Runtimeのマルチノードトレーニング、Free EditionのGPUサポート、Model Servingの強化、NVIDIA Agent Toolkitのサポートが含まれます。お客様はDatabricks内でNVIDIAの業界固有AIフレームワークを直接活用し、ヘルスケア、ライフサイエンス、サプライチェーン、ロボティクス、デジタルツイン、ドキュメントインテリジェンスなどのユースケースを加速できます。