AI News HubLIVE

今日の必読ニュース

政策

選べる二つのAI未来

記事は、安全なAIの未来に関する二つの対照的なビジョン、すなわち単一の超強力ASIによるシングルトン(Singleton)と、多数のAIへの民主的アクセスがある多元(Plural)を探る。著者は歴史が多元社会を支持し、権力の過度な集中を避けつつ、分散システムの混沌としたが回復力のある性質を受け入れると主張する。

  • シングルトンの安全は完全な設計に由来し、多元の安全は分散型のチェックとバランスに由来する。
  • 歴史的証拠は多元社会がより回復力があり有益であることを示している。
サイト内本文
チップ

Kimi K3は安くない

中国のMoonshot AIが公開したオープンウェイトLLM「Kimi K3」について、低コストだという主張は誤りであり、実際には中国の他のモデルと比較して高価であることを解説。

  • Kimi K3はMoonshot AIがリリースしたオープンウェイトの大規模言語モデルで、議論を呼んでいる。
  • 一部のコメンテーターはK3が低コストだと主張するが、ベンチマークではOpenAIのトップモデルと同等のコストがかかる。
サイト内本文
モデル

トークン再販業者と不正を支えるリレー市場の内部

マット・レナードの調査により、LLMトークンを割引価格で再販する市場が明らかになりました。この市場では、無料トライアルの悪用、保護されていないサポートボットの利用、盗まれたクレジットカードやチャージバック攻撃などを通じて、大幅な割引を実現しています。主に中国で行われており、再販業者はone-apiやnew-apiなどのオープンソースプロキシソフトウェアを使用して複数のAPIキーをプールしています。購入者は安価なトークン、地理的制限の回避、モデル蒸留のためのデータ収集などを目的としています。

  • 再販業者は無料トライアルの悪用、保護されていないサポートボット、盗難クレジットカードやチャージバック攻撃により割引APIアクセスを提供。
  • オープンソースのプロキシソフトウェア(one-apiおよびそのフォークnew-api)がAPIキープールに使用される。
サイト内本文

Black Forest Labs、FLUX 3をリリース:画像、動画、音声、ロボット行動予測のためのマルチモーダルフローモデル

Black Forest Labs(BFL)は、画像、動画、音声を単一アーキテクチャで学習するマルチモーダル基盤モデルFLUX 3をリリースした。FLUX 3は、同一の重みセットから動画、音声、行動予測を出力する初のFLUXモデルである。Self-Flow手法に基づき、最大20秒の動画クリップをネイティブ音声付きで生成できる。人間の嗜好テストでは多くの競合を上回った。同じバックボーンは、80ミリ秒未満の応答時間でFLUX-mimicロボットポリシーも駆動する。

  • FLUX 3は画像、動画、音声を統合するマルチモーダル基盤モデル。最大20秒の動画をネイティブ音声で生成し、人間の嗜好評価で優位。
  • トレーニングはSelf-Flow手法を使用。動画は計算リソースの95%以上を消費し、音声は0.5%未満のトークン。
サイト内本文
Agent

APIを提供してください、AIではなく

著者は企業に対し、製品固有のAIチャットバーやアシスタントを構築する代わりに、よく設計されたAPIを通じてコア機能を公開するよう促しています。APIはAIエージェントに優れたツール基盤を提供し、たとえインフラプロバイダーになることを意味しても、それが重要かつ必要不可欠な道であると述べています。

  • 企業はアクセスしやすく細かい権限設定が可能なAPIを優先すべき。
  • APIにはトークン効率、人間介入フック、ドキュメントの充実が求められる。
サイト内本文

HART OS:オープンソースのAI OS、フロンティアAIにデータセンター不要

HART OS はオープンソースのAIネイティブオペレーティングシステムで、ラップトップからロボットまであらゆるデバイスでローカルに動作し、AI推論をシステムサービスとして提供します。自己改善、ピア間の連携、OpenAI互換APIを特徴とし、データセンターを不要にします。

  • HART OS はAIネイティブOSで、あらゆるデバイスでローカルファーストに動作します。
  • Model Busを介してAI推論をシステムサービスとして提供し、アプリは独自のモデルやAPIキーを必要としません。
サイト内本文

「Grill Me」スキル

grill-me スキルは、計画や設計について執拗にインタビューし、一度に一つの質問と推奨回答を提示します。Matt Pocock は現在、ほとんどの計画ワークフローに domain-model を推奨していますが、grill-me はより狭いストレステストとして有用です。PRD 作成前、機能実装前、データモデル確定前に使用します。推奨ワークフローは domain-model から始まり、to-prd、to-issues、tdd と続きます。

  • grill-me は計画や設計に対する執拗なインタビュースキルで、決定ツリーを解決します。
  • Matt は現在、 domain-model をデフォルトの計画スキルとして推奨し、grill-me は特定の状況での軽量オプションとしています。
サイト内本文

Show HN:ModelFuzz – AIエージェント向けオープンソースのランタイムガードレール

ModelFuzz は、AIエージェントへのプロンプトインジェクション攻撃を検出・防止するオープンソースツールです。レッドチームスキャナーと防御デコレーターを備え、インフラと機密データを保護します。

  • プロンプトインジェクションにより、LLMエージェントが乗っ取られ、任意のコマンド実行やデータ流出が可能になる。
  • ModelFuzz のスキャナーは、OpenAI互換エンドポイントをレッドチームテストし、脆弱性を発見する。
サイト内本文
ツール
研究

アメリカ人の考えるグローバルAI競争

ピュー・リサーチ・センターの調査によると、アメリカ人の36%が中国は米国よりAI開発で進んでいると考え、米国がリードすると答えたのは12%にとどまりました。43%が米国がAI世界リーダーとなることは極めて重要または非常に重要と回答し、51%がAIは富裕国と貧困国の格差を拡大すると予想しています。

  • 36%が中国、12%が米国、33%がどちらか不明と回答
  • 43%が米国のAIリーダーシップが重要と回答、22%は重要でない
サイト内本文
その他の更新(5件)
Agent

SP/1.0:AIエージェントの意思決定に対する確定的で再現可能な判断

SHACKLEは自律型AIエージェント向けのランタイムサーキットブレーカープロトコルで、9つの数学的不変量、Ed25519署名監査ログ、Redis分散状態エンジンを備え、確定的で検証可能な判断を提供します。

  • SHACKLEは暗号監査チェーンを備えた初のオープンソースAIエージェントランタイムサーキットブレーカー
  • 決定関数は純粋関数で8層の保護を備え、10分以内に監査可能
サイト内本文

Boffin:AIコーディングエージェントのためのスタッフエンジニア層

Boffinは、AIコーディングエージェントに現在の編集に関連するアーキテクチャ制約を提供し、検証を強制することで、不要な書き換えを防ぎます。各ファイルに正確な制約を提供し、小規模な修正が大規模な書き換えになるのを防ぎます。

  • Boffinは現在の編集に関連するアーキテクチャ制約をルーティングします。
  • 変更に比例した検証を要求します。
サイト内本文

MCPの最大のアップデート:多くのサーバーの基盤を除去

Model Context Protocol (MCP) は、セッション状態と初期化ハンドシェイクを削除し、リモートサーバー運用を簡素化する、ローンチ以来最大のアップデートを受けます。リリース候補は5月21日に凍結され、最終仕様は7月28日に予定されています。Samplingなどのコア機能が非推奨となり、移行ガイダンスが提供されます。

  • MCPのアップデートはリクエストをステートレスにすることでセッションアフィニティを排除し、運用の複雑さを低減。
  • 機能とプロトコルバージョンは_metaを介して呼び出しごとに伝達され、キャッシュとルーティングが可能に。
サイト内本文
政策

私のエッセイ執筆におけるAI利用ポリシー

エッセイ執筆でのAIツールの責任ある使用方法を概説し、透明性と倫理基準を強調します。

  • AIを執筆に使用するための明確なポリシーを提案
  • オリジナリティと学術的誠実さの維持を重視
サイト内本文

今年7月、私はSimple AI(深くYCに関わる企業)から解雇されました

Andy Trattner氏が、入社3週間でSimple AIから突然解雇された経験を語りつつ、会社と創業者に対する前向きな姿勢を維持し、新たな機会を求めています。

  • Andy Trattner氏はSimple AIに入社3週間後、火曜日の午後6時にSlackアクセスが削除され解雇された。
  • 彼は求人に応募したのではなく、創業者のCat氏とZach氏にリクルートされた。