AI News HubLIVE

モデル価格の最新ニュース

Moonshot AI、2.8兆パラメータのKimi K3モデルの重みを公開

Moonshot AIは今月初めの約束通り、2.8兆パラメータのKimi K3モデルの重みをHugging Faceで公開しました。ファイルサイズは1.56TBです。K3のライセンスはK2の「修正MIT」から変更され、年収2000万ドルを超えるMaaS企業には別途契約が必要です。Moonshotは「オープンソース」ではなく「オープンウェイト」という用語を一貫して使用しています。OpenRouterは既に7つのプロバイダからK3を提供しており、価格はMoonshot自身と同じです。

  • Moonshot AIが2.8兆パラメータのKimi K3重みを公開(サイズ1.56TB)。
  • K3ライセンスは「修正MIT」を名乗らず、年間売上2000万ドル超のMaaS事業者に別途契約を要求。
サイト内本文

GTM Co-Founder – ソロのDevTool/AI創業者のためのオープンソースGTMスキル

GTM Co-Founderは、資金や商業的な共同創業者なしで開発者向けツールやAI製品を構築するテクニカルファウンダー向けのオープンソースGTM(市場投入)スキル集です。AIエージェント(Claude Code、Cursor、Codexなど)と連携するMarkdown形式のプレイブックで提供され、ポジショニング、初期ユーザー獲得、価格設定、営業などをカバーします。15分の創業者ブリーフィングから優先順位付きロードマップを生成し、エージェントが段階的に実行をサポートします。

  • オープンソースのGTMプレイブック、ソロのDevTool/AIファウンダー向け
  • Claude Code、Cursor、CodexなどのAIエージェントと統合可能、3つの統合パス
サイト内本文

トークン再販業者と不正を支えるリレー市場の内部

マット・レナードの調査により、LLMトークンを割引価格で再販する市場が明らかになりました。この市場では、無料トライアルの悪用、保護されていないサポートボットの利用、盗まれたクレジットカードやチャージバック攻撃などを通じて、大幅な割引を実現しています。主に中国で行われており、再販業者はone-apiやnew-apiなどのオープンソースプロキシソフトウェアを使用して複数のAPIキーをプールしています。購入者は安価なトークン、地理的制限の回避、モデル蒸留のためのデータ収集などを目的としています。

  • 再販業者は無料トライアルの悪用、保護されていないサポートボット、盗難クレジットカードやチャージバック攻撃により割引APIアクセスを提供。
  • オープンソースのプロキシソフトウェア(one-apiおよびそのフォークnew-api)がAPIキープールに使用される。
サイト内本文

NYUスターン校の価格専門家:次期スマホに忍び寄る「AI税」

NYUスターン・ビジネススクールのスリカンス・ジャガバトゥラ教授は、AIデータセンターの拡大がメモリチップの生産能力を圧迫し、ノートパソコンやスマートフォンなどの消費者向け電子機器の価格上昇を引き起こしていると指摘。この「AI税」は、高帯域幅メモリ(HBM)が従来のDRAMと生産設備を共有し、データセンターの高い支払い意欲が消費者を圧迫することに起因する。Appleなどのメーカーは値上げを余儀なくされ、Apple自身のオンデバイスAI戦略がメモリ需要をさらに高めている。

  • AIデータセンターのHBM需要が民生用DRAMの生産能力を圧迫し、不足と価格高騰を引き起こしている。
  • Apple、Dell、Lenovoなどが部品コスト上昇で値上げ、2026年のPC平均販売価格は18.3%上昇と予測。
サイト内本文

AIはコンサルティングを殺していない。価値の代理指標としての時間を殺している

AIにより知識作業の効率は上がったが、顧客が買っているのは時間ではなく成果だ。コンサルティング業界は時間単位の課金から価値ベースの価格設定へ移行すべきである。

  • 顧客は時間ではなく、判断力、経験、確信を購入している。
  • AIが圧縮するのは労力であり、経験ではない。専門知識の価値は変わらない。
サイト内本文

AI投資の祭壇で、Googleは金の卵を産むガチョウを犠牲にしている

月50万ドル以上をGoogle広告に費やす長期広告主が、収益成長を維持するためのGoogleの短視的な戦略を詳細に説明。第二価格オークションから最高入札額への移行、キーワード完全一致の弱体化、予算上限の無視などが行われており、広告主エコシステムを損なっている。

  • Googleは第二価格オークションから最高入札額方式に密かに移行し、広告主のコストが上昇
  • 完全一致キーワードに無関係なバリエーションが大量に含まれ、広告主は低品質なトラフィックに支払いを強いられる
サイト内本文

[AINews] Claude Opus 5:Opus価格でFable級の性能(Fableの半額)

AnthropicはClaude Opus 5をリリースし、Opus価格(Fableの半額)でFableに迫る性能を実現しました。独立したベンチマークでは一部の指標でFableを上回っていますが、公式メッセージは慎重です。コミュニティの反応は、ベンチマークの不整合はあるものの、強力なコーディング能力とエージェンティックなツール使用を強調しています。

  • Claude Opus 5はECI 159(Fable 5の161)、SWE-ECI 161でFableと同等。
  • ユーザーは優れたコーディング性能と効果的なブラウザ自動化を報告。
サイト内本文

新しいClaude Opus 5のご紹介:同じOpus価格で最前線のエージェントコーディングとコンピューター利用

AnthropicはClaude Opus 5をリリースし、Opus 4.8に代わるOpus層のフラッグシップとしました。価格は据え置き(入力100万トークンあたり5ドル、出力25ドル)で、Claude Fable 5の半分の価格でその知能に迫ります。主な変更点として、思考機能がデフォルトでオン、無効化時の破壊的変更、検証プロンプトの削除などがあります。エージェントコーディングとコンピューター利用のベンチマークで卓越した性能を示し、特にOSWorldとZapier AutomationBenchで優れています。セキュリティ面では、ソースコードの脆弱性発見のみが緩和され、悪用経路は引き続きブロックされています。

  • 価格は変わらず、性能は大幅に向上し、Fable 5に迫る
  • 思考機能がデフォルトでオン、高努力では無効化不可
サイト内本文

AWSでのClaude Opus 5提供開始:Anthropicの最も高性能なOpusモデル

AnthropicはAmazon BedrockとClaude Platform on AWSでClaude Opus 5を発表しました。このモデルは、コーディング、ナレッジワーク、視覚的理解、長時間タスクにおいて大幅な改善をもたらし、Opusレベルの価格でトップクラスのインテリジェンスを実現します。Bedrockではデフォルトでデータ保持ゼロ(ZDR)を提供します。

  • Claude Opus 5はAnthropicの第5世代Opusモデルで、コーディングと推論能力が大幅に向上。
  • Amazon Bedrock上でデフォルトでデータ保持ゼロを実現し、エンタープライズデータガバナンスを確保。
サイト内本文

Claude Opus 5登場:Fable 5に迫る性能、半額の価格

AnthropicがClaude Opus 5をリリース。コーディングやナレッジワーク、エージェントワークフローで優れた性能を発揮し、Fable 5に迫る性能を半額で実現。価格はOpus 4.8と同じ。

  • Opus 5は複雑なコーディングや知識タスクでFable 5に迫る性能を半額で提供。
  • Opus 4.8と比較して平均26%少ないトークン使用量でセッション効率が向上。
サイト内本文

Anthropic、Opus 5を発表「Fable 5の能力に近い」

Anthropicは新モデルClaude Opus 5を公開。多くの分野でFable 5の能力に近く、複雑なコーディングタスクで優れるとしている。価格は前世代と同じだが、2倍の速度の「Fastモード」を追加料金で提供し、サイバーセキュリティ対策も強化されている。

  • AnthropicがClaude Opus 5をリリース、Fable 5に迫る性能で複雑なコーディングに強い。
  • Opus 5の価格はOpus 4.8と同額だが、高速なFastモードは倍額。
サイト内本文

フロンティアモデルの価格設定はぼったくりなので、オープンソースCLIを開発しました

Kolega Code はローカルファーストのターミナルコーディングエージェントで、大規模なコードレビューや移行などのタスクに対してマルチエージェントオーケストレーション(Gigacode)を提供します。複数の専門サブエージェントを並行実行でき、多様なモデルプロバイダーとルーティングをサポートし、計画/ビルドモードや豊富なツールセットを備えています。

  • Kolega Code はオープンソースのローカルファーストターミナルコーディングエージェントで、マルチエージェント連携を実現。
  • Gigacode機能により、大規模コードベースの処理を効率化する並行サブエージェント実行が可能。
サイト内本文

Show HN:最先端モデルの価格設定はぼったくりなので、オープンソースのCLIを作りました

Kolega Codeは、オープンソースでローカルファーストのCLIツールであり、複数のAIエージェントを調整してコーディングタスクを実行します。さまざまなモデルプロバイダーをサポートし、並列サブエージェントワークフロー(Gigacode)、ウェブ検索、ブラウザ自動化などを備え、すべてのデータをユーザーのマシンに保持します。

  • 専門化されたサブエージェントとGigacodeの並列ワークフローによるマルチエージェントコーディング。
  • ローカルファースト設計:セッション、キー、状態はユーザーのマシンに残ります。
サイト内本文

Gemini 3.6 Flash登場:効率性を重視したリリース

2026年7月21日、Googleは画期的な能力ではなく効率性に焦点を当てた中間アップデート「Gemini 3.6 Flash」を静かにリリースしました。推論能力は3.5 Flashと同程度ですが、トークン消費とコストが大幅に削減されています。コード生成、MLタスク、コンピュータ使用のパフォーマンスが向上し、知識カットオフ日も更新されました。価格は入力100万トークンあたり1.50ドル、出力7.50ドルで、前世代より安価です。記事にはモデルを自分で評価するためのストレステストが含まれています。

  • Gemini 3.6 Flashは生の知能の飛躍ではなく、効率性の向上に重点を置いている
  • 出力トークンが約17%削減され、タスクによっては最大65%削減
サイト内本文

新しいGemini 3.5 Flashモデル:高速化・低コスト化だが、知能は向上せず

更新されたモデルは、企業向けに手頃な価格を目指しています。新しいサイバーモデルはオーケストレーション用に設計されています。

  • Gemini 3.5 Flashモデルが高速化・低コスト化されたが、知能は向上していない。
  • 企業向けに開発され、導入コストを削減。
サイト内本文

Google、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberをリリース:エージェントワークロード向けのより安価でトークン効率の高いFlash層

Googleは2026年7月21日、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの3つの新しいGeminiモデルをリリースしました。3.6 Flashは出力トークンを17%削減し、出力価格を100万トークンあたり7.50ドルに引き下げました。Flash-Liteは毎秒350トークンで動作し、Flash Cyberは脆弱性発見のためにCodeMenderを強化します。フラッグシップの3.5 Proは引き続き遅延しています。

  • Gemini 3.6 Flashは出力トークンを17%削減(DeepSWEでは最大65%)、出力価格を100万トークンあたり9.00ドルから7.50ドルに引き下げ。
  • Gemini 3.5 Flash-Liteは毎秒350トークン、入力0.30ドル/出力2.50ドル(100万トークンあたり)で動作し、SWE-Bench ProやOSWorld-Verifiedで旧3 Flashを凌駕。
サイト内本文

中国の低価格Z.aiモデルがコーダーの高コスト習慣を露呈

Z.aiのGLM 5.2は低価格でオープンウェイトのモデルであり、米国のフロンティアAIモデルに挑戦する。しかし多くのプログラマーは依然として高価なモデルを使い続け、コストを無視している。ベンチマークではClaude Opus 4.8に迫る性能を示すが、実際の使用感は様々。

  • GLM 5.2のAPI価格はAnthropic Opus 4.8の5分の1、Fableの10分の1
  • オープンウェイトで自社ホスティングが可能、データプライバシー問題を回避
サイト内本文

先週のAI #251 - Mythos復活、Sonnet 5、Etched、LongCat

Anthropicが米国政府との協議後にClaude Fable 5を再展開し、新たなサイバーセキュリティ分類器を追加。Claude Sonnet 5の低価格版も発表。GoogleのNotebookLMがTikTok風動画要約機能を追加、Nano Banana 2 Lite画像生成器もリリース。Etchedへの大規模投資、百度AIチップ部門のIPO計画、Agility RoboticsのSPAC上場、DeepSeekの拡大採用、中国のLongcat 2.0 MoEモデルと長期エージェントベンチマークなど。

  • AnthropicがClaude Fable 5を再展開し、セキュリティ分類器とフレームワークを追加
  • Anthropicが低価格のClaude Sonnet 5をエージェント用途に投入
サイト内本文

Wire AI: モバイルアプリ向けのAIネイティブ成長エンジニア

Wire AIは、AIを活用したA/Bテストでユーザージャーニーをパーソナライズし、アクティベーションとリテンションを向上させるモバイルアプリ向け成長ツールです。アクティベーションが改善されなければ支払いは不要というリスクフリーの価格モデルを採用しています。

  • Wire AIはAI駆動のA/Bテストにより、アプリ内のユーザー体験全体を個別最適化します。
  • 実際のアプリで1日あたりのインストール数が100から1,000に増加し、オンボーディング完了率93%を達成。
サイト内本文

Alibaba、2.4兆パラメータのマルチモーダルモデルQwen3.8-Maxをプレビュー、MoonshotのKimi K3オープンウェイト公開から数日後

AlibabaのQwenチームは、2.4兆パラメータのマルチモーダルMoEモデルQwen3.8-Max-Previewをプレビューし、「Fable 5に次ぐ」と称しています。プレビューはToken Plan、Qoder、QoderWorkで標準価格の10%で提供されています。ベンチマーク表、モデルカード、ライセンス、トークンあたりの価格、アクティブパラメータ数はまだ公開されていません。本記事では、Alibabaが確認した情報と主張のみの情報を区別します。

  • Qwen3.8-Max-PreviewはToken Plan、Qoder、QoderWorkで標準価格の10%で提供中。
  • 2.4兆パラメータと「Fable 5に次ぐ」とのランキングはAlibabaの主張であり、検証済みのベンチマークではない。
サイト内本文

10-Kレポートのどの部分が重要か?全文とリスク要因の感情分析の集約依存価値

この研究は、教師あり辞書学習を10-K提出書類とそのItem 1Aリスク要因セクションに拡張し、リターンとボラティリティラベルに対してセクター、ポートフォリオ、個別企業の3つの集約レベルで感情スコアを訓練。2006~2023年のナスダック100テクノロジー企業94社の1,383件の提出書類を用いて、全文はセクターおよびポートフォリオレベルでより正確な感情分析を生み出すが、個別企業レベルでは狭いItem 1Aセクションの方が優れていることを発見。Loughran-McDonald辞書ベースラインはすべてのレベルで価格と一貫して強い負の相関を示し、規制開示テキストに対する教師ありアプローチの価値を強調している。

  • 全文の感情分析はセクター・ポートフォリオレベルで正確だが、個別企業レベルではItem 1Aが優れる。
  • Loughran-McDonald辞書ベースラインはすべてのレベルで価格と強い負の相関を示す。
サイト内本文

GPT-5.6 Sol vs Claude Fable 5:ベンチマーク、価格、実践比較

GPT-5.6 Sol と Claude Fable 5 は、フロンティアモデルの座を争っています。Fable 5 は一般的な知能でわずかに優れている一方、Sol はコーディング性能、実行速度、価格で反撃します。Sol の価格は Fable 5 よりも Claude Opus 4.8 に近く、この比較をより興味深いものにしています。

  • GPT-5.6 Sol はコーディングで優れ、価格も安い。Claude Fable 5 は一般的な知能でわずかに優位。
  • Sol の API 価格は入力100万トークンあたり5ドル、出力30ドル。Fable 5 はそれぞれ10ドルと50ドル。
サイト内本文

Thinking MachinesのInklingがModalで利用可能に

Thinking Machinesが汎用マルチモーダルモデルInklingをリリース。テキスト、画像、音声入力に対応し、ModalのManaged Endpointとしてトークンベースの価格で利用可能。本記事では、局所注意機構アーキテクチャとDFlash投機的復号の利点について解説。

  • Thinking MachinesがInklingをリリース。総パラメータ975B(活性化41B)、マルチモーダル、1Mトークンコンテキスト。
  • Inklingは局所注意レイアウトを採用。6層中5層がスライディングウィンドウ注意で計算効率を向上。
サイト内本文

Anthropic Claude Sonnet 5 vs Sonnet 4.6 vs Opus 4.8:エージェンティックコーディングベンチマーク、API価格、コストパフォーマンスの比較

AnthropicはClaude Sonnet 5をリリースしました。これは最もエージェンティックなミッドティアモデルで、前世代のSonnet 4.6をすべてのベンチマークで上回り、フラッグシップのOpus 4.8との差を縮めています。努力レベル(effort levels)を導入し、低/中努力では高いコストパフォーマンスを発揮しますが、超高努力ではOpus 4.8よりもコストがかかる可能性があります。FreeおよびProプランのデフォルトモデルとなり、APIからも利用可能です。

  • Sonnet 5はSWE-bench Pro、OSWorld-Verified、HLEでSonnet 4.6を上回り、Opus 4.8に迫る。
  • 価格はOpus 4.8より低く、$2/$10 per MTokの導入価格(2026年8月31日まで)、その後$3/$15。
サイト内本文

AI構築が最新のインフレ脅威に

AIデータセンターへの巨額投資により、メモリチップやパソコン、電力の価格が上昇。インフレがFRBの目標を上回り続け、利上げにつながる可能性がある。

  • 4大テクノロジー企業は今年、データセンターを中心に7200億ドルを投資見込み。メモリチップ価格は最大400%上昇。
  • アップルやマイクロソフトはノートPCやゲーム機などの価格を引き上げ。
サイト内本文

AIについての考察

著者はAIに関する自身の見解を共有し、その影響は大きく、肯定的であると位置づけている。仕事の代替、SaaSの将来、価格変動、資本支出の正当性について質問に答え、AIがプロセスを効率化しビジネスモデルを変革するが、過度な懸念は不要だと論じている。

  • 著者はAIに対して非常に肯定的で、その影響は大きいと考えている。
  • AIは仕事を完全に奪うのではなく、仕事のやり方を変える。
サイト内本文

2026年初頭、AIサブスクリプションが割り当てを削減し価格を引き上げ

2026年初頭、複数のAIサブスクリプションサービスが割り当てを削減し価格を引き上げ、ユーザーの不満を招いている。記事は2025年の激しい競争を振り返り、現在のサービスの縮小傾向を強調している。

  • 2026年初頭、AIサブスクリプションが割り当てを削減し価格を引き上げ
  • ユーザーはコスト増加と使用制限の減少に直面
サイト内本文

韓国半導体SK hynix、AIブームに乗り米国上場で265億ドル調達

先進メモリチップサプライヤーのSK hynixは、AIデータセンター建設競争により利益が急増。同社は金曜日に米国上場の価格設定を行い、265億ドルの調達を目指す。

  • SK hynixは金曜日に米国上場の価格設定を完了し、265億ドルの調達を目指す。
  • 同社はAIブームの主要な恩恵を受けており、利益が急増している。
サイト内本文

GPT-5.6 登場:Sol、Terra、Luna

OpenAI が GPT-5.6 シリーズを発表。フラッグシップの Sol、ワークホースの Terra、高速な Luna の3モデルで、全ユーザーが無料で利用可能。価格、性能、安全性、ハンズオンテストの詳細を解説。

  • 3モデル:Sol(フラッグシップ)、Terra(実務用)、Luna(高速)、全ユーザーに無料開放。
  • 価格:Sol 標準 $5/$30、高速版 $12.50/$75、Terra $2.50/$15、Luna $1/$6(100万トークンあたり)。
サイト内本文

Meta Superintelligence Labs、Muse Spark 1.1をリリース:エージェントタスク向けマルチモーダル推論モデル、Meta Model API上で提供

Meta Superintelligence Labsは、エージェントタスク向けに最適化されたマルチモーダル推論モデルMuse Spark 1.1をリリースし、Meta Model APIのパブリックプレビューを開始しました。本モデルは100万トークンのコンテキストウィンドウ(アクティブに圧縮)、新しいツールへのゼロショット汎化、マルチエージェント委譲を特徴とします。価格は入力トークン100万あたり1.25ドル、出力トークン100万あたり4.25ドルで、プレビューは米国限定です。ツール使用ベンチマークでリードする一方、コーディングや視覚推論では競合に劣ります。

  • Muse Spark 1.1はツール使用およびツール強化推論で優れており、Metaの報告ベンチマークでトップ。
  • 100万トークンのコンテキストウィンドウをアクティブに圧縮し、マルチエージェント委譲をサポート。
サイト内本文

Palo Alto CEOアローラ氏、AI価格は90%下落必要と指摘、トークンコスト高騰で

Palo Alto NetworksのCEO Nikesh Arora氏は、AIトークンコストが企業導入を促進するために最大90%低下する必要があるとし、現在の高価格が障壁だと批判した。彼はPalantirのAlex Karp氏など他の経営幹部に加わり、より安価な代替手段を求めている。オープンウェイトモデルが注目を集める中。

  • Arora氏はAIトークンコストの2年間で90%削減を要求。
  • 同氏はOpenAIの54%効率向上では不十分と指摘。
サイト内本文

OpenAI、GPT-5.6(Sol、Terra、Luna)をリリース:3層モデルファミリーとResponses APIにおけるプログラム的ツール呼び出し

OpenAIは2026年7月9日、GPT-5.6ファミリーを一般公開し、3つの層(Sol、Terra、Luna)を提供開始。価格は1Mトークンあたり$1/$6から$5/$30。SolはArtificial Analysis Coding Agent Indexで80を記録し、Claude Fable 5を2.8ポイント上回り、トークン使用量も少ない。主な開発者向け機能はProgrammatic Tool Callingで、モデルが記述したJavaScriptを分離されたV8ランタイムで実行し、トークン使用量を38~63.5%削減する。しかし、SWE-Bench Proや知能指数、ツール使用ベンチマークではClaudeモデルに劣る面もある。

  • GPT-5.6は3つの層(Sol、Terra、Luna)を導入し、価格は1Mトークンあたり$1/$6から$5/$30。
  • SolはCoding Agent Indexで80を記録し、Claude Fable 5を2.8ポイント上回る。
サイト内本文

OpenAIのGPT-5.6とChatGPT Workは、価格、速度、生産性でAnthropicを上回ることを目指す

OpenAIは、GPT-5.6シリーズ(Sol、Terra、Luna)とChatGPT Workを発表し、AnthropicのFable 5とClaude Coworkに対抗。新モデルはベンチマークで優れた性能、低コスト、高速処理を示す。ChatGPT Workはエージェント機能をデスクトップタスクに拡張する。

  • GPT-5.6は3つのモデル(Sol、Terra、Luna)を提供し、各性能レベルに対応。
  • SolはAgent's Last Examで53.6点を獲得し、Claude Fable 5を13.1点上回る。
サイト内本文

AIは経済を牽引するが、多くのアメリカ人が取り残されている

サンフランシスコのリッチモンド・コミュニティセンターでは200人以上がフードパントリーの待機リストに名を連ねる。わずか数マイル先の「AIアレー」ではAI企業が数十億ドルの投資を集め、高給を従業員に支払い、住宅価格と家賃を高騰させている。全米ではAI関連投資がGDP成長率2.1%を支える一方、消費者信頼感は低迷し、低所得層の賃金上昇は最も鈍い。専門家はAIが「勝者と敗者の経済」を悪化させ、富をテクノロジー企業の創業者や初期投資家に集中させていると指摘する。

  • AI投資がGDP成長を牽引するが、格差を拡大。
  • サンフランシスコのフードパントリー需要が10%増加。
サイト内本文

GPT-5.6 Sol (max) ベンチマーク結果

OpenAI の最新推論モデル GPT-5.6 Sol (max) が Artificial Analysis インテリジェンス指標で 59 点を獲得し、同クラスのモデル平均を大きく上回りました。テキストと画像の入力、100万トークンのコンテキストウィンドウを備える一方、価格は高額(入力 $5/100万トークン、出力 $30/100万トークン)で、評価では7000万トークンを出力し、冗長性が高めです。

  • GPT-5.6 Sol (max) は Artificial Analysis インテリジェンス指標で 59 点を記録し、同価格帯の推論モデルの中央値 30 を大幅に上回る。
  • 価格は高額:入力 $5/100万トークン、出力 $30/100万トークン、評価総費用は $2824.18。
サイト内本文

OpenAIのGPT-5.6が利用可能に

OpenAIはGPT-5.6モデルファミリーをリリース。フラッグシップのSol、メインストリームのTerra、低価格のLunaの3種類を提供し、ベンチマークでAnthropicのFable 5と競合しつつ、コストを削減。コーディング、ナレッジワーク、セキュリティ面での改善も注目される。

  • OpenAIが3つのGPT-5.6モデル(Sol、Terra、Luna)を発表。
  • Solは複数のベンチマークでFable 5と同等以上、コストは半減。
サイト内本文

高収入のAI従業員がサンフランシスコの住宅価格を急騰させる

サンフランシスコは2026年5月に住宅価格の中央値が過去最高の176万ドルに達し、AI業界の富が不動産市場を押し上げている。

  • サンフランシスコは2026年3月に全米で最も高額な住宅購入都市となった。
  • OpenAIやAnthropicなどのAI企業の高給とストックオプションが価格高騰の主因。
サイト内本文

Grok 4.5 ベンチマーク結果

Grok 4.5 (high) は Artificial Analysis インテリジェンス指数で 54 のスコア、速度 86.7 トークン/秒、入力価格 $2.00/百万トークン、出力 $6.00/百万トークン。推論モデルで、テキストと画像入力に対応、コンテキストウィンドウ 500k。

  • Grok 4.5 はインテリジェンス指数で 54 のスコアを獲得し、平均 29 を大きく上回る。
  • 出力速度は 87 トークン/秒で、平均 73 より高速。
サイト内本文

SpaceXAI、Grok 4.5を発表 - Cursor買収後初のOpus級モデル

SpaceXAI(xAI)は、コーディングとエージェントに特化した最新モデルGrok 4.5を公開した。Opus級の性能を謳いつつ、より高速で低コストを実現。Cursorと協力してトレーニングされ、価格は入力100万トークンあたり2ドル、出力100万トークンあたり6ドル。コンテキストウィンドウは50万トークン(近日中に100万に拡大予定)。独立した評価では効率性が高く評価され、Artificial Analysis Intelligence Indexで4位にランクインした。

  • Grok 4.5はxAI初のコーディング&エージェント向けモデルで、Cursorと共同開発。
  • 競合(GPT-5.6、Opus 4.8)より大幅に低価格で出力速度も高速。
サイト内本文

Ollama:オープンモデルに全員乗車

Ollamaは、開発者がオープンモデルを簡単に実行できるプラットフォームで、Benchmark、Theory Ventures、8VCなどから8800万ドルを調達しました。890万人の開発者に利用され、フォーチュン500社の85%が採用。所有権、手頃な価格、プライバシーを重視しています。

  • Ollamaが8800万ドルを調達し、オープンモデルエコシステムを推進。
  • 890万人の開発者を擁し、所有権、手頃な価格、プライバシーを重視。
サイト内本文

スタートアップに注目:Sourcerer は AI 調達をサプライヤーに変える

Sourcerer は、調達ワークフローツールではなく、物理的製品の記録サプライヤーとなることを目指すスタートアップです。顧客が製品仕様や請求書をアップロードすると、AI エージェントがサプライヤーを審査し、価格設定、貨物手配、信用供与を行い、単一の見積もりを提供します。

  • Sourcerer は単なる調達ツールではなく、物理的製品の記録サプライヤーを目指す。
  • AI エージェントがサプライヤー審査、価格設定、貨物手配、信用供与を担当。
サイト内本文

「絶対にバカげている」:サンフランシスコの住宅、AIブームで希望価格より100万ドル以上高く売れる

不動産仲介会社コンパスの分析によると、2026年上半期にサンフランシスコで140戸以上の住宅が希望価格より少なくとも100万ドル高い価格で売却され、6月だけで44戸に上った。AIブームによる富裕層の増加と住宅不足が激しい競争を招いている。

  • サンフランシスコのAIブームで住宅の超過入札が記録的に
  • 2026年上半期に140戸以上が希望価格より100万ドル以上で売却
サイト内本文

中国のAIモデルがコスト高騰で米国企業に浸透

中国製のAIモデルが、米国の有力な競合との性能差を縮めつつ、大幅に低コストで利用できることから、米国企業の間で採用が進んでいる。DeepSeekやZ.aiなどの中国企業による最近のモデルリリースは、AnthropicやOpenAIなどの最先端システムと非常に競争力があると見なされている。これらの能力向上は、多くの米国AI研究所で最先端モデルのトークン価格が上昇し、企業がテクノロジー利用に関連する予想外の高コストに直面している時期に起きている。

  • 中国のAIモデルは、米国のトップクラスとの性能差を縮めている。
  • DeepSeekやZ.aiなどの中国企業は、低コストで競争力のあるモデルを提供。
サイト内本文

OpenAI、低遅延音声エージェント向けGPT-Realtime-2.1およびGPT-Realtime-2.1-miniをAPIで公開

OpenAIはAPIに2つのRealtimeモデルを追加しました。gpt-realtime-2.1とgpt-realtime-2.1-miniです。ミニモデルはリアルタイム音声向けの小型推論モデルで、従来のgpt-realtime-miniと同じ価格です。また、キャッシュの改善によりp95レイテンシを少なくとも25%削減しました。本稿では、変更点、価格比較、WebRTCを介した接続方法を説明します。

  • OpenAIがgpt-realtime-2.1とgpt-realtime-2.1-miniをリリース。
  • ミニモデルは推論機能を持ち、価格は従来と同じ。
サイト内本文

電力価格予測のための時系列基盤モデルの評価:汚染リスク、分布シフト、および共変量依存性

本研究は、電力価格予測における時系列基盤モデル(TSFM)を公平に評価するための二重データセットベンチマークフレームワークを提案する。TSFMは競争力があるが、共変量サポートに強く依存し、ドメイン固有手法を常に上回るわけではない。単純なアンサンブルは有望であり、補完的な情報を捉える。

  • 汚染リスクを軽減する二重データセットベンチマークを提案。
  • TSFMは非常に競争力があるが、共変量サポートに強く依存。
サイト内本文

半導体メーカー、ホワイトハウスにメモリー市場への広範な介入回避を要請

半導体業界団体SEMIはトランプ政権に対し、メモリー市場への広範な介入を避けるよう要請した。価格歪みを引き起こす懸念から、税制優遇や長期契約などの狭い対策を提案している。AI需要によるメモリー価格上昇が背景にある。

  • SEMIは主要半導体企業を代表し、メモリー市場への広範な介入回避をホワイトハウスに要請。
  • 同協会は税額控除と長期購入契約を代替案として提案。
サイト内本文

TokenScope: 大規模言語モデルのコードタスクにおけるトークンレベルの説明可能性と解釈可能性

TokenScopeは、コード生成中のLLMのトークンレベルでの意思決定を可視化するインタラクティブなツールであり、トークンメトリクス、アテンションパターン、反実分岐を提供する。

  • TokenScopeは、コード生成におけるトークンレベルのメトリクスとアテンション分析を提供。
  • インタラクティブなトークン置換と反実分岐をサポート。
サイト内本文

その他の成長タグ

モデル価格 AI News | AI News Hub