本文にスキップ
AI News HubLIVE
公開記事 51収集記事 54信頼度 84更新頻度 120 分
稼働状態 正常ソース種別 公式全文利用権限 公式全文最終取り込み 2026-09-25ID fireworks-blog状態 有効

Official AI inference and model platform blog; confirm reuse terms before full body display.

最新公開記事

翻訳待ち:Every byte counts: ARCv3 and the case for cross-region RL

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Every byte counts: ARCv3 and the case for cross-region RL Join us for our inaugural conference, Forge 2026 Blog Arcv3 And The Case For Cross Region Rl Every byte counts: ARCv3 and the case for cross-region RL PUBLISHED…

Fireworks AI Blogサイト内本文翻訳待ち:Every byte counts: ARCv3 and the case for cross-region RL

翻訳待ち:Introducing Ember-1

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Introducing Ember-1 Join us for our inaugural conference, Forge 2026 Blog Ember 1 Introducing Ember-1 PUBLISHED 9/23/2026 Table of Contents Ember-1: half the tokens, same answers How Fireworks Research built Ember-1 The…

Fireworks AI Blogサイト内本文翻訳待ち:Introducing Ember-1

翻訳待ち:Introducing The Specialized Intelligence Index

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Join us for our inaugural conference, Forge 2026 Blog Introducing The Specialized Intelligence Index Introducing The Specialized Intelligence Index PUBLISHED 9/22/2026 Table of Contents The measure of real work Develope…

Fireworks AI Blogサイト内本文翻訳待ち:Introducing The Specialized Intelligence Index

翻訳待ち:The frontier isn’t a model. It’s a router.

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:The frontier isn’t a model. It’s a router. Join us for our inaugural conference, Forge 2026 Blog The Frontier Isnt A Model Its A Router The frontier isn’t a model. It’s a router. PUBLISHED 9/21/2026 Table of Contents Ho…

Fireworks AI Blogサイト内本文翻訳待ち:The frontier isn’t a model. It’s a router.

翻訳待ち:Phylo brings frontier AI to more scientists with open models on Fireworks

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Phylo brings frontier AI to more scientists with open models on Fireworks Join us for our inaugural conference, Forge 2026 Blog Phylo Brings Frontier AI To More Scientists With Open Models On Fireworks Phylo brings fron…

Fireworks AI Blogサイト内本文翻訳待ち:Phylo brings frontier AI to more scientists with open models on Fireworks

翻訳待ち:Making the leap to specialized intelligence

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Making the leap to specialized intelligence Join us for our inaugural conference, Forge 2026 Blog Making The Leap To Specialized Intelligence Making the leap to specialized intelligence PUBLISHED 9/10/2026 Table of Cont…

Fireworks AI Blogサイト内本文翻訳待ち:Making the leap to specialized intelligence

翻訳待ち:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Gen-1 Slides: Opus 5-level decks at a fraction of the cost Join us for our inaugural conference, Forge 2026 Blog Gen 1 Slides Opus 5 Level Decks At A Fraction Of The Cost Gen-1 Slides: Opus 5-level decks at a fraction o…

Fireworks AI Blogサイト内本文翻訳待ち:Gen-1 Slides: Opus 5-level decks at a fraction of the cost

翻訳待ち:Training API now generally available | Fireworks

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Training API now generally available | Fireworks Join us for our inaugural conference, Forge 2026 Blog Train Past The Frontier Training API Now Generally Available Train past the frontier: Training API now generally ava…

Fireworks AI Blogサイト内本文翻訳待ち:Training API now generally available | Fireworks

翻訳待ち:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 Training API now generally available Blog Deepseekv4pro Fable5 DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5 PUBLISHED 8/26…

Fireworks AI Blogサイト内本文翻訳待ち:DeepSeek V4 Pro: Tops SWE-Bench & Cuts Cost per Task by 3x vs. Fable 5

翻訳待ち:Post-training Kimi K3 with Harvey for long-horizon legal work

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Post-training Kimi K3 with Harvey for long-horizon legal work DeepSeek-V4-Pro-0813 available now on Fireworks Blog Post Training Kimi K3 With Harvey For Long Horizon Legal Work Post-training Kimi K3 with Harvey for long…

Fireworks AI Blogサイト内本文翻訳待ち:Post-training Kimi K3 with Harvey for long-horizon legal work

翻訳待ち:Fireworks AI

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Fireworks AI DeepSeek-V4-Pro-0813 available now on Fireworks Blog Deepseek V4 Pro Security DeepSeek V4 Pro is Redefining Security Agent Economics PUBLISHED 8/26/2026 TLDR; DeepSeek V4 Pro 0813 recorded zero refusals acr…

Fireworks AI Blogサイト内本文翻訳待ち:Fireworks AI

翻訳待ち:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:DeepSeek-V4-Pro-0813 available now on Fireworks Blog J Lens Kimi K3 Qwen Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B PUBLISHED 8/12/2026 Table of…

Fireworks AI Blogサイト内本文翻訳待ち:Can open models carry readable silent signals before they speak? Reproducing J-Lens Readouts on Kimi K3 & Qwen3.5-9B

翻訳待ち:Fireworks AI

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Fireworks AI Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Meta Muse Glimmer Muse Glimmer from Meta on Fireworks: Ideal for your Always-On Agents PUBLISHED 8/10/2026 Table of Contents Inside the Architect…

Fireworks AI Blogサイト内本文翻訳待ち:Fireworks AI

翻訳待ち:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Voyage AI Models Now On Fireworks Your AI performance stack is Fireworks + Voyage AI P…

Fireworks AI Blogサイト内本文翻訳待ち:Your AI Performance Stack is Fireworks Models with Voyage AI embeddings

翻訳待ち:Three Tests to Run Before You Switch from LoRA to FullFT

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:Three Tests to Run Before You Switch from LoRA to FullFT Kimi K3 on Fireworks: Frontier Intelligence You Can Own Blog Three Tests To Run Before You Switch From Lora To Fullft Three Tests to Run Before You Switch from Lo…

Fireworks AI Blogサイト内本文翻訳待ち:Three Tests to Run Before You Switch from LoRA to FullFT

Trilogy の Kimi K3 を活用したオープンウェイトサイバーセキュリティプレイブック

Trilogy AI Center of Excellence は、Fireworks 上の Kimi K3 をベースにしたサイバーセキュリティプレイブックを公開しました。このプレイブックは、防御型 AI におけるオープンウェイトモデルの利点を強調し、制限された高価なモデルに依存することなく、継続的な高負荷セキュリティワークフローを可能にします。具体的なリファレンススタックとして、決定論的ツールによる構造化と Kimi K3 による判断を分離し、パス中心の監査アプローチを採用しています。Fireworks はマネージド推論を提供し、チームは監査ワークフローの制御を維持しながら独立してスケーリングできます。

Fireworks AI Blogサイト内本文Trilogy の Kimi K3 を活用したオープンウェイトサイバーセキュリティプレイブック

Fireworks Nexus:予算制限のあるチーム向けのドロップイン型オープンフロンティアインテリジェンス

Fireworks AI は Fireworks Nexus を発表。エンジニアリングチームがワークフローを変更せずに、ルーティンタスクをコスト効率の良いオープンソースモデルにルーティングすることで AI コストを削減できる。初期テストでは、マージ PR あたりのコストが 3 分の 1 削減され、ブレンドトークンレートはクローズドモデルラボの約 4 分の 1 となっている。

Fireworks AI Blogサイト内本文Fireworks Nexus:予算制限のあるチーム向けのドロップイン型オープンフロンティアインテリジェンス

Fireworks AI、Kimi K3向けLoRAトレーニングを発表:最前線の知能を手軽に

Fireworks AIは、約2.8兆パラメータのMoEモデル「Kimi K3」向けにサーバーレスLoRAトレーニングを開始しました。LoRAアダプターは低コストで微調整が可能で、トークン単位の料金と柔軟な提供方法を特徴とします。2つのタスク例を通じて、小さなアダプターが数分で新しい目標やツール使用ループを学習する様子を示しています。報酬設計の重要性とデータフライホイール効果も強調されています。

Fireworks AI Blogサイト内本文Fireworks AI、Kimi K3向けLoRAトレーニングを発表:最前線の知能を手軽に

Fireworks 上の Kimi K3:手に入るフロンティアインテリジェンス

Kimi K3 は、2.8 兆パラメータを誇る初のオープンウェイトモデルで、Fable 5、Opus 5、GPT 5.5 などのクローズドモデルに匹敵する性能を発揮します。Fireworks では、米国ホスティングによる推論とトレーニングを提供し、データ保持ゼロ、GPU 管理不要で利用可能です。

Fireworks AI Blogサイト内本文Fireworks 上の Kimi K3:手に入るフロンティアインテリジェンス

2026年最高のオープンソースLLM:7モデルを徹底レビュー

2026年半ば時点で9つのオープンソースLLMをレビューし、ベンチマーク、コンテキストウィンドウ、マルチモーダル対応、ライセンスなどを比較。Kimi K3がトップだが、重みの公開は未定。Fireworksで利用可能な最高のオープンモデルはGLM 5.2。DeepSeek-V4-Pro、MiniMax M3、gpt-oss-120bなどが特定のユースケースで推奨される。

Fireworks AI Blogサイト内本文2026年最高のオープンソースLLM:7モデルを徹底レビュー

Heidi x Fireworks:最先端モデルの性能ギャップを埋める

Heidi HealthはFireworks AIと提携し、監視付き微調整(SFT)と強化学習微調整(RFT)を用いて、臨床ノートデータセットにおいてGemini Proなどの最先端モデルを凌駕する品質を達成しました。パートナーシップによりレイテンシを25秒から7秒に短縮し、3.5倍の性能向上を実現。成功の鍵は、高品質なデータフィルタリングと大規模バッチトレーニング(実効バッチサイズ150万トークン)にありました。

Fireworks AI Blogサイト内本文Heidi x Fireworks:最先端モデルの性能ギャップを埋める

Kimi K3 は Fable と競合し、Kimi K3 + Fable が SOTA に

Fireworks AI の新たな研究により、オープンソースモデル Kimi K3 がクローズドソースの Fable 5 と約 1,000 のエージェントタスクで競合し、ルーティングにより 93% の精度と最大 50 倍のコスト削減を達成。最高の AI は単一モデルではなくモデルの混合から生まれる。

Fireworks AI Blogサイト内本文Kimi K3 は Fable と競合し、Kimi K3 + Fable が SOTA に

NVIDIA BlackwellでのMiniMax M3スパースアテンションの最適化

Fireworks AIチームは、MiniMax M3スパースアテンション向けにBlackwell(SM100)カーネルを開発しました。KV固定実行パスを採用し、各KVブロックを1回だけロードすることで、約980 TFLOP/sのスループットと約4.1 TB/sのHBM帯域幅を達成し、クエリ固定ベースライン(FlashInfer)比1.9–2.4倍、オープンソースMSAカーネル比約1.6倍の高速化を実現しました。本記事では、アルゴリズム、カーネル設計、最適化、I/Oコストモデルについて詳述します。

Fireworks AI Blogサイト内本文NVIDIA BlackwellでのMiniMax M3スパースアテンションの最適化

Fireworksが15億ドルのシリーズD資金調達を完了

Fireworksは15.05億ドルのシリーズDラウンドを発表し、評価額は175億ドルに。年商10億ドル超、1日あたり40兆トークンを処理し、その95%以上が顧客専有データに特化したモデルからのもの。

Fireworks AI Blogサイト内本文Fireworksが15億ドルのシリーズD資金調達を完了

Gumloop、Fireworks AIでオープンウェイトモデルの使用量を3週間で7倍に拡大

GumloopはFireworks AIとの提携により、3週間でオープンウェイトモデルのエージェントチャットを7倍に増加させ、品質を維持しながら最大72%のコスト削減を実現しました。

Fireworks AI Blogサイト内本文Gumloop、Fireworks AIでオープンウェイトモデルの使用量を3週間で7倍に拡大

オープン、フロンティア、そしてあなたのもの:Fireworks 上で動作する NVIDIA Nemotron 3 Ultra 向け LangChain Deep Agents

LangChain は NVIDIA Nemotron 3 Ultra 向けに Deep Agents ハーネスをチューニングし、オープンモデルの中でベンチマークをリードするエージェント性能を実現、コストはクローズドな代替品の10分の1です。チューニングされたハーネスは LangChain Deep Agents に含まれ、Nemotron 3 Ultra は Fireworks 上で初日からサポートされます。

Fireworks AI Blogサイト内本文オープン、フロンティア、そしてあなたのもの:Fireworks 上で動作する NVIDIA Nemotron 3 Ultra 向け LangChain Deep Agents

GLM 5.2 Fast で1か月分のエンジニアリング作業を4日間でリリースした方法

著者は、FireConnect 経由で Claude Code 上で GLM 5.2 Fast を使用し、通常1か月相当の GPU スケジューラのリクレーム機能を、わずか4日間と218ドルの推論コストで実装しました。記事では、高速推論によるコンテキストスイッチの排除、低コストによるトークン使用の制限からの解放、複雑な並行処理ロジックを扱えるモデルの品質について詳述しています。

Fireworks AI Blogサイト内本文GLM 5.2 Fast で1か月分のエンジニアリング作業を4日間でリリースした方法

GLM 5.2 Fast が Fireworks で利用可能に

GLM 5.2 Fast が Fireworks でリリースされ、Opus レベルの知能をオープンソース価格で提供します。契約不要でトークン単位の課金です。1M トークンのコンテキストウィンドウ、積極的なプロンプトキャッシュ、構造化出力をサポートし、共有サーバーレスで標準パスの2〜3倍の速度を実現します。Fireworks は 446 tok/sec を達成し、MoE とスパースアテンションのアーキテクチャを最適化しました。

Fireworks AI Blogサイト内本文GLM 5.2 Fast が Fireworks で利用可能に

Factory が Fireworks でオープンモデルの使用量を6ヶ月で2~3倍に増やす方法

Factory はエージェントネイティブなソフトウェア開発を構築しており、その Droid エージェントはソフトウェア開発ライフサイクル全体をカバーします。Fireworks のオープンウェイトモデル推論プラットフォームを採用することで、Factory は6ヶ月でオープンモデルの使用量を2~3倍に増やし、タスクコストをフロンティアモデルの6%~20%に削減し、スループットを1ドルあたり5~15倍向上させました。これは、Fireworks の完全なモデルカバレッジ、デイゼロ利用可能性、高い信頼性、低レイテンシーによるものです。

Fireworks AI Blogサイト内本文Factory が Fireworks でオープンモデルの使用量を6ヶ月で2~3倍に増やす方法

Cursor Composer 2 + Fireworks AI

Cursorは、Cursor開発環境に最適化されたコードモデルComposer 2をリリースしました。Kimi 2.5をベースに、継続的プレトレーニングと大規模強化学習を組み合わせ、最先端のコーディング性能を実現しつつ、推論コストを6〜10倍削減します。Fireworks AIは分散型推論インフラを提供し、RLのスケーラビリティを可能にします。

Fireworks AI Blogサイト内本文Cursor Composer 2 + Fireworks AI

全ソース