本文にスキップ
AI News HubLIVE
公開記事 9収集記事 9信頼度 88更新頻度 120 分
稼働状態 正常ソース種別 公式全文利用権限 公式全文最終取り込み 2026-07-28ID kimi-blog状態 有効

Official Kimi/Moonshot blog listing; verify terms before displaying full body.

最新公開記事

PerceptionBench:マルチモーダル大規模言語モデルにおける原子的視覚知能の評価

PerceptionBench は、マルチモーダル大規模言語モデルの原子的視覚知能を分離して評価する新しいベンチマークです。42の既存ベンチマークにおけるモデルの失敗から導き出された10の原子的知覚カテゴリに基づき、3,000の検証済み質問で構成されています。最先端モデルでも正答率60%に達しておらず、知覚関連の幻覚が平均的に最も弱い能力です。このベンチマークは、視覚知覚がどこで破綻するかを明らかにし、忠実で一貫したマルチモーダルAIの進歩を促進することを目的としています。

Kimi Blogサイト内本文PerceptionBench:マルチモーダル大規模言語モデルにおける原子的視覚知能の評価

Kimi K3 テックブログ:オープンフロンティアインテリジェンス

Kimi は、2.8兆パラメータの最も強力なモデルKimi K3を発表。Kimi Delta Attention と Attention Residuals 上に構築され、ネイティブビジョン機能と100万トークンのコンテキストウィンドウを備える。世界初のオープンな3Tクラスモデルで、長期コーディング、知識作業、推論などのフロンティアインテリジェンス向けに設計。最も強力なプロプライエタリモデルには及ばないものの、評価では他のテストモデルを上回る。

Kimi Blogサイト内本文Kimi K3 テックブログ:オープンフロンティアインテリジェンス

Kimi K2: オープンエージェントインテリジェンス

Kimi K2は、Excelフォーミュラ、ドキュメント処理、AIエージェント展開、コード支援、ブラウザ拡張などのツールと、Kimi K2.6、Agent Swarmなどの研究成果を含むオープンエージェントインテリジェンスプラットフォームです。

Kimi Blogサイト内本文Kimi K2: オープンエージェントインテリジェンス

Kimi K2 シンキング

Kimi K2 はオープンソースの思考モデルで、Excel、文書、コード、ブラウザ拡張などのツールを統合し、エージェントスウォームと深層研究をサポートします。

Kimi Blogサイト内本文Kimi K2 シンキング

Kimi ベンダーベリファイア

Kimiは、オープンソースモデルの推論実装の正確性を検証するためのベンダーベリファイア(KVV)をオープンソース化しました。このプロジェクトには、デプロイメントの一般的な問題を検出するための6つの重要なベンチマークが含まれており、インフラプロバイダーが根本的な原因を修正することを促進します。

Kimi Blogサイト内本文Kimi ベンダーベリファイア

Kimi K2.5 テクノロジーブログ:ビジュアルエージェントインテリジェンス

Kimi K2.5は、コーディングとビジョンタスクにおいて最先端の性能を発揮するオープンソースのマルチモーダルモデルです。最大100のサブエージェントを調整して並列実行する自己指示型エージェント群を備え、タスク完了時間を最大4.5倍短縮します。また、複雑なドキュメント、スプレッドシート、プレゼンテーションを処理するオフィス生産性にも優れています。Kimi.com、アプリ、API、Kimi Codeを通じて利用可能で、オープンソースコミュニティにとってAGIへの重要な一歩となります。

Kimi Blogサイト内本文Kimi K2.5 テクノロジーブログ:ビジュアルエージェントインテリジェンス

WorldVQA:マルチモーダル大規模言語モデルにおける原子世界知識の測定

WorldVQAは、マルチモーダル大規模言語モデルの視覚的世界知識に関する事実的正確性を評価する新しいベンチマークです。3,500の高品質な画像-質問ペアから構成され、9カテゴリをカバーし、ヘッドとテールの知識分布に焦点を当てています。最先端モデルでも50%未満の精度にとどまり、過信と視覚知識のギャップが明らかになりました。

Kimi Blogサイト内本文WorldVQA:マルチモーダル大規模言語モデルにおける原子世界知識の測定

Kimi Agent Swarm: 100のサブエージェントによるスケール

KimiはAgent Swarmを発表。最大100のサブエージェントを並行動作させ、水平スケーリングを実現するマルチエージェントアーキテクチャです。システムはCEO、研究者、アナリストなどの役割を自己組織化し、タスクの分解、エージェント割り当て、結果の統合を自律的に行います。逐次実行と比較して最大4.5倍高速で、大規模調査、バッチ処理、多視点分析に優れています。トップティア向けにプレビュー提供中。

Kimi Blogサイト内本文Kimi Agent Swarm: 100のサブエージェントによるスケール

Kimi K2.6 テックブログ:オープンソースコーディングの進化

Kimi K2.6 は、最先端のコーディング、長期間の実行、エージェントスウォーム機能を備えた新しいオープンソースモデルです。本記事では、その機能、ベンチマーク、コミュニティからのフィードバックを詳しく紹介します。

Kimi Blogサイト内本文Kimi K2.6 テックブログ:オープンソースコーディングの進化

全ソース