本文にスキップ
AI News HubLIVE
公開記事 17収集記事 18信頼度 87更新頻度 720 分
稼働状態 正常ソース種別 研究全文利用権限 全文利用可最終取り込み 2026-09-29ID ahead-of-ai状態 有効

Public Substack newsletter; free posts allowed.

最新公開記事

翻訳待ち:Language Models for Text Classification: From Bag-of-Words to Jev

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:A Visual Guide to RNNs, CNNs, Transformers, and Calibration, with Hands-On Experiments on Accuracy and Efficiency

Ahead of AI (Sebastian Raschka)サイト内本文翻訳待ち:Language Models for Text Classification: From Bag-of-Words to Jev

翻訳待ち:GPT-6 Astra, Looped Transformers, and Hidden Reasoning

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:A Look at Recurrent Depth, Hidden Chains of Thought, and Recent Research on Looping Transformer Blocks

Ahead of AI (Sebastian Raschka)サイト内本文翻訳待ち:GPT-6 Astra, Looped Transformers, and Hidden Reasoning

翻訳待ち:How Claude Watermarks AI-Generated Text

AI サービスが一時的に利用できないため、復旧後に翻訳を補完します。ソース概要:A 48-minute video walkthrough of token sampling, watermark detection, and removal

Ahead of AI (Sebastian Raschka)サイト内本文翻訳待ち:How Claude Watermarks AI-Generated Text

ゼロから作るAIテキスト検出器

SubstackのAI検出機能に触発され、AIテキスト検出器をゼロから構築するエンドツーエンドのプロジェクトを解説。データセット構築、モデル訓練、ローカル展開に加え、検出器を検証器(verifier)として使い、RLVRで小言語モデルを訓練して検出を回避する方法も紹介します。AI検出器の仕組みと限界を学ぶ教育的事例です。

Ahead of AI (Sebastian Raschka)サイト内本文ゼロから作るAIテキスト検出器

LLMにおける推論努力の制御

本記事では、複数の推論努力モードを持つモデルの開発方法を探り、o1やDeepSeek-R1からGPT-5.6への進化、RLVRトレーニング、推論スケーリング、思考トークン、推論モード切り替えなどの主要技術を解説する。

Ahead of AI (Sebastian Raschka)サイト内本文LLMにおける推論努力の制御

ローカルコーディングエージェントの活用:オープンウェイトモデルとローカルツールの実践ガイド

本記事では、オープンソースツールとオープンウェイト大規模言語モデル(Qwen3.6など)を用いて、完全ローカルのコーディングエージェント環境を構築する方法を詳しく解説します。Claude CodeやCodexのような有料サービスの代替として、ローカル設定の利点、セットアップ手順、パフォーマンス評価、および複数のエージェントフレームワーク(Qwen-Code、Codex、Claude Codeなど)の選択についてカバーしています。

Ahead of AI (Sebastian Raschka)サイト内本文ローカルコーディングエージェントの活用:オープンウェイトモデルとローカルツールの実践ガイド

LLM研究論文:2026年リスト(1月~5月)

筆者は毎年の習慣に従い、2026年1月から5月までの注目すべきLLM研究論文を整理・分類。アーキテクチャ、トレーニング、推論効率、推論モデル、強化学習、エージェントシステムなど多岐にわたる方向性をカバーし、ハイブリッドアーキテクチャのトレンドやNemotron 3などの代表的な研究を紹介。

Ahead of AI (Sebastian Raschka)サイト内本文LLM研究論文:2026年リスト(1月~5月)

LLMアーキテクチャの最新動向:KV共有、mHC、圧縮注意機構

Gemma 4からDeepSeek V4まで、新しいオープンウェイトLLMがクロスレイヤーKV共有、レイヤー別埋め込み、注意予算、圧縮畳み込み注意、mHCなどを通じて長コンテキストコストを削減する方法を探る。

Ahead of AI (Sebastian Raschka)サイト内本文LLMアーキテクチャの最新動向:KV共有、mHC、圧縮注意機構

私のLLMアーキテクチャ理解のワークフロー

新しいオープンウェイトモデルのリリースを理解するための学習指向のワークフロー。公式のテクニカルレポートから始めるが、最近の論文は詳細が不足しているため、Hugging Faceの設定ファイルとリファレンス実装から情報を得る。

Ahead of AI (Sebastian Raschka)サイト内本文私のLLMアーキテクチャ理解のワークフロー

コーディングエージェントの構成要素

コーディングエージェントを効果的にする6つの主要コンポーネント(ライブリポジトリコンテキスト、プロンプトの形状とキャッシュ再利用、ツールアクセスと使用、コンテキスト肥大化の最小化、構造化セッションメモリ、サブエージェントへの委任)を概説し、これらのハーネス機能がどのようにLLMのコーディングタスクにおけるパフォーマンスを向上させるかを説明します。

Ahead of AI (Sebastian Raschka)サイト内本文コーディングエージェントの構成要素

オープンウェイトLLMの春:2026年1月~2月の10のアーキテクチャ

2026年1月から2月にかけてリリースされた10のオープンウェイト大規模言語モデルのアーキテクチャ比較分析。Arcee Trinity、Kimi K2.5、Step 3.5 Flash、Qwen3-Coder-Next、GLM-5、MiniMax M2.5、Nanbeige 4.1、Qwen3.5、Ling 2.5、Tiny Aya、そしてSarvamのアップデートをカバー。ハイブリッドアテンション、マルチトークン予測、Mixture-of-Expertsなどの技術トレンドに焦点を当てる。

Ahead of AI (Sebastian Raschka)サイト内本文オープンウェイトLLMの春:2026年1月~2月の10のアーキテクチャ

LLM推論能力向上のための推論時スケーリングの分類

推論時スケーリングは、デプロイされたLLMの回答品質を向上させる最も効果的な方法の1つです。本記事では、チェーン・オブ・ソート、自己一貫性、ベスト・オブ・Nランキング、検証器付きリジェクションサンプリング、自己改良、解経路探索など、様々な推論時スケーリング手法を明確に分類し、最近の論文を概説します。著者は、関連する書籍の章を執筆する際に行った個人的な実験も共有しています。

Ahead of AI (Sebastian Raschka)サイト内本文LLM推論能力向上のための推論時スケーリングの分類

2025年のLLMの現状:進歩、問題、予測

2025年の大規模言語モデル(LLM)の重要な進展を包括的にレビュー。DeepSeek R1によるRLVR/GRPOを用いた推論の進化、推論時スケーリングとツール使用の台頭、ベンチマークの過剰最適化(benchmaxxing)問題、そして2026年への予測(拡散モデルやRLVRの拡大など)を扱います。

Ahead of AI (Sebastian Raschka)サイト内本文2025年のLLMの現状:進歩、問題、予測

LLM研究論文:2025年版リスト(7月~12月)

著者が2025年7月から12月までの興味深い研究論文を厳選し、推論モデル、強化学習、アーキテクチャなどのカテゴリに分類して支援者に感謝の意を込めて共有します。

Ahead of AI (Sebastian Raschka)サイト内本文LLM研究論文:2025年版リスト(7月~12月)

DeepSeek V3からV3.2へ:アーキテクチャ、スパースアテンション、強化学習の更新

本稿では、DeepSeek V3.2の技術的進化について、アーキテクチャの変更(スパースアテンション機構DSAを含む)、強化学習の更新(GRPOの改良、自己検証と自己洗練)、およびハイブリッド推論モデルの開発を詳しく解説します。V3.2はGPT-5やGemini 3.0 Proに匹敵する性能を持ち、オープンウェイトモデルとして公開された重要なリリースです。

Ahead of AI (Sebastian Raschka)サイト内本文DeepSeek V3からV3.2へ:アーキテクチャ、スパースアテンション、強化学習の更新

標準LLMを超えて

本稿では、従来の自己回帰型デコーダーTransformerに代わる大規模言語モデルの代替アーキテクチャを探ります。線形注意ハイブリッド、テキスト拡散モデル、コードワールドモデル、小型再帰Transformerを紹介し、効率性、推論能力、モデリング性能における利点と限界を分析します。

Ahead of AI (Sebastian Raschka)サイト内本文標準LLMを超えて

LLM評価の4つの主要アプローチ(スクラッチから):多肢選択、検証器、リーダーボード、LLMジャッジ

この記事では、大規模言語モデルを評価する4つの主要な方法を説明します:多肢選択ベンチマーク(MMLUなど)、自由形式の回答のための検証器、ユーザーの好みに基づくリーダーボード(Chatbot Arenaなど)、およびLLMをジャッジとして使う評価です。スクラッチからのコード実装を含み、各方法のトレードオフについて議論します。

Ahead of AI (Sebastian Raschka)サイト内本文LLM評価の4つの主要アプローチ(スクラッチから):多肢選択、検証器、リーダーボード、LLMジャッジ

全ソース