跳到主要内容
AI News HubLIVE
公开文章 32采集文章 38可信度 84刷新频率 120 分钟
健康状态 健康来源类型 官方原文权限 官方原文最近入库 2026-09-28ID llamaindex-blog运行状态 已启用

Official agent and retrieval infrastructure blog; confirm reuse terms before full body display.

最新公开文章

待翻译:Why VLMS Just Can

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Why forms need a purpose-built parser Representing a form’s structure Finding the boxes Attributing boxes to fields Parsing forms with LlamaParse Try it out A form is one of the most critical types of documents for a bu…

LlamaIndex Blog站内正文待翻译:Why VLMS Just Can

待翻译:Exploring Static Embedding Retrieval

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:What are static embeddings? Attempt #1: MaxSim over raw static tokens Attempt #2: teach the tokens some context It was working? Kinda? Attempt #3: a smarter teacher Attempt #4: skip the teacher, train on the actual metr…

LlamaIndex Blog站内正文待翻译:Exploring Static Embedding Retrieval

待翻译:Introducing ExtractBench: The Most Comprehensive Benchmark for Data Extraction from Enterprise Documents

AI 服务暂时不可用,以下为来源摘要,待恢复后补全翻译:Why we built ExtractBench What ExtractBench evaluates How the ground truth was built Results Reproduce it yourself Enterprise agents increasingly act on critical business data, and much of that data lives in unstructure…

LlamaIndex Blog站内正文待翻译:Introducing ExtractBench: The Most Comprehensive Benchmark for Data Extraction from Enterprise Documents

智能文档提取如何提升准确度与自动化水平

传统的OCR只能转录文本,而智能文档提取(Agentic Document Extraction)通过推理式的文档处理方式,结合视觉定位、自校验循环等技术,能够理解文档结构、提取准确信息并减少人工审核需求。本文详细介绍了智能文档工作流的原理、应对复杂布局(如表格、医疗表单)的方法,以及其在ROI和部署上的优势。

LlamaIndex Blog站内正文智能文档提取如何提升准确度与自动化水平

非结构化数据提取:将文档转化为洞察

本文探讨了非结构化数据提取的核心技术、工作流程和实际应用。通过NLP、NER和LLM等技术,企业可以从海量文档中自动提取结构化信息,应用于媒体监控、法律分析、医疗研究等领域。文章还介绍了LlamaParse的创新方法,包括多模态理解和多验证循环,以及2026年的趋势。

LlamaIndex Blog站内正文非结构化数据提取:将文档转化为洞察

OCR准确性解析:如何提升识别准确率

本文深入探讨OCR准确性的测量方法(字符错误率、词错误率、字段级准确性)、影响准确性的关键因素(图像分辨率、文档布局、手写变异性等)、实用改进工具包(预处理、合成数据训练、LLM后处理校正)、验证方法以及2026年OCR解决方案选择指南。强调准确性是一个管道问题,最大的收益来自识别前后的处理。

LlamaIndex Blog站内正文OCR准确性解析:如何提升识别准确率

AI文档分类:实用指南

AI文档分类通过自动化文档的排序和标记,解决了大规模文档处理的操作瓶颈。本文介绍了其工作原理、分类类型、高价值用例,以及如何选择和实施分类系统。

LlamaIndex Blog站内正文AI文档分类:实用指南

为何深度提取优于单次流水线

深度提取采用迭代、智能体驱动的验证循环,在复杂文档上实现近乎完美的字段准确性,而单次流水线在高容量、高风险的流程中会悄然失败。

LlamaIndex Blog站内正文为何深度提取优于单次流水线

模板OCR的真正替代方案:按内容读取文档而非坐标

模板OCR(区域OCR)将提取与页面坐标绑定,布局一旦变化就会静默产生错误。真正的替代方案是智能体OCR(如LlamaParse),通过布局感知计算机视觉识别文档结构,无需模板即可处理任意格式的第一份文档。这消除了模板库的维护成本、上线延迟和漂移问题,并提供置信度分数用于定向人工审核。文章以应付账款、汇款通知、物流单据等场景为例说明模板OCR的局限和智能体OCR的优势。

LlamaIndex Blog站内正文模板OCR的真正替代方案:按内容读取文档而非坐标

抵押贷款文件自动化:常见的工作流程缺口

抵押贷款文件自动化通常在阶段之间的交接处失败,而非阶段内部。没有数据来源证明,每个阶段都会重新验证数字,增加成本和结案时间。代理提取(如LlamaParse)提供页面级引用和置信度评分,实现有针对性的人工审查和可追溯的审计线索。

LlamaIndex Blog站内正文抵押贷款文件自动化:常见的工作流程缺口

解析、提取、分类——现在各自拥有自己的MCP | 每周通讯

LlamaIndex团队规模翻倍,推出多项更新:提取支持对话模式、快速层级输出Markdown、Agentic Plus改进表格处理、所有方案支持100用户。同时,AI新闻包括GPT-5.6性能分析、Bun用Rust重写Zig代码、苹果起诉OpenAI等。

LlamaIndex Blog站内正文解析、提取、分类——现在各自拥有自己的MCP | 每周通讯

解析、提取、分类 — 现在每个都有独立的 MCP | 每周通讯

LlamaIndex 发布了多项产品更新,包括 Retrieval Harness(为 AI 代理提供文件系统工具)、LiteParse 的 Markdown 支持、MCP 端点重构、成本优化器改进、企业级使用标签和用户元数据。社区方面,有 LiteParse 与 LanceDB 的结合实践、n8n 节点集成以及多场活动演讲。AI 新闻包括 Anthropic 延长 Fable 5 访问权限、OpenAI DevDay 2026 申请开放等。

LlamaIndex Blog站内正文解析、提取、分类 — 现在每个都有独立的 MCP | 每周通讯

LlamaParse检索工具包:面向AI代理的文件系统原语

LlamaIndex发布了LlamaParse索引的更新,新增检索工具包,为AI代理提供文件系统级文档遍历工具,以及视觉布局保留、托管基础设施和管道可观测性功能。

LlamaIndex Blog站内正文LlamaParse检索工具包:面向AI代理的文件系统原语

n8n的LlamaParse平台节点:利用AI解析、分类、提取和检索文档

LlamaParse平台社区节点已发布v5和v6版本,现为n8n官方验证的社区节点。该节点整合了五个LlamaCloud资源(解析、分类、拆分、提取、检索),支持作为AI Agent工具使用。v5重写了基础架构,v6将多个独立节点整合为一个,并增加了索引管理功能。文章还提供了三种工作流示例:将检索器作为Agent工具、构建分类-提取-验证流水线、以及评估不同解析模式的输出质量。

LlamaIndex Blog站内正文n8n的LlamaParse平台节点:利用AI解析、分类、提取和检索文档

LiteParse 新增 Markdown 输出功能

LiteParse 2.1 推出最快的开源无模型 PDF 转 Markdown 管道,在三大基准测试中均取得领先成绩,并支持多语言运行环境。

LlamaIndex Blog站内正文LiteParse 新增 Markdown 输出功能

为Claude智能体构建更快、更便宜的PDF解析技能:LiteParse案例研究

本文详细介绍了如何通过迭代评估、分析追踪和优化,为Claude智能体改进LiteParse文档解析技能,使其更便宜、更快且质量更高。项目发现并修复了反模式,如重复解析、不必要的OCR和低效的grep调用,最终使成本降低37%,并在所有评判指标上获得更高分数。

LlamaIndex Blog站内正文为Claude智能体构建更快、更便宜的PDF解析技能:LiteParse案例研究

LlamaIndex 新闻通讯 6-10-26

本期带来 ParseBench 在 CVPR 2026 的展示、Parse-Flow 视觉文档智能工作流、Anthropic Fable 5 基准测试结果、LlamaParse 新粒级边界框,以及 AI 首个匹克球锦标赛 The Agent Open。

LlamaIndex Blog站内正文LlamaIndex 新闻通讯 6-10-26

如何使PDF可搜索:方法与局限

本文探讨了PDF可搜索性的真正含义。快速OCR方法(如Adobe Acrobat、免费在线工具)适用于简单文档,但在表格、多栏布局和低质量扫描件上表现不佳。文本层即使有95%准确率仍会遗留错误,导致关键信息无法被检索。对于大规模文档处理或AI集成,需要像LlamaParse这样提供结构化输出(如Markdown)和高准确率的工具,以保留阅读顺序和表格结构。真正的可搜索性取决于准确性和结构,而非仅仅文本层的存在。

LlamaIndex Blog站内正文如何使PDF可搜索:方法与局限

提取合同元数据:方法、挑战与工作流程

组织在从复杂的法律合同中提取结构化元数据时面临重大挑战,因为语言、结构和格式的多样性。现代系统结合了布局感知解析、机器学习、语义提取和模式映射,将非结构化的法律协议转化为机器可读数据。LlamaParse 提供了一个集成的平台,将这些能力整合到生产工作流中。

LlamaIndex Blog站内正文提取合同元数据:方法、挑战与工作流程

Parse-Flow:开源可视化文档智能工作流设计器

Parse-Flow 是一个开源项目,通过可视化工作流设计器、异步工作器和实时事件仪表板,将文档处理的四个基本操作——解析、分类、拆分和提取——整合在一起。后端基于 llama-agents 工作流引擎,使用 Redis 和 Postgres 实现任务队列与事件持久化。本文详细介绍了系统架构、工作流定义、基于状态机的执行引擎以及设计优势。

LlamaIndex Blog站内正文Parse-Flow:开源可视化文档智能工作流设计器

grep vs. RAG:为AI智能体选择正确的搜索策略

本文对比了grep(词法搜索)与RAG(语义搜索)在AI智能体中的应用场景。grep在小规模纯文本语料库中快速精准,但无法处理PDF等非结构化文档,且扩展性差。RAG通过解析、分块、嵌入和向量索引实现规模化语义搜索,支持自然语言查询,但需要额外基础设施。作者建议采用分层方法:先用工具解析非结构化文档,再用语义搜索处理大规模语料,同时在适用场景保留grep。

LlamaIndex Blog站内正文grep vs. RAG:为AI智能体选择正确的搜索策略

LlamaIndex 新闻通讯 5-19-26

本期LlamaIndex新闻通讯介绍了ParseBench——首个为AI代理构建的OCR基准测试,以及新的开源工具:用于安全文档交互的Sandboxed-Lit CLI代理和用于私有部署的LiteParse-Server。此外,还回顾了新加坡和纽约的社区活动。

LlamaIndex Blog站内正文LlamaIndex 新闻通讯 5-19-26

如何使用LiteParse构建财务尽职调查代理

本文介绍了一个利用LiteParse构建的AI代理演示应用,该代理能够处理SEC文件、跨文件搜索并回答带有精确引用的问题。文章详细讲解了项目架构,包括PDF解析、文档存储、工具定义、聊天端点和引用系统,并说明了如何集成SEC EDGAR获取文件。整个项目约600行库代码,无需向量数据库或外部基础设施。

LlamaIndex Blog站内正文如何使用LiteParse构建财务尽职调查代理

抵押贷款文档自动化:重塑贷款处理流程

抵押贷款文档自动化利用智能文档处理技术,将文档密集型工作流转化为结构化、机器驱动的流程,从而提高效率、减少错误。本文分析了抵押贷款处理的复杂性、自动化工作流(文档摄取、分类、数据提取、验证、人工审核及系统集成)、面临的挑战,并介绍了使用LlamaParse实施自动化的最佳实践。

LlamaIndex Blog站内正文抵押贷款文档自动化:重塑贷款处理流程

KYC中的OCR:为什么标准文本提取不够用

本文探讨了标准OCR技术在KYC(了解你的客户)工作流程中的不足,包括对复杂证件、安全特征和多语言支持的局限性。介绍了代理型OCR(如LlamaParse)如何通过布局感知分割、模型编排和自纠错循环来提高准确率,并分析了银行业、保险业和加密货币交易所中的应用与合规需求。

LlamaIndex Blog站内正文KYC中的OCR:为什么标准文本提取不够用

LlamaIndex 新闻通讯:智能表格提取与 LiteSearch

本周的 LlamaIndex 新闻通讯重点介绍了智能表格提取、用于本地文档检索的 LiteSearch、改进的 Word 文档处理,以及与 Gemini Live API 的集成,同时提供了法律发现和社区项目的指南。

LlamaIndex Blog站内正文LlamaIndex 新闻通讯:智能表格提取与 LiteSearch

LlamaIndex 新闻简报 2026-04-14

本期简报介绍了 ParseBench——首个专为AI代理设计的OCR基准测试,以及LiteParse的快速增长、结构感知PDF QA管道、VLM驱动的OCR生产洞察、纽约金融科技研讨会和安全文档代理等重要更新。

LlamaIndex Blog站内正文LlamaIndex 新闻简报 2026-04-14

LlamaIndex 新闻通讯 2026-04-21

本期重点包括首个AI代理文档OCR基准测试ParseBench的发布、LiteParse正式加入LlamaIndex生态系统、Anthropic Opus 4.7的全面基准测试以及即将举行的纽约金融科技周AI活动。

LlamaIndex Blog站内正文LlamaIndex 新闻通讯 2026-04-21

LlamaParse MCP:为AI代理提供智能OCR工具

LlamaParse平台MCP已重构,从存储检索转向文档处理。本文介绍了MCP暴露的工具、连接方式以及设计决策,包括OAuth认证、文件上传解决方案(URL上传和令牌端点)、可观测性和速率限制等。

LlamaIndex Blog站内正文LlamaParse MCP:为AI代理提供智能OCR工具

liteparse-server 介绍:用于 AI 工作流的自托管文档解析与 OCR

liteparse-server 是一个自托管的 HTTP API,封装了 LiteParse 文档解析引擎,支持 PDF、Office 文档和图像,提供精确的空间布局文本提取和 OCR 功能。它解决了云端解析的延迟、成本和隐私问题,适用于 RAG、视觉模型等工作流。支持两种部署模式:轻量级服务器(无依赖)和完整堆栈(带 Redis 缓存、限流、OpenTelemetry 追踪、Prometheus 指标)。

LlamaIndex Blog站内正文liteparse-server 介绍:用于 AI 工作流的自托管文档解析与 OCR

全部来源