跳到正文
今天9月30日周三
  1. LlamaIndex 官方博客(网页)64

    LlamaIndex 推出 Parse Gateway:支持按页面复杂度智能路由文档解析器

    LlamaIndex 推出 Parse Gateway Web 应用,基于 LiteParse 的 is_complex 功能实现页面级别的文档解析智能路由。系统会依据无文本、扫描件、乱码或多列复杂排版等信号及严重程度,将简单页面交给免费进程内运行的 LiteParse 处理,复杂页面则自动升级并路由至不同档位的 LlamaParse。

    推荐理由:通过在页面级评估文档复杂度并将不同页面路由至对应解析层级,在保障复杂页面提取质量的同时有效降低了整体延迟与处理成本。

  2. LlamaIndex 官方博客(网页)41

    智能 OCR:构建生产级文档理解系统

    智能 OCR 将传统字符识别与机器学习、版面感知、语义提取及视觉语言模型相结合,直接将企业文档转化为对齐 Schema 的结构化数据。相比传统 OCR 仅输出扁平文本,智能 OCR 能保留表格与键值对等层级关系,并支持字段级置信度评分与规则校验。这推动了文档处理向具备自主推理与验证能力的智能体文档工作流演进。

  3. LlamaIndex 官方博客(网页)48

    LlamaIndex 探索静态嵌入检索技术

    LlamaIndex 探索将 ColBERT 式 MaxSim 晚期交互引入静态嵌入模型,试图在保持极高检索速度的同时解决静态向量缺乏上下文的问题。基于 potion-retrieval-32M,团队引入约 530k 参数(2 MB)的轻量卷积混合器,在 NanoBEIR 基准上取得 0.5258 的平均 NDCG@10 分数,达到 MiniLM-L6 的 94% 表现且速度快约 100 倍。

  4. LlamaIndex 官方博客(网页)62

    LlamaIndex 推出文档抽取层 LlamaParse Turbo Beta 版

    LlamaIndex 在 LlamaParse 平台推出极低延迟的结构化抽取层 Turbo Beta 版,定价为每页 35 credits。Turbo 省去独立解析步骤并采用多页并行处理,在中长文档场景下单页耗时可降至约 0.5 秒,在 ExtractBench 评测中单页中位数耗时为 3.7 秒且 F1 分数为 0.84。

    推荐理由:原文展示了并行页面抽取在长文档场景下的低延迟表现与适用场景,有助于读者评估实时结构化提取方案。

  5. LlamaIndex 官方博客(网页)50

    LlamaIndex:如何从 PDF 提取表格并规模化构建结构化验证数据

    PDF 文件因仅存储字符坐标或图像而缺少行列元数据,导致基于空格切分和固定模板的传统提取方法在复杂布局下极易失效。无边框、多行换行、单元格留空及跨页合并等常见结构,要求解析系统必须具备空间布局推理能力而非单纯提取文本。LlamaIndex 探讨了如何通过 LlamaParse 重构表格行列关系并构建可验证的结构化数据。

  6. LlamaIndex 官方博客(网页)67

    LlamaIndex 提出即时智能体 OCR 模式:两阶段处理兼顾文档检索效率与精度

    LlamaIndex 提出了面向 10 至 100 份文档临时数据室场景的即时智能体 OCR(Just-in-Time Agentic OCR)模式,通过两阶段处理降低 VLM 全量解析的高昂成本与延迟。

    推荐理由:文章拆解了即时智能体 OCR 的两阶段处理机制,为百篇内临时文档集的低成本精准解析提供了清晰的落地参考。

  7. LlamaIndex 官方博客(网页)28

    智能文档处理(IDP)平台:多数厂商走入了哪些误区

    多数智能文档处理(IDP)平台在生产环境中常因文档多样性、模板依赖及非文本内容而失效,演示环境与实际生产的准确率差距往往达 10 到 20 个百分点。传统系统无法有效提取图表、架构图和图像中的关键信息,导致后续业务依赖大量人工复核。新一代智能体(Agentic)IDP 则通过 LLM 编排层,将文本、表格与图表分别动态路由至最适配的模型进行解析。

  8. LlamaIndex 官方博客(网页)66

    LlamaIndex 详解 AI 文档抽取难题:为何 Schema 才是导致流水线失效的关键

    LlamaIndex 发布文章指出,生产级 AI 文档抽取流水线的准确率瓶颈已从 OCR 与解析能力转向 Schema 定义层,未受审计的 Schema 会导致模型在必填字段上生造数据或错误合并重复项。

    推荐理由:文章拆解了文档抽取中 Schema 设计不当导致的隐性错误,提供了字段审计与 Agentic 架构的具体实践路径。

  9. LlamaIndex 官方博客(网页)66

    LlamaIndex 发布 LiteParse 2026 年 9 月更新:优化解析性能并新增视觉定位与复杂度路由

    LlamaIndex 宣布开源 PDF 解析工具 LiteParse 迎来重要更新,通过在其 PDFium 分支中引入 mimalloc 内存优化与热路径缓存,将文本提取耗时降低 20–25%,在无 OCR 情况下达到平均 2.8ms/页的提取速度和 3.9ms/页的 Markdown 渲染速度。

    推荐理由:文章详细拆解了通过改造底层 PDFium 内存分配提升无模型解析吞吐的工程细节,为文档预处理与路由分流提供了实测基准。

  10. LlamaIndex 官方博客(网页)31

    应付账款中的 OCR:优势、挑战与最佳实践

    现代应付账款自动化正从传统基于模板的 OCR 转向结合视觉语言模型(VLM)与机器学习的智能文档解析。LlamaParse 与 LlamaIndex 将 OCR 整合进统一的解析与索引工作流中,能够精准提取发票行项目及表格结构,完成数据校验后直接对接 ERP 系统。该方案可有效降低人工录入错误、大幅缩短处理周期,并提供可追溯的审计记录。

  11. LlamaIndex 官方博客(网页)36

    图像 OCR:主流 AI 图像转文本软件与技术选型

    现代图像 OCR 已从基础字符识别演进为涵盖版面保留与表格提取的文档智能,直接影响下游 LLM 与 RAG 工作流的质量。开源引擎如 Tesseract、PaddleOCR、EasyOCR 和 docTR 适合高可控与私有化部署需求,而 Google Cloud、Amazon Textract 与 Azure 等云端 API 则提供开箱即用的文档理解能力。

  12. LlamaIndex 官方博客(网页)31

    表格 OCR:如何从文档中提取结构化数据

    表格 OCR 通过结合布局感知与结构解析,将 PDF 或扫描件中的表格转换为 JSON、CSV 或 Excel 等结构化格式。生产级提取流程包含表格检测、结构识别和数据提取三阶段,能解决合并单元格、多行行项及无边框表格等难题。以 LlamaParse 为例,该方案可精准解析发票等文档的表格网格,并将数据映射至指定字段。

  13. LlamaIndex 官方博客(网页)31

    智能体文档处理:AI 智能体如何自动化复杂工作流

    智能体文档处理(ADP)利用 AI 智能体自主理解文档上下文与意图、解决异常并触发下游操作,实现端到端自动化。相比传统 IDP 依赖固定模板与人工审核,ADP 结合大语言模型与视觉模型分别解析文本、图表和版式结构。LlamaParse 采用该多智能体协同架构,无需针对格式变化重复训练即可高精度处理复杂文档。

  14. LlamaIndex 官方博客(网页)34

    非结构化数据提取:如何将文档转化为结构化洞察

    现代非结构化数据提取结合 NLP、命名实体识别(NER)与 LLM,将占企业 90% 的非结构化文档转化为下游可查询的结构化数据。该流程涵盖文档摄取、OCR 与分块预处理、提示词提取、自动化验证及输出集成等环节。这一技术栈让企业摆脱了脆弱的规则解析器,能以零样本方式从各类格式文档中提取精准信息。

  15. LlamaIndex 官方博客(网页)30

    AI 文档分类实用指南:自动化分拣与打标签全流程解析

    LlamaIndex 发布 AI 文档分类指南,阐述如何利用大语言模型实现文档的自动分拣、打标签与工作流路由。流程包含摄入预处理、特征提取、模型分类、打标签评分及下游分发 5 个阶段,支持借助 LlamaParse 解析排版并用 LLM 进行零样本分类。系统通过置信度评分实现高置信度任务自动流转、低置信度任务人工审核。

  16. LlamaIndex 官方博客(网页)16

    LlamaIndex 开放 LlamaParse 产品演示预约

    LlamaIndex 开放智能体文档处理平台 LlamaParse 的定制演示预约,支持文档 OCR、信息提取与索引自动化。平台提供页面级引用、置信度分数与边界框供人机协同审查,并设有成本优化器模式以平衡解析成本与精度。用户还可借助低代码构建器 LlamaAgents,用自然语言开发并部署端到端文档 AI 智能体。

  17. LlamaIndex 官方博客(网页)32

    LlamaCloud 开发者文档与 API 调用指南

    LlamaCloud 发布开发者文档与代码示例,支持通过 Python、JavaScript SDK 及 cURL 调用核心文档处理能力。开发者可利用智能体模式(agentic)进行 PDF 解析与基于 Schema 的结构化数据提取。平台还提供了基于自然语言规则的文档分类(classifier)以及将合并文件按类别逻辑拆分(split)的功能。

  18. LlamaIndex 官方博客(网页)16

    LlamaIndex 客户支持解决方案:提供即时准确的智能响应

    LlamaIndex 推出面向客户支持场景的解决方案,帮助企业基于 FAQ、知识库、政策合同和产品手册构建 AI 智能体,以实现即时解答并降低支持成本。该方案覆盖自动化问答、故障排除引导与内部坐席辅助,并通过专用的 LlamaParse 解析图表和复杂表格文档。平台提供 Python 与 TypeScript SDK 及 API 支持,同时具备引用追溯和置信度评分等企业级功能。

  19. LlamaIndex 官方博客(网页)27

    LlamaIndex 技术文档搜索:在复杂技术文档中检索答案

    LlamaIndex 面向工程与研发团队提供技术文档搜索方案,支持基于规范、SOP 和手册构建 AI 智能体,实现复杂文档的即时精准问答。该方案结合专为图表与表格设计的 LlamaParse 工具,支持规格版本比对、架构总结及公式提取,并提供 Python 与 TypeScript SDK 及 API。Salesforce Agentforce 等团队已采用该方案以提升企业 RAG 管道表现。

  20. LlamaIndex 官方博客(网页)28

    LlamaIndex 发票处理:实现人工审核自动化

    LlamaIndex 推出发票处理自动化解决方案,帮助财务和运营团队解析发票、提取数据并自动化工作流程。该方案基于 LlamaParse 解析复杂表格与文档,提供发票解析器、验证智能体、审批助手和审计追踪器四大功能模块。系统支持 Python 与 TypeScript SDK 及 API 接入,实现企业级端到端智能体自动化与合规审计。

  21. LlamaIndex 官方博客(网页)24

    LlamaIndex 财务尽职调查:加速合规审查

    LlamaIndex 针对投资与审计团队推出财务尽职调查解决方案,利用专用解析工具 LlamaParse 处理合同、财报等文件中包含图表与表格的复杂数据。该方案支持提取关键条款、汇总风险、跨实体对比合同差异并生成结构化尽调报告,同时提供 Python 与 TypeScript SDK、API 及 Agent 工作流以实现端到端自动化。

  22. LlamaIndex 官方博客(网页)22

    LlamaIndex 助力医疗与制药领域加速临床研究

    LlamaIndex 针对医疗与制药领域推出 AI 智能体方案,支持基于临床记录、化验报告及试验文献构建智能体以加速临床研究。该方案涵盖病史总结、自动提取 ICD/CPT 编码的医学编码、文献综合与患者出院支持四大场景。其依托 LlamaParse 解析复杂图表与表格,并提供 Python 和 TypeScript SDK 实现端到端自动化。

  23. LlamaIndex 官方博客(网页)22

    LlamaIndex 推出制造业解决方案:构建 AI 智能体以优化系统正常运行时间

    LlamaIndex 针对制造业场景推出 AI 智能体解决方案,支持基于技术规范、CAD、SOP 手册及合规文档构建智能体,以减少设备停机时间并优化质检流程。该方案包含 Spec Navigator、合规智能体、供应链分析及维修辅助等功能,依托专为复杂图表设计的 LlamaParse 提升 RAG 检索性能。

  24. LlamaIndex 官方博客(网页)26

    LlamaIndex 推出金融解决方案:赋能金融研究与合规自动化

    LlamaIndex 面向金融机构推出 AI 智能体解决方案,支持基于合同、监管备案文件与研究报告构建端到端自动化工作流。方案结合 LlamaParse 针对复杂图表和嵌套表格的解析能力,覆盖投资研究分析、KYC/AML 校验、合同条款提取及审计风控报告四大场景。系统提供置信度评分与引用溯源,支持通过 API 和仪表盘进行调用与监控。

  25. LlamaIndex 官方博客(网页)25

    LlamaIndex 助力保险行业实现理赔与核保自动化

    LlamaIndex 推出基于 AI 智能体的保险自动化解决方案,用于处理发票分类、表单录入与合规审查等繁重文档任务。该方案依托 LlamaParse 解析包含图表的复杂文档,涵盖理赔助手、合规跟踪、保单解答及欺诈监测四大功能,并提供 Python 与 TypeScript SDK 及 API。

  26. LlamaIndex 官方博客(网页)26

    金融分析师如何借助 LlamaIndex 构建 AI 金融模型

    LlamaIndex 推出面向金融分析的 AI 解决方案,利用 LlamaParse 高精度解析复杂财报 PDF、图表与嵌套表格,可减少 80% 的研究时间。系统支持自动提取营收、FCF 等关键指标,快速完成 10-K/10-Q 报告摘要、尽职调查与趋势分析,并构建专属 AI 智能体。平台还提供 Python 与 TypeScript SDK 及 API,支持可追溯引用与企业级并行处理。

  27. LlamaIndex 官方博客(网页)30

    LlamaIndex 行政运营方案:简化业务流程

    LlamaIndex 基于 LlamaParse 与 AI 智能体工作流推出行政运营方案,旨在消除发票匹配、表单录入与合同审查等手动流程,释放 80% 的时间。该方案提供发票评估、合同提取与表单处理等模块,并配备 Python 和 TypeScript SDK 与 API。系统支持解析复杂图表和表格,提供字段溯源与置信度评分,适用于高合规性企业 RAG 管道。

  28. LlamaIndex 官方博客(网页)20

    LlamaIndex 助力工程与研发加速产品开发

    LlamaIndex 针对工程与研发场景推出解决方案,通过加速技术文档理解将产品开发周期缩短 80%。该方案依托 LlamaParse 解析包含图表和嵌套表格的复杂多模态文档,支持构建研发助手、系统架构问答与技术规范对比等 AI 智能体工作流。平台提供 Python 和 TypeScript SDK 及 API,已被 Salesforce Agentforce 等团队用于落地企业级 RAG 应用。

  29. LlamaIndex 官方博客(网页)76

    LlamaIndex 开源本地文档解析工具 LiteParse

    LlamaIndex 团队开源本地文档解析工具 LiteParse,支持在无云端依赖且不消耗模型 token 的情况下快速解析 PDF、Office 文档及图像。该工具采用嵌入文本结构化结合传统 OCR 的混合方案,能够输出带有精确边界框坐标的结构化 JSON 数据。LiteParse 提供命令行工具与 Python 包,支持跨核心扩展与批量处理,便于直接接入 AI 智能体与向量数据库工作流。

    推荐理由:该工具无需调用大模型即可在本地快速解析多格式文档并保留边界框坐标,为构建低成本 RAG 与 Agent 工作流提供了轻量开源方案。

  30. LlamaIndex 官方博客(网页)20

    LlamaIndex Index 数据索引与检索功能介绍

    LlamaIndex 提供 Index 功能,通过智能切块与嵌入向量处理让数据支持高精度的大规模检索。平台目前已累计处理超过 1B 份文档,每月安装包下载量超 25M 次,LlamaParse 用户突破 300k。该功能支持多模态索引与数据增量同步,并可直接对接 AI 智能体实现下游工作流自动化。

  31. LlamaIndex 官方博客(网页)28

    LlamaIndex LlamaExtract:复杂文档结构化数据提取

    LlamaIndex 旗下文档提取工具 LlamaExtract 支持从复杂文档中提取结构化数据,并提供字段级置信度评分与来源引用追溯。该工具结合版面与上下文感知推理,支持用户自定义或自动检测 Schema,且具备多种解析模式以平衡成本与准确率。目前平台已处理超 10 亿份文档,LlamaParse 用户数超 30 万。

  32. LlamaIndex 官方博客(网页)26

    LlamaParse 文档解析工具介绍

    LlamaIndex 旗下的 LlamaParse 可将复杂排版、表格、图表、手写内容及图像等转化为干净的 Markdown 格式。它具备版面感知与多模态解析能力,开箱支持 100+ 种语言,并提供本地云部署与高并发等企业级支持。目前该工具累计处理文档超 1B+,月度包下载量超 25M+,用户规模达 300k+。

  33. LlamaIndex 官方博客(网页)29

    LlamaParse:兼顾成本与准确度的智能体文档处理

    LlamaParse 提供端到端 AI 文档理解方案,具备 Parse 复杂版面与图表解析、Extract 上下文数据提取(含置信度分数与引用)以及 Index 智能分块与嵌入检索能力。该工具专注于复杂表格与层级文档处理,已应用于 Salesforce Agentforce 等团队的企业级 RAG 和 AI 智能体开发,有效降低了数据管道的维护成本。

9月18日周五
  1. GitHub Blog · AI 与安全52

    GitHub 播客拆解 AI 编程争议:从代码审查、Skills 与 MCP 到 RAG 的实际定位

    GitHub 官方播客发文针对五个 AI 热门争议给出务实分析:开发者仍需审查 AI 代码直至能对其负责,面试核心在于展示人机协作的判断力;Skills 与 MCP 并非竞争替代而是互补组合,前者提供流程与上下文,后者提供标准化接口工具调用,同时 RAG 依然是补充外部信息的关键支柱。文章强调,难以被 AI 理解的代码往往本身存在可维护性问题,开发者应结合实际工程需求灵活选用工具而非盲目跟风争论。

9月16日周三
  1. Apple Machine Learning Research34

    Glyph:面向企业数据目录列描述与敏感本体标注的多策略智能体系统

    Glyph 是一个将企业数据目录列描述生成与敏感本体标注建模为协作 LLM 智能体的生产系统。系统利用 Descriptor 检索 GitHub 源码生成描述,并通过 Tagger 并行运行三项策略与 RRF 融合匹配 275 个叶节点的数据分类本体。其微调的 6 层 MiniLM 编码器将检索 NDCG@10 从 0.55 提升至 0.92(MAP@100 从 0.19 升至 0.90)。

9月14日周一