#文档处理
亚马逊的教程教你如何用 Bedrock 和 Step Functions 构建一个无服务器的 PII 脱敏管道,能自动处理大量文档。
LlamaIndex 的 LiteParse 更新了,用 Rust 重写了图片转 PDF 核心,比原来快不少,还不用装 ImageMagick 了,升级后更省心。
LlamaIndex创始人发了团队近况,规模翻倍,规划了AI agent文档基础设施路线图。适合关注LlamaIndex和智能体开发的朋友看看。
LlamaIndex 在文档处理上发力,ParseBench 基准和 LlamaParse 实用,liteparse 免费且明星增长快。
LlamaIndex 给 LiteParse 加了 gRPC 接口,微服务之间调文档处理更快了,还能解析 PDF、Office 和图片,带截图和 OCR 预判,适合多语言系统。
手把手教你用 AWS 原生服务搭无服务器文档处理流水线,冷启动配置、批跑模式、Schema 扩展都讲透了,适合想省云成本的开发者。
LlamaIndex更新了LlamaParse MCP,现在代理能自动从合同发票抽数据,还能直接搜公司文档,处理大批文件快多了。
LandingAI 搞了两个 Agent Skills,装上后让 Claude Code 这类编程智能体直接对话里就能搭文档处理流水线,省掉你手写 API 脚本的功夫。
企业 AI 团队终于有了一个开箱即用的文档处理框架,做合同、发票、报告等非结构化数据提取的开发者可以直接上手,拖拽式设计降低了门槛,值得一试。
企业 AI 团队终于有了一个可视化的文档处理工具,能直接从 PDF 中提取结构化 JSON,做数据清洗和 RAG 管道的开发者可以直接用起来。
做 RAG 或文档处理的团队终于有了一个又快又准的开源选择——LiteParse 在速度和准确率上双杀现有方案,建议做 PDF 解析的开发者直接试。
LangChain 团队用 Fleet 智能体把文档请求的自动化闭环跑通了,做文档维护或工程自动化的团队可以直接参考这个模式,省去人工分类和 PR 提交流程。
企业文档处理团队终于有了可落地的多智能体方案——MADP 用 HITL 机制平衡自动化与准确率,做发票、合同等批量文档处理的团队可以直接参考其部署结果和碳排放数据。