LlamaIndex 拿 Micron 财报演示文稿测了 LlamaParse,嵌套表格里两个业务单元行名相同,18 个数值照样各归各位,做文档解析的可以试试。
#文档解析
共 92 条 · 7 天 9 条 · 30 天 24 条
信息流里打上「文档解析」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
LlamaParse 试试解析嵌套表格:Micron 财报里 18 个数值一个不错
10月9日
OpenDocRouter推出文档OCR统一API
Jerry Liu推出的OpenDocRouter让你不用再折腾各种OCR模型,一个接口就能用上Opus 5.5等130多种模型,还自动处理限流和计费。
10月8日
LlamaIndex 推出 OpenDocRouter:文档解析统一 API,一次接入 10 个模型
LlamaIndex 出了个 OpenDocRouter,一个 API 接 10 个文档解析模型,换模型改一行代码,每千页最低 $0.86,处理 PDF 转 markdown 的可以试试。
10月6日
10月5日
10月4日
9月30日
9月26日
表格空单元格会让 agent 解析出错:LlamaParse 用美联储 dot plot 演示对齐
LlamaIndex 拿美联储 dot plot 当例子,演示表格空单元格怎么让 agent 读错数,LlamaParse 解析后 9 个数字全对上。做文档解析的可以试试。
9月22日
9月20日
LlamaIndex 发布面向 AI Agent 的文档解析评测基准「ParseBench」
LlamaIndex 这个团队做了个挺有意思的事,他们把 100 种文档解析方法都测了一遍,结果发现 LlamaParse 在图表处理上特别强,而且成本还低,0.38 美分一页就能拿到 80 多分,比很多大模型都划算。
9月18日
LlamaParse系列首篇:解析关键文档的挑战与LlamaParse的作用
朋友A推荐,说LlamaParse系列第一篇讲的是解析关键文档的挑战,比如美国能源报告里的数据,解析错误会影响后续的仪表盘或AI应用,挺实用的。
Jina AI 发布基于 DeepSeek-OCR 微调的文档解析模型「jina-ocr-v1」
Jina AI 推出了个新模型叫 jina-ocr-v1,用 DeepSeek-OCR 微调的,能解析文档转 Markdown,在 L4 GPU 上速度挺快,比很多同类模型都快。
9月15日
9月12日
9月11日
Astra 在解析带表格复杂文档时表现最佳,在 ParseBench 上达 93.2% 成绩
Jerry Liu 测试了 Astra,它解析带表格的复杂文档很厉害,在 ParseBench 上 93.2%,适合金融文档分析,但价格有点贵。
9月10日
9月6日
9月5日
9月4日
9月3日
9月1日
8月28日
8月19日
8月16日
8月15日
8月11日
8月9日
文档解析评测:Gemini 3 Flash最强,但前沿模型视觉能力原地踏步
Jerry Liu说别急着用前沿模型做文档OCR,LlamaParse在表格图表上准确率涨了15%,还能自己搭ParseBench跑评测。