8月20日
06:21
06:21官方一手AWS Machine Learning Blog@Gayatri Ohri
亚马逊的Quick Automate配合AWS GAIIC IDP加速器,为银行、保险等行业处理高容量文档提供解决方案;基于AWS GAIIC技术的IDP加速器,能自动完成文档分类、提取和验证;美国某抵押贷款机构用它实现从邮件到验证数据的全程自动化。
推荐理由:亚马逊这方法,用Quick Automate加AWS GAIIC加速器,帮金融机构处理文档更高效,比以前手动做快很多。
7月29日
00:50
00:50向阳乔木@vista8
某AI Agent在尝试抓取飞书文档时检测到需要登录,自动切换到飞书Cli执行。它识别出文档长度约20万字,自动提取关键结构和精华内容。相比三年前的AutoGPT或BabyAGI项目,当前AI在任务拆解和执行路径上已有显著进步。

推荐理由:看看这个AI agent怎么自己切换工具、处理超长文档,还能自动提取精华,比三年前的AutoGPT强太多了。
7月25日
02:33
02:33LlamaIndex@llama_index
精选
LiteParse v2.8.0 移除了对 ImageMagick 的依赖,改用 Rust 原生处理图片到 PDF 的转换。根据图片格式不同,转换速度提升 1.2 倍到 7.2 倍。此更新使 LiteParse 更接近零外部系统依赖的目标。用户需升级到最新版本以获得改进。
事件专题

推荐理由:LlamaIndex 的 LiteParse 更新了,用 Rust 重写了图片转 PDF 核心,比原来快不少,还不用装 ImageMagick 了,升级后更省心。
7月22日
10:17
10:17Jerry Liu@jerryjliu0
LlamaIndex创始人Jerry Liu发布推文,团队在旧金山进行了一周线下冲刺,团队规模较上次聚会翻倍(2x)。期间锁定了AI智能体文档基础设施的路线图,并进行了团建活动(喷绘、Topgolf、足球、密室逃脱)。团队已为Q3做好准备。

推荐理由:LlamaIndex创始人发了团队近况,规模翻倍,规划了AI agent文档基础设施路线图。适合关注LlamaIndex和智能体开发的朋友看看。
7月5日
23:51
23:51官方账号Decoder@Jonathan Kemper
精选
百度发布了Unlimited OCR模型,一次性可处理数十页文档,而以往系统最多处理约10页。该模型通过改进注意力机制,使内存使用量不随页数增加而增长。Unlimited OCR目前在最重要的OCR基准测试中排名第一。

推荐理由:百度出了个Unlimited OCR,一次扫描几十页文档,内存不涨还拿了OCR基准第一,处理长文档效率提升明显。
7月1日
02:57
02:57LlamaIndex@llama_index
精选
LlamaIndex发布LlamaParse MCP更新,支持从合同、发票和报告中自动提取结构化数据。代理可直接搜索、阅读并检索PDF、Office文档和图片等知识库内容。工具按分类、提取和搜索等任务重新组织,可并行执行。这提升了大规模文档处理的可靠性和效率。

推荐理由:LlamaIndex更新了LlamaParse MCP,现在代理能自动从合同发票抽数据,还能直接搜公司文档,处理大批文件快多了。
6月24日
17:51
6月12日
6月5日
5月28日
09:48
09:48官方账号LangChain@LangChainAI
LangChain 团队展示了如何使用 Fleet 智能体自动化文档请求处理流程。Fleet 智能体监听 'docs-plz' 频道中的每条消息,自动进行分类,并直接打开 PR 实现文档请求。这一方案结合了 Fleet 智能体和沙箱环境,大幅减少了人工干预。用户也可以自行创建类似智能体,实现从生产力到工程任务的全面自动化。
推荐理由:LangChain 团队用 Fleet 智能体把文档请求的自动化闭环跑通了,做文档维护或工程自动化的团队可以直接参考这个模式,省去人工分类和 PR 提交流程。