6月25日
02:37
02:24
02:12
00:24
6月24日
19:12
12:40
12:40小互@imxiaohu
精选
百度发布新 OCR 模型 UnlimitedOCR,支持单次推理解析数百页文档,同时保持高吞吐速度。在 OmniDocBench v1.5 基准上,其准确率达到 93%,比原始 DeepSeek-OCR 基线提升 6 个百分点。模型已开源,可在 Hugging Face 和 GitHub 下载。
事件专题

推荐理由:百度新出的 UnlimitedOCR 能一次处理几百页,速度还很快,直接比 DeepSeek-OCR 高了 6 个点,真正好用。
10:56
07:34
06:03
06:03OpenRouter@OpenRouterAI
OpenRouter 宣布提供 GLM 5.2 模型的所有服务商入口,共列出 20 个提供商。其中一条服务线路的推理速度超过 125 tokens/秒。用户可在单一页面比较并选择不同服务商。这标志着 GLM 5.2 的部署生态进一步开放。
推荐理由:想用 GLM 5.2 但不清楚哪家快?OpenRouter 把 20 个提供商列在一起了,还能直接选超 125 TPS 的那条线。
6月23日
23:26
23:26官方一手歸藏(guizang.ai)@op7418
作者测试了 Seed 2.1 Pro,发现它在智能体和编程任务上的短板已被补上。该模型现在能更流畅地处理复杂代理场景。作者计划将 Seed 2.1 Pro 作为内容创作的主要模型。
事件专题

推荐理由:豆包刚更新的 Seed 2.1 Pro,智能体和编程短板都补上了,做内容创作更顺手,可以试一下。
20:25
20:18
19:56
19:56The Rundown AI@therundownai
日本AI实验室Sakana发布了编排模型,旨在提升多智能体协作效率。SpaceX将Colossus超级计算机租赁给Reflection AI用于训练。Google投资独立电影公司A24,联合开发AI电影制作工具。AI语音命令工具可实现打字时间减半。
事件专题

推荐理由:Sakana的编排模型能协调多个AI任务,SpaceX租算力给Reflection AI,Google投A24造电影工具,每个都新鲜
14:56
14:46
14:46向阳乔木@vista8
76°
百度发布Unlimited OCR,模拟人类抄书注意力模式,每生成一个token时参考完整图像和提示词,但输出侧仅回看前128个token。KV缓存固定为128长度,避免长文档推理时内存爆炸。在超长文档OCR任务上效果显著,已在GitHub和Hugging Face开源。
事件专题

推荐理由:百度开源了一个超聪明的OCR方案,用固定128 token缓存模拟人眼抄书,长文档不爆内存,快去试试!
14:45
14:19
14:19小互@imxiaohu
76°
Seedance 2.5能一次生成30秒短片,原生支持4K分辨率。它可输入最多50个全模台参考素材,并支持3D白模引导生成。同时字节跳动推出了AI版权商业化平台,允许用户使用官方授权IP进行创作并获取分成。
推荐理由:字节跳动新出的视频模型Seedance 2.5能一次生成30秒4K短片,还支持3D白模和50个素材输入,做视频效率很高。
14:15

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。