7月23日
14:21
14:21官方账号vLLM@vllm_project
精选
Macaron 团队发布了 Macaron-V1-Venti,一个基于 vLLM 的多 LoRA 路由系统。其开源组件 MoL Harness 可将多个 LoRA 专家模型统一在 OpenAI 兼容端点后,并自动路由请求。该系统利用了 vLLM 原生的 Multi-LoRA 服务。从发布首日即支持 vLLM。
事件专题

推荐理由:Macaron 搞了个好东西:把多个 LoRA 模型挂在一个接口后,自动路由,基于 vLLM 直接上线。
13:36
09:19
09:19AI产品黄叔@PMbackttfuture
AI资讯站AIHOT月活突破60万。该站每日5分钟级抓取数百信源,经数据清洗、结构化、预筛、精选、聚类等流程,其中大模型介入10多个节点。作者自造聚类算法,经过大量数据回测达到准确性要求。网站承诺永久免费。
推荐理由:卡兹克做的AIHOT资讯站月活60万了,后端技术流程超复杂,自建聚类算法,对人和Agent都好用,还永久免费。
08:03
07:16
07:16Yangyi@Yangyixxxx
AIHOT月活突破60万。后端流程包括数百信源5分钟级抓取、数据清洗、结构化、预筛、精选、聚类,大模型介入超过10处。聚类算法基于自研,经过多轮回测和数据标注。网站永久免费,网址aihot.virxact.com。
推荐理由:这个AI资讯站月活60万了,作者说自己对资讯品味有信心,背后技术很硬核,永久免费,值得一试。
05:39
05:15
05:15Browser Use@browser_use
browser-use发布了一个能构建网页游戏的AI智能体。该智能体支持Kimi 3或Fable 5模型,可创建2D和3D游戏,并支持在线多人模式。即日起/game-mode功能免费开放,前20名提供游戏链接和反馈的用户可获得50美元browser-use积分。
事件专题

推荐理由:browser-use整了个能直接搭网页游戏的智能体,支持Kimi 3和Fable 5,2D/3D/多人联机都能做,现在免费体验,前20人还送50刀积分。
02:47
02:47官方账号Microsoft Research@MSFTResearch
微软研究院推出 MagenticLite,一个强调用户控制的人工智能代理。该代理会展示其推理过程,用户可以随时接管控制。关键操作会暂停等待用户批准,确保安全。用户还可以检查代理背后的模型。
推荐理由:微软出了个新AI代理,你可以随时打断它、看它在想啥,关键操作还得你点头,比黑盒靠谱多了。
02:45
02:39
02:39elvis@omarsar0
Bolt.new发布了新的Skills功能,实现了技能自动匹配,开发者无需每次手动调用特定技能。代理能自动判断何时使用哪些技能,并且团队构建的技能对所有成员共享。一个提示即可自动触发所有匹配的技能,简化了多代理协作编程的流程。
推荐理由:Bolt.new这个新功能太实用了,自动匹配技能,不用每次都喊'用代码生成技能',团队技能还能共享,一个提示搞定所有。
02:33
02:33Philipp Schmid@_philschmid
精选76°
Google 已将 Gemini 3.6 Flash 设为 Gemini Managed Agents 的默认模型,现有智能体无需代码修改即可自动切换到 3.6 Flash。用户仍可通过设置目标模型 ID 回退至 Gemini 3.5 Flash 或使用 Gemini 3.5 Flash-Lite。Google 在 AI Studio 中提供了 TICKR 金融多智能体交互应用来演示新模型的功能。
事件专题

推荐理由:Google 把 Gemini 3.6 Flash 设成托管智能体的默认模型了,不用改代码就能自动升级,还能随时切回旧版。想看看金融多智能体怎么玩?去 AI Studio 试试那个 TICKR 应用吧。
02:15
02:15HeyGen@HeyGen_Official
HeyGen 发布伴侣模式(companion mode),用户可通过该模式让AI代理提出5个视频角度,自动生成故事板并绘制草图。用户每步可审查和调整创意,只有在批准后才进入最终构建阶段。该功能通过 npx hyperframes @latest 命令启动,旨在将视频制作从“下单”变为“执导”。
推荐理由:HeyGen 的伴侣模式让你像导演一样指挥AI,而不是简单下订单。它帮你构思5个角度、画故事板,每一步都让你把关,确保视频符合你的想法。
01:23
01:18
01:18Firecrawl@firecrawl_dev
firecrawl 训练了一个新模型,用于从搜索结果中返回最匹配查询的片段。该模型在 SimpleQA 基准上达到 SOTA 成绩,同时相比处理完整页面可节省 10 倍的 token 消耗。该功能现已默认对所有免费用户开启。
推荐理由:firecrawl 出了新版搜索,返回最相关的片段给智能体,比整页处理省 10 倍 token,实测 SimpleQA 最强,还免费。
00:24
00:24官方一手歸藏(guizang.ai)@op7418
精选
Codepilot即将发布新版本,允许用户为每个SubAgent单独指定模型。例如,可用Grok检索Twitter内容,用DeepSeek生成文案,用Kimi K3生成网页。该功能让不同模型发挥各自特长,提升协作效率。
事件专题

推荐理由:以后一个任务里可以让Grok搜推、DeepSeek写稿、Kimi做页面,想怎么混搭都行。
7月22日
22:37
22:14
22:14Lovable@lovable_dev
Lovable 宣布其 AI 功能新增支持 Gemini 3.6 Flash 和三个 GPT-5.6 模型。用户可通过 Connectors → AI 查看并切换可用模型。新模型旨在提升生成的代码质量和响应速度。Lovable 是一个 AI 驱动的应用开发平台,允许开发者通过自然语言构建应用。
事件专题

推荐理由:Lovable 刚上线了 Gemini 3.6 Flash 和三个 GPT-5.6 模型,做应用开发时能直接选更快的模型了,快去 Connectors 试试。
22:09
22:09Viking@vikingmute
Vinext是一个针对Cloudflare Workers部署优化的框架,基于Vite实现Next.js兼容性。其核心重构据说由AI在一周内完成。目前兼容性测试整体通过率达到92.3%。该框架适合All in Cloudflare的开发者使用。
事件专题

推荐理由:Vinext让你能在Cloudflare Workers上跑Next.js,通过率92.3%,还据说用AI一周重构,挺靠谱的,推荐试试。
21:36
21:36官方账号OpenAI@OpenAI
精选76°
OpenAI发布了企业产品Presence,旨在帮助公司部署可信的语音和聊天代理,用于客户服务与内部工作流程。这些AI代理能回答问题、调用公司系统、执行经授权的操作,并在必要时升级至人工处理。代理会随时间持续改进。目前,Presence通过有限通用可用性计划面向合格企业客户开放。
事件专题

推荐理由:OpenAI出了新产品Presence,帮企业搭语音和聊天代理,能用公司系统、干活、还能找人帮忙,感觉比以前的智能客服靠谱多了。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。