02:04lmarena.ai@lmarena_ai78°Alibaba_Qwen的Qwen3.8-27B模型在图像到WebDev领域排名首位,参数量27B,性能与2.8T参数的Kimi K3相当,价格为每M输入/输出令牌0.40/3美元,支持262K原生上下文,可扩展至1M令牌。同时,Qwen3.8-2.4T-A95B(Max级)的开放权重也已发布。AI模型Qwen3.8-27B智能体多模态1 个信源在谈事件专题推荐理由:Alibaba_Qwen发布了Qwen3.8-27B,性能卓越,价格亲民,是构建应用和智能体的理想选择。原文稍后读已读值得跟进有用关注 Qwen3.8-27B
15:49向阳乔木@vista8ADP 4.0 支持自然语言生成 Workflow、Multi-Agent、Claw 模式等构建模式,适用于简单 Agent 助手和复杂企业系统。Single Workflow 适用于确定流程,Standard 模式搭建 AI + 企业 RAG 知识库,Multi-Agent 模式实现主 Agent + 子Agent协作,Claw 模式基于 Agent Loop 机制。提供150+行业应用模板,支持动态 Agentic RAG 检索引擎和160+企业级 Skill、50+连接器。AI产品ADP 4.0智能体MCP/工具推荐理由:ADP 4.0 新增多种构建模式,让 Agent 助手搭建更灵活,支持150+行业应用模板,适合企业级应用。原文稍后读已读值得跟进有用关注 ADP 4.0
05:04andrew chen@andrewchenLazymaxxing提出智能体协同处理代码库中的冲突和重叠,实现8个标签同时进行新功能开发,自动处理合并、测试、Git冲突等,无需人工干预。技巧智能体多模态编程助手推荐理由:Lazymaxxing提出的新方法,让多智能体在代码库中自动处理冲突,提升开发效率,值得一试!原文稍后读已读值得跟进有用关注 智能体
00:19lmarena.ai@lmarena_ai72°@Alibaba_Qwen的Qwen3.8-27B在Code Arena WebDev类别中排名第九,参数量27B,超越Qwen3.7-Plus,支持262K原生上下文,可扩展至1M。Qwen3.8-2.4T-A95B(Max级)的开放权重也已发布。AI模型Qwen3.8-27B智能体多模态1 个信源在谈事件专题推荐理由:@Alibaba_Qwen发布了Qwen3.8-27B,参数量小但性能出色,适合构建轻量级应用和智能体,值得尝试!原文稍后读已读值得跟进有用关注 Qwen3.8-27B
10:13官方一手Pandaily@contact@pandaily.com (Pandaily)精选72°BOCOM International 分析称,Moonshot AI 的 Kimi K3 模型,拥有 2.8 万亿参数,原生多模态,1 万个令牌窗口,位于成本与能力帕累托前沿,仅次顶级封闭模型,同时大幅降低每项任务成本。AI模型Kimi K3开源模型多模态2 个信源在谈事件专题推荐理由:Kimi K3 模型,参数量高达 2.8 万亿,多模态,成本能力前沿,值得一看!原文稍后读已读值得跟进有用关注 Kimi K3
05:34elvis@omarsar0精选研究多智能体系统在代码审查中的应用,提出Adversarial Review方法,使用三个智能体进行审查,在LiveCodeBench上优于五智能体基线,在SWE-PRBench上实现最高F1值。论文智能体代码审查多模态推荐理由:这篇论文探讨了如何使用多智能体系统进行代码审查,提出了一种新的方法,值得一读。原文稍后读已读值得跟进有用关注 智能体
17:59官方一手歸藏(guizang.ai)@op7418Ox Alpha 模型、DeepSeek V4 Flash、Vision EXP 模型和 Claude Fable 5 模型进行对比,Claude Fable 5 在排版细节和色散处理上表现更佳;Ox Alpha 模型在多模态和代码能力上表现出色,可还原 3D 玻璃材质质感。AI模型Ox AlphaDeepSeek V4 FlashVision EXP10 个信源在谈事件专题推荐理由:看看 Claude Fable 5 在排版和色散处理上的优势,以及 Ox Alpha 模型的多模态和代码能力,和其它模型有何不同。原文稍后读已读值得跟进有用关注 Ox Alpha
17:13官方一手歸藏(guizang.ai)@op741872°展示 DeepSeek-V4-Flash-Vision-EXP 在相同提示词和参考图下的生成结果。AI模型DeepSeek-V4-Flash-Vision-EXP视频生成推理模型推荐理由:看看 DeepSeek-V4-Flash-Vision-EXP 的强大效果,与其它模型相比有何不同。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-EXP
14:10官方一手歸藏(guizang.ai)@op7418Ox Alpha 利用多模态和代码能力,通过 WebGL 技术成功还原网页,实现 3D 玻璃材质质感和透视效果,文字位置和排版细节与原图一致。AI模型Ox AlphaWebGL多模态9 个信源在谈事件专题推荐理由:Ox Alpha 用 WebGL 技术还原网页,效果逼真,细节处理到位,值得一试。原文稍后读已读值得跟进有用关注 Ox Alpha
14:58IT之家(博客/媒体)78°Ox Alpha AI模型上线限免,DeepSWE跑分达80%,优于Claude Fable 5的65%。模型支持多模态输入,与智谱架构高度吻合。AI模型Ox AlphaDeepSWEClaude Fable 56 个信源在谈事件专题推荐理由:Ox Alpha模型免费限免,DeepSWE跑分领先,多模态输入,与智谱架构相似,值得一试。原文稍后读已读值得跟进有用关注 Ox Alpha
05:03OpenRouter@OpenRouterAIThinkymachines发布Inkling Small模型,总参数276B,活跃参数12B,与家族其他成员共享推理控制和多模态输入功能。AI模型ThinkymachinesInkling Small推理模型推荐理由:想了解最新模型?Thinkymachines的Inkling Small模型值得一试,参数量适中,功能全面,与家族其他成员共享技术。原文稍后读已读值得跟进有用关注 Thinkymachines
03:38官方账号Decoder@Matthias BastianDeepseek推出V4-Flash-Vision-Exp,一个实验性多模态模型,为V4-Flash的文本能力添加图像理解。在公司自己的多模态智能体基准测试中,其性能接近Opus 4.8,有时甚至超越它。AI模型Deepseek多模态视觉模型推荐理由:Deepseek新推出的V4-Flash-Vision-Exp模型,将图像理解能力与文本处理结合,在多模态智能体基准测试中表现优异,与Opus 4.8不相上下,值得一试。原文稍后读已读值得跟进有用关注 Deepseek
00:03elvis@omarsar078°Ox Alpha模型确认,为前沿多模态智能体能力的新竞赛做好准备。具体细节尚未公开。AI模型Ox Alpha模型智能体多模态推荐理由:Ox Alpha模型确认,预示着多模态智能体能力竞赛的开始,值得关注。原文稍后读已读值得跟进有用关注 Ox Alpha模型
22:05elvis@omarsar0Ox Alpha(隐秘模型)免费一周,支持1M上下文、多模态、零数据保留,每日100T令牌容量,限时体验。AI模型Ox Alpha多模态零数据保留5 个信源在谈事件专题推荐理由:Ox Alpha免费一周,多模态、零数据保留,体验最新AI模型。原文稍后读已读值得跟进有用关注 Ox Alpha
19:58shao__meng@shao__meng78°DeepSeek发布新模型deepseek-v4-flash-vision-exp,在多模态能力上接近Claude Opus 4.8,DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力提升,值得一试!原文稍后读已读值得跟进有用关注 DeepSeek
19:53Geek@geekbbDeepSeek-V4-Flash-Vision-Exp模型上线,多模态能力提升,接近Opus-4.8水平。DeepSeek Harness 0.1.1支持新模型。AI模型DeepSeek-V4-Flash-Vision-Exp多模态模型发布推荐理由:DeepSeek新模型发布,多模态能力大幅提升,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
18:53官方一手歸藏(guizang.ai)@op741878°Deepseek发布新模型Deepseek V4 Flash Vision EXP,多模态能力逼近Opus 4.8,文本能力与Deepseek V4 Flash相同,价格一致。DeepSeek Harness 0.1.1支持新模型。AI模型Deepseek多模态模型发布推荐理由:Deepseek新模型V4 Flash Vision EXP发布,多模态能力大幅提升,值得一试!原文稍后读已读值得跟进有用关注 Deepseek
18:38爱范儿@莫崇宇78°DeepSeek 多模态模型更新,带来全新功能。鲸鱼模型开‘天眼’,提升多模态识别能力。AI模型DeepSeek多模态智能体推荐理由:DeepSeek 更新,多模态识别更强,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek
18:05orange.ai@oran_geOx大模型多模态,小参数,强后训练,Terra能力级别,flash速度,Cola等平台已上线,限时免费7天体验。beta模型,谨慎使用。AI模型Ox模型多模态免费试用推荐理由:Ox大模型多模态,速度快,Cola等平台已上线,限时免费7天,值得一试!原文稍后读已读值得跟进有用关注 Ox模型
18:03官方账号深度求索 DeepSeek@deepseek_ai精选DeepSeek发布多模态API,支持模型deepseek-v4-flash-vision-exp,图像可支持最多384个token,支持Chat Completions、Messages & Responses,混合文本和图像输入,图像可通过base64、外部URL或Files API提供。AI产品DeepSeek多模态API推荐理由:DeepSeek新推出多模态API,支持多种图像输入方式,功能强大,值得一试。原文稍后读已读值得跟进有用关注 DeepSeek
18:03官方账号深度求索 DeepSeek@deepseek_ai78°DeepSeek-V4-Flash-Vision-Exp模型在DeepSeek API平台上线,文本能力与DeepSeek-V4-Flash相当,多模态性能提升显著,接近Opus-4.8。DeepSeek Harness 0.1.1版本支持新模型。AI模型DeepSeek-V4-Flash-Vision-Exp多模态推理模型2 个信源在谈事件专题推荐理由:DeepSeek新模型上线,文本和推理能力提升,多模态性能接近Opus-4.8,值得一试!原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
17:28IT之家(博客/媒体)精选深度求索发布多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,支持多模态适配,API 计费按 token 计算,支持 Chat Completions、Messages、Responses 三种格式调用。Files API 已上线,不收费。AI模型DeepSeek-V4-Flash-Vision-Exp多模态API服务推荐理由:深度求索新模型上线,多模态能力提升,API 访问方便,适合各种 Agent 工具集成。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-Vision-Exp
16:09官方一手Pandaily@contact@pandaily.com (Pandaily)精选小红书发布自研大模型dots3-note,MoE模型,总参数280B,激活参数16B,512K上下文,支持文本、视觉和语音理解。以Apache 2.0协议在Hugging Face和GitHub上开源,华为Ascend零延迟适配,标志着月活跃用户超3亿的平台上,AI从功能转变为基础。AI模型小红书大模型MoE模型推荐理由:小红书开源自研大模型,支持多模态理解,与华为Ascend深度适配,为内容平台构建AI基础,值得关注。原文稍后读已读值得跟进有用关注 小红书
14:34爱范儿@张子豪DeepSeek模型支持多模态功能即将到来,爱范儿带你快速上手DeepSeek Harness,体验赛博乐高乐趣。技巧DeepSeek赛博乐高多模态推荐理由:想快速掌握DeepSeek Harness?爱范儿教你玩转赛博乐高,体验多模态模型魅力!原文稍后读已读值得跟进有用关注 DeepSeek
11:29orange.ai@oran_geCola 推出多模态模型 Ox,参数小,后训练能力强,达到 Terra 能力级别,速度媲美 flash。目前限时免费体验。beta 模型无技术支持,可能存在问题。AI模型ColaOx多模态推荐理由:Cola 推出的新模型 Ox,多模态且速度快,限时免费体验,值得一试!原文稍后读已读值得跟进有用关注 Cola
11:06官方账号arXiv cs.AI@Sahil Sharma本文探讨AGI时代后的经济模式,企业拥有AI和机器人代理,成为能源、计算、维护和升级的生产和消费者。结果显示,需求闭环、瓶颈移除和GDP与人类福利的完全脱钩。在最大增长时,利率等于增长率,任何正的人类消费率都会使人类份额以相同速率指数衰减。结论是,在AGI经济中,就业政策过时,所有权政策至关重要。论文AI安全多模态智能体推荐理由:这篇论文深入探讨了AGI时代经济模式的变化,揭示了人类份额在机器经济中的重要性,值得一读。原文稍后读已读值得跟进有用关注 AI安全
11:02IT之家(博客/媒体)72°谷歌端侧模型Gemma总下载量达10亿次,开发者发布超10万变体,应用于多个领域。Gemmaverse生态系统包括社区项目、教程等。AI模型Gemma开源模型智能体推荐理由:谷歌Gemma模型下载量突破10亿次,应用广泛,开发者社区活跃,值得了解。原文稍后读已读值得跟进有用关注 Gemma
10:17官方一手arXiv: Anthropic@Nikita Khudov研究团队发布OenoBench,一个包含3266道选择题的葡萄酒领域知识评测基准。该基准基于38104个原子事实构建,涵盖六个支柱和四个难度层级。评估16个前沿模型配置,发现整体准确率在53%-84%之间,o3以83.6%领先。DeepSeek R1在推理模式下提升6.8个百分点,而Claude Opus和Gemini Pro无提升。Anthropic在自身问题上偏好度+9pp,Google则-8pp。开源模型与专有推理模型共享成本-准确率帕累托前沿。所有配置在闭卷可解项目上平均提升33pp。论文OenoBencho3DeepSeek R110 个信源在谈事件专题推荐理由:研究人员搞了个叫OenoBench的葡萄酒知识测试题库,用这个题库测了16个大模型,发现o3考得最好,DeepSeek R1在推理题上表现突出,还发现模型对自己出的题有偏好,挺有意思的。原文稍后读已读值得跟进有用关注 OenoBench
09:36OpenRouter@OpenRouterAIOpenRouter 发布了 FLUX Video Upscale 工具。该工具提供两种模式:`precise` 模式可更快完成放大并保留更多身份特征。`creative` 模式则能修复并生成更多细节。AI产品FLUX Video UpscaleOpenRouter视频生成1 个信源在谈事件专题推荐理由:OpenRouter 刚刚发布了 FLUX Video Upscale,能放大视频,有 `precise` 和 `creative` 两种模式,一个快一个细节多。原文稍后读已读值得跟进有用关注 FLUX Video Upscale
06:43OpenRouter@OpenRouterAIOpenRouter发布新模型Ox Alpha。该模型支持1M token上下文窗口。Ox Alpha支持文本、图像和视频输入。该模型旨在高效编码和持续智能体工作。AI模型Ox AlphaOpenRouter多模态3 个信源在谈事件专题推荐理由:OpenRouter悄悄发布了Ox Alpha,支持1M token上下文和图像视频输入,适合编码和智能体工作,试试看反馈吧。原文稍后读已读值得跟进有用关注 Ox Alpha
06:02官方一手AWS Machine Learning Blog@Melanie LiAmazon Bedrock 现在在超过 25 个 AWS 区域提供 OpenAI GPT-5.6 模型(Sol、Terra 和 Luna)的跨区域推理功能。该功能通过 US 地理和全球推理配置文件来路由请求,以实现更高的吞吐量。用户可以通过 OpenAI 和 Converse API 调用这些模型。文档还介绍了如何配置 IAM、配额和监控。AI产品OpenAIGPT-5.6Amazon Bedrock10 个信源在谈事件专题推荐理由:AWS 在 Bedrock 上为 OpenAI GPT-5.6 模型增加了跨区域推理,能提升全球请求的吞吐量,适合需要低延迟和高可用性的开发者。原文稍后读已读值得跟进有用关注 OpenAI
05:03elvis@omarsar0精选一篇关于持续学习的新论文提出了一种名为“受保护 harness 演化”的方法。该方法将 harness 组件的更新提议与实际提交分离开来。通过使用持续优化器和持续评估器,该方法在文本推理、多模态感知和开放世界交互等任务上实现了超过10%的相对增益。论文还定义并量化了“harness 级别遗忘”这一现象。论文持续学习智能体harness推荐理由:这篇论文讲的是怎么让AI智能体在更新技能或记忆时,不会把之前学好的东西忘了。它把更新和评估分开,效果比原来好10%以上,对做智能体的人很有用。原文稍后读已读值得跟进有用关注 持续学习
03:43官方一手marktechpost@Michal SutterUPDF是一款轻量级PDF编辑工具,旨在解决AI难以直接编辑源文件的问题。该工具支持14种格式转换和38种语言的OCR功能。在2.5版本中,UPDF内置了十个AI智能体,以提升用户的工作效率。AI产品UPDFAdobeAI智能体推荐理由:UPDF 2.5 版本内置了10个AI智能体,能帮你直接编辑PDF,还能转换14种格式,比Adobe轻量多了。原文稍后读已读值得跟进有用关注 UPDF
03:06官方账号Meta AI@AIatMetaMeta 公开了 Muse Spark 1.1 和 1.2 模型在 Cat Mesh 上的生成样本。这些样本展示了模型在特定任务上的表现。链接指向 Meta AI 的研究页面,用户可查看具体生成内容。AI模型Muse SparkMeta生成样本推荐理由:Meta 公开了 Muse Spark 1.1 和 1.2 的生成样本,你可以直接看效果,不用自己跑了。原文稍后读已读值得跟进有用关注 Muse Spark
03:05官方账号Meta AI@AIatMetaMeta 发布了 Muse Spark 1.1 和 1.2 模型在 Plywood Whale 上的生成成果。这些成果展示了模型在特定任务上的表现。链接指向了包含这些生成成果的网页。该推文获得了 1896 次浏览和 8 个点赞。AI模型Muse SparkMeta生成成果推荐理由:Meta 公开了 Muse Spark 1.1 和 1.2 的生成成果,你可以直接看效果,比之前更具体了。原文稍后读已读值得跟进有用关注 Muse Spark
03:02官方账号Meta AI@AIatMeta精选Meta 预览 WildArtifactBench,一个内部评估框架。该框架通过人类和智能体偏好评委的胜率和 Elo 分数,而非严格的真实基准,评估智能体在复杂现实任务中的表现。它扩展了任务覆盖范围,涵盖实用的多模态工作流。Meta 将发布 WildArtifactBench 中的 10 项任务。AI模型WildArtifactBenchMeta智能体推荐理由:Meta 推出 WildArtifactBench 评估框架,用胜率和 Elo 分数评估智能体,覆盖多模态工作流,还开放了 10 项任务。原文稍后读已读值得跟进有用关注 WildArtifactBench
02:25官方账号Meta AI@AIatMeta精选Meta 内部部署多模态模型 Muse Spark。该模型与 Muse Image 协作进行智能体媒体生成,并为 Muse Image 和 Muse Video 生成详细字幕作为训练数据。Muse Spark 能将原始文本、图像和视频内容转化为下游应用可用的信号和洞察。Muse Spark 1.2 的评估和演示可在此查看:go.meta.me/multimodal。AI模型Muse SparkMeta多模态推荐理由:Meta 把自家的多模态模型 Muse Spark 用起来了,能生成字幕还能做内容分析,比之前版本更实用了。原文稍后读已读值得跟进有用关注 Muse Spark
02:20官方账号Pika Labs@pika_labsPika Labs 发布了新的 Pika Music 模型。该模型接受文本、歌词、语音参考和音乐参考四种输入模态。这些信号在一个共享的潜在扩散解码器中融合,生成完整的音乐曲目。它不是一系列独立的工作流程。AI产品Pika MusicPika Labs多模态推荐理由:Pika Labs 新出的 Pika Music 模型,能同时用文字、歌词、声音和音乐来生成一首歌,比分开处理更方便。原文稍后读已读值得跟进有用关注 Pika Music
01:37lmarena.ai@lmarena_aiAgent Arena 排行榜衡量模型在数百万个真实世界、长周期任务中的表现。模型可使用网络搜索、文件系统和终端工具完成复杂工作流。该榜单通过因果追踪方法,衡量模型相对于平均模型的结果表现。AI模型Agent Arenaarena.ai智能体推荐理由:看看 arena.ai 上新出的 Agent Arena 排行榜,它用真实任务测试模型,还能用工具,比普通测试更实用。原文稍后读已读值得跟进有用关注 Agent Arena
01:29官方一手@OpenAIDevs@OpenAIDevs78°ChatGPT Pro、Business 和 Enterprise 用户可在 Mac 上使用 Computer History 功能。该功能可让 ChatGPT 记住用户在应用和网站上的活动。Computer History 能为 ChatGPT 提供更丰富的上下文,帮助其理解工作模式并建议重复性任务的技能或计划。AI产品ChatGPTOpenAIComputer History10 个信源在谈事件专题推荐理由:OpenAI 给 ChatGPT Pro、Business 和 Enterprise 用户上了个新功能,能让它记住你之前在电脑上干了啥,下次聊天不用再重复解释背景了。原文稍后读已读值得跟进有用关注 ChatGPT