12:56官方账号arXiv cs.AI@Junjie Yin, Buxin She, Xinyu Feng, Fangxing, Li该论文提出一个面向电力系统AI教育的开源可执行框架,包含渐进式难度模块。框架从基础DNN模板(函数逼近、负荷曲线拟合)起步,提供5节点系统的CNN潮流代理模型,并拓展到DNN辅助优化、电池储能DRL控制及摆动方程的PINN。作者基于社区调查,92%受访者表示运行AI模型前至少遇到一个障碍,94%希望有电力专用的动手课程。模块以Jupyter Notebook形式发布,支持本地或Google Colab运行,并通过IEEE在线课程和PES网络研讨会交付。相关网络研讨会吸引超过590名直播观众,位居IEEE PES网络研讨会前十。论文IEEEJupyter Notebook电力系统推荐理由:电力行业想学AI但怕门槛高的,可以看看这个开源框架,从基础DNN到CNN潮流代理再到强化学习,都有Jupyter Notebook能直接跑。原文稍后读已读值得跟进有用关注 IEEE
12:33Hailuo AI@Hailuo_AI精选MiniMax H3 的开源权重已在社区中流传。有开发者在 RTX 5090 上本地运行该模型,生成 1280×720 分辨率、15 秒长的视频,耗时 10 分 40 秒。该配置使用了 Sol-Attn 与 SageAttention 优化,并设置 tau=0.8。生成的文字仍是乱码,但画面质量明显提升。AI模型MiniMaxH3RTX 5090视频生成6 个信源在谈事件专题推荐理由:想在本地玩视频生成?MiniMax H3 开源了,5090 跑 15 秒片段只要 10 分多钟,社区已经出优化方案了。原文稍后读已读值得跟进有用关注 MiniMaxH3
12:10官方一手arXiv: DeepSeek@Wen Zan, Jiaqi Zhang, Jianchao Tan, Hong Liu, Cunguang Wang, Xiang Li, Duyue Ma, Guanyu Wu, Yifan Lu, Fengcun Li, Yerui Sun, Peng Pei, Yuchen Xie, Xunliang CaiLongCat Sparse Attention(LSA)提出流式感知索引、跨层索引和分层索引三种策略,解决DeepSeek Sparse Attention的O(L^2)计算开销和内存访问不连续问题。LSA在69B-A3B到560B-A27B规模模型上,与全注意力性能持平。LSA支持原生训练最长100万token的上下文,并支撑LongCat-2.0(1.6T-A48B)的开发。团队开源了LongCat-Flash-Lite-Sparse(69B-A3B)。AI模型LongCatDeepSeek Sparse Attention稀疏注意力推荐理由:DeepSeek稀疏注意力有个瓶颈,LongCat这套新方案用流式感知和跨层索引把它治了,跑长文本不慢,还开源了个69B模型,可以试试。原文稍后读已读值得跟进有用关注 LongCat
11:49官方账号arXiv cs.LG@Iaroslav Chelombitko, Ekaterina Chelombitko, Mika Hämäläinen一项研究对18个开源大模型进行跨文化神话知识探测,覆盖8个架构家族。模型能准确识别宙斯、朱庇特、托尔,但在芬兰、斯拉夫、埃及或中国神话中表现明显下降。研究者使用线性探针、logit lens、激活修补等方法,发现残差流能清晰区分文化,但解码器将特定文化token坍缩为主导传统。失败发生在读出阶段而非表征阶段,且解码行为受提示语言门控。论文发布了逐实体分解框架、跨文化基准及18个模型的预测结果。论文开源模型多模态LLM推荐理由:这篇论文用18个模型告诉你:LLM其实知道芬兰神话,但输出时故意不说。想看AI文化偏见的根源,读这篇。原文稍后读已读值得跟进有用关注 开源模型
11:21官方账号阿里通义 Qwen@Alibaba_Qwen81°阿里巴巴的Qwen3.8 Max已在OpenRouter上线。该模型有2.4万亿参数、950亿激活参数,主打长程编程、研究和多模态智能体任务。开放权重预计下周发布,这是Qwen Max级模型第一次开源。AI模型Qwen3.8 MaxOpenRouter开源模型推荐理由:Qwen3.8 Max已上线OpenRouter,2.4万亿参数、950亿激活,下周还首次开源Max级权重,想试的可以蹲。原文稍后读已读值得跟进有用关注 Qwen3.8 Max
10:38官方一手Pandaily@contact@pandaily.com (Pandaily)82°华为开源openPangu-2.0-Pro,发布模型权重、推理代码和技术报告。该模型拥有5050亿参数,推理时稀疏激活1800亿参数,上下文窗口达到512K。华为称它是首个完全在昇腾NPU上训练的前沿模型,也是首个完全不依赖NVIDIA硬件的500B以上开源模型。余承东此前曾表示要让盘古成为世界第一。AI模型openPangu-2.0-Pro华为盘古10 个信源在谈事件专题推荐理由:华为把500B级大模型开源了,权重代码报告都给了,还是在昇腾上训的,不用N卡也能跑。原文稍后读已读值得跟进有用关注 openPangu-2.0-Pro
09:47OpenRouter@OpenRouterAI79°阿里旗舰模型 Qwen3.8 Max 已在 OpenRouter 上线。它拥有 2.4T 总参数,激活参数为 95B。Qwen3.8 Max 面向长时程编码、科研和多模态智能体任务优化。官方计划下周开放权重,这是 Qwen Max 级模型首次开源。AI模型Qwen3.8 MaxOpenRouter阿里巴巴推荐理由:阿里把 2.4T 参数的 Qwen3.8 Max 放 OpenRouter 了,下周开源,长时程编码和多模态智能体都能用,想体验可以直接去跑。原文稍后读已读值得跟进有用关注 Qwen3.8 Max
07:36lmarena.ai@lmarena_ai在LMSYS Text-to-Video Arena排行榜中,MiniMax-H3获得1455分,与Muse Video的1458分仅差3分,并列总榜第三。Hailuo-2.3以1260分排在第23位,Hailuo-02-pro以1228分排在第29位。MiniMax-H3比排名紧随其后的最佳开源模型高出283分,表现亮眼。AI模型MiniMax-H3Muse VideoHailuo6 个信源在谈事件专题推荐理由:MiniMax-H3这回冲到了视频生成基准第三,离Muse Video就差3分,还比其它开源模型高出一大截,值得看看。原文稍后读已读值得跟进有用关注 MiniMax-H3
04:29lmarena.ai@lmarena_ai76°AI 评测平台 LMSYS CEO Angelopoulos 在 20VC 播客中表示,中国开源模型 Kimi K3 已超越西方顶级闭源模型,打破了“外国实验室只是蒸馏美国技术”的说法。他警告,开源模型权重可能被植入后门,某个触发词可导致企业数据大规模外泄。他还判断,70% 的 neo-labs 只是研究项目,无法成为可持续业务。他强调,未来企业的护城河将来自专有数据和网络效应,而非可即时生成的软件。行业Kimi K3开源模型AI安全5 个信源在谈事件专题推荐理由:LMSYS CEO 在 20VC 直接开讲:Kimi K3 已经超越西方闭源模型,还警告开源权重可能藏后门。想听不绕弯的行业实话,可以看这个。原文稍后读已读值得跟进有用关注 Kimi K3
03:57Julien Chaumond@julien_cinterconnectsai 团队发布 Artifacts Hub,一个跟踪开放 AI 生态重要模型的 Web 界面。Artifacts Hub 汇总模型信息,让用户快速了解哪些模型值得关注。相关推文已获得 671 次浏览。AI产品Artifacts Hubinterconnectsai开源模型推荐理由:interconnectsai 做了个 Artifacts Hub,专门跟踪开放 AI 生态的重要模型,想了解开源模型动态可以上去看看。原文稍后读已读值得跟进有用关注 Artifacts Hub
02:38elvis@omarsar0Intology的自动化研究系统Locus对Qwen3基础模型进行后训练,在PostTrainBench上达到SOTA。其训练出的模型超越官方人类调优的Qwen3 1.7B Instruct版本。PostTrainBench用10个H100小时评估代理后训练能力,扩展版PostTrainBench+将预算提升至数千H100小时。在此预算下,Locus后训练的模型集体优于官方Qwen3 1.7B。此外,Locus在Kaggle所有活跃奖金竞赛运行16天后,平均排名第4。AI模型LocusQwen3PostTrainBench推荐理由:Locus这个自动化系统后训练的模型居然干过了人类调的Qwen3 1.7B,在PostTrainBench上拿了第一,还上了Kaggle奖金赛前排。原文稍后读已读值得跟进有用关注 Locus
01:43elvis@omarsar0阿里巴巴发布Qwen3.8-Max,主打编码与协作场景。开发者在Hermes Agent上实测后表示,开源前沿模型已经追上闭源模型。该模型被视为开源界在编码方向上的新标杆。AI模型Qwen3.8-MaxHermes Agent阿里巴巴推荐理由:阿里Qwen3.8-Max在Hermes Agent上表现很猛,编码和协作都强,开源都快追上闭源了,你可以试试。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
22:15官方账号Decoder@Maximilian SchreinerMiniMax发布H3视频模型权重,这是开源模型首次登顶AI视频排行榜。H3在视频生成领域超越此前领先的闭源模型,成绩排名第一。该模型权重现已开放下载,开发者可以自由使用和改进。这一结果标志着开源视频模型在基准评测中首次处于领先位置。AI模型MiniMaxH3视频生成推荐理由:MiniMax把H3权重开源了,直接冲到视频榜第一,开源党可以下载来玩了。原文稍后读已读值得跟进有用关注 MiniMax
21:27量子位@十三商汤预览了SenseNova U1.5 Lite。这款开源的图像生成模型支持4K分辨率直出。SenseNova U1.5 Lite是国产自研模型,面向高清生图场景。AI模型SenseNova商汤图像生成推荐理由:商汤出了个开源生图模型,能直接出4K图,还是国产的,玩高清生成的话可以围观一下。原文稍后读已读值得跟进有用关注 SenseNova
19:23Hailuo AI@Hailuo_AI71°MiniMax正式发布开源视频模型MiniMax-H3,权重已公开。模型已上线Hugging Face,社区可免费获取。官方确认MiniMax-H3在RTX 5090和RTX 6000 GPU上验证运行。此次发布强调从社区来、到社区去,让智能触达每个人。AI模型MiniMax-H3MiniMax视频生成7 个信源在谈事件专题推荐理由:MiniMax开源了视频模型H3,RTX 5090能跑,想本地生成视频的直接去下权重。原文稍后读已读值得跟进有用关注 MiniMax-H3
19:21官方账号Decoder@Jonathan Kemper74°阿里巴巴发布旗舰模型Qwen3.8-Max,总参数达2.4万亿。该模型可自主执行跨数天的复杂任务,包括复现研究论文和设计芯片。与常见闭源模型不同,Qwen3.8-Max采用开放权重,团队计划下周公布权重文件。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里那个2.4万亿参数的Qwen3.8-Max要开源了,能自己搞芯片设计,下周放权重,想玩长任务的盯紧点。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
18:13官方账号阿里通义 Qwen@Alibaba_Qwen72°Qwen 3.8 Max已上线Command Code Go,并宣布将开放权重。该模型为2.4T参数的MoE旗舰,输入价格每百万tokens 2美元,输出6美元。缓存价格每百万tokens 0.25美元,整体比3.7版本便宜20%。下周将发布Qwen3.8-Max和Qwen3.8-27B的开放权重。AI模型QwenCommand Code Go开源模型推荐理由:Qwen 3.8 Max上线了,价格比3.7便宜20%,下周还要开源权重,值得蹲一下。原文稍后读已读值得跟进有用关注 Qwen
16:39官方一手marktechpost@Asif Razzaq76°阿里Qwen团队将Qwen3.8-Max从预览转为正式可用,并公布了按token计费的价格。该模型为2.4万亿参数的MoE架构,支持文本、图像和视频输入,上下文窗口为100万token。官方尚未公布基准测试结果,开放权重预计下周发布。AI模型Qwen3.8-MaxAlibaba多模态推荐理由:Qwen3.8-Max正式上线,2.4T参数MoE,能看视频,上下文100万token,权重下周开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
16:14IT之家(博客/媒体)商汤科技开源轻量级统一多模态模型 SenseNova U1.5-Lite-Preview。该模型仅有 8B-MoT 参数规模,原生支持 4K 图像生成。在多项主流生成与编辑质量评测基准上,其表现显著超越前代 U1。官方称其图像生成与编辑效果可比肩商用闭源模型。此外,该模型在中英文文字生成、复杂版式组织以及视觉指令遵循方面均有提升。AI模型SenseNova商汤科技多模态推荐理由:商汤开源了新多模态模型,8B参数就能生成4K图,编辑效果还追上闭源大厂,想玩图像生成的可以试试。原文稍后读已读值得跟进有用关注 SenseNova
16:00官方一手pandaily@contact@pandaily.com (Pandaily)79°阿里巴巴发布Qwen3.8-Max正式版,参数量达2.4万亿。该模型支持1M上下文窗口,可执行长时间运行的智能体任务。官方称其编码与办公能力显著提升,跻身全球第一梯队。开源权重预计一周内公布,开发者可下载使用。AI模型Qwen3.8-MaxAlibaba智能体推荐理由:阿里发了Qwen3.8-Max,2.4T参数加1M上下文,做长任务Agent很强,而且下周就开源了,能直接玩。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
15:59官方一手pandaily@contact@pandaily.com (Pandaily)MiniMax 在 HuggingFace 上开源 H3-Base 权重,采用 33B 参数的稠密单流 Omni-Transformer 架构。该模型配备 16 倍空间和 4 倍时间压缩 VAE,本地运行只需两张 RTX 5090 显卡。其 API 定价仅为 Seedance 2.0 的三分之一。H3 在基准测试中直接对标 Seedance 2.0,展示了开源视频生成模型的竞争力。AI模型MiniMaxH3Seedance 2.0推荐理由:MiniMax 把 H3 开源了,33B 参数,两张 RTX 5090 就能本地跑,API 价格只有 Seedance 2.0 的三分之一,想玩视频生成的可以试试。原文稍后读已读值得跟进有用关注 MiniMax
14:39量子位@量子位的朋友们阿里巴巴正式发布新一代基座大模型Qwen3.8,官方称整体性能处于全球大模型第一梯队。该模型在编程与办公场景下推理更快更稳定。Qwen3.8-Max预计下周开源,同时还将开源Qwen3.8-27B。AI模型Qwen3.8阿里巴巴Qwen3.8-Max推荐理由:阿里发了Qwen3.8,性能进第一梯队,Max版下周开源,想试新模型的可以蹲一下。原文稍后读已读值得跟进有用关注 Qwen3.8
14:08shao__meng@shao__meng81°阿里发布 Qwen3.8-Max,参数规模 2.4T,主打自主编码和长时任务。官方称它能在无人干预下完成 10 天以上的开发流程,并跑过 500 多轮芯片设计优化。定价为输入 2 美元/百万 tokens,输出 6 美元/百万 tokens,缓存 0.25 美元/百万 tokens。下周 Qwen3.8-Max 和 Qwen3.8-27B 的权重将一同开源。AI模型Qwen3.8-MaxQwen3.8-27B开源模型1 个信源在谈事件专题推荐理由:阿里把 2.4T 参数的 Qwen3.8-Max 拿出来,下周连 27B 一起开源,缓存价只要 0.25 美元,可以蹲一手。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
13:43AI Will@FinanceYF5DeepSeek V4 Flash High 在前端代码竞技场拿到 1586 分,总榜第 7,开源模型第 3。消费产品类目第 4,参考设计、数据分析、游戏类目均第 6。相比 Flash High Preview 提升 154 分,比 V4 Pro Preview 高 121 分,Flash 版升级幅度明显。AI模型DeepSeekV4 Flash High前端代码竞技场推荐理由:DeepSeek V4 Flash High 前端代码拿 1586 分,总榜第 7,比 V4 Pro Preview 高 121 分,开源模型第 3。原文稍后读已读值得跟进有用关注 DeepSeek
13:33官方账号阿里通义 Qwen@Alibaba_Qwen78°阿里通义发布Qwen3.8-Max,参数规模2.4T,输入定价每百万tokens 2美元、输出6美元。官方称其可实现10天以上自主编码,从空文件夹到生产环境无需人工干预。该模型支持500+轮芯片设计优化与365天电商策略规划,视觉作为持续反馈参与规划与修正。Qwen3.8-27B也将开源,开放权重于下周放出。AI模型Qwen3.8-MaxQwen3.8-27BAlibaba1 个信源在谈事件专题推荐理由:阿里发了Qwen3.8-Max,2.4T参数,能自己写代码跑10天出成品,下周开放权重,27B版也一起开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
13:29官方账号Simon Willison@simonwMiniMax发布MiniMax-H3,权重已在Hugging Face公开下载。数小时内,Qwen 3.8 Max也宣布推出,两大模型相继亮相。相关发布推文观看量达1.1万次,引发社区关注。AI模型MiniMax-H3Qwen 3.8 MaxMiniMax7 个信源在谈事件专题推荐理由:MiniMax-H3刚上线,Qwen 3.8 Max也来了,两个新模型撞一起,想尝鲜的赶紧去Hugging Face看看。原文稍后读已读值得跟进有用关注 MiniMax-H3
12:36小互@imxiaohu72°Qwen3.8-Max 总参数量 2.4T、激活参数 95B,官方宣布下周开源,是 Qwen Max 系列首次开源。它在 oh-my-cli 项目中自主运行 16 天完成无人编程,并在电商多模态意图识别竞赛中提交 45 次,准确率从 0.60 提升到 0.853,击败 458 支队伍。在 365 天模拟电商经营中,模型实现 4.16 倍资金回报,净赚超 10 万元。它还花 125 小时写 7,600 行代码复现论文,并在 AIME24 上反超原论文 2.71 分。视觉与多模态方面,模型支持分析 100+ 小时长视频,并能通过 Hybrid Agent 编程与 GUI 操作复刻应用。AI模型Qwen3.8-Max开源模型智能体推荐理由:Qwen Max 首次开源,2.4T 参数下周见;它能自己跑 16 天干活,还拿过 4.16 倍回报。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:24官方一手歸藏(guizang.ai)@op741881°Qwen3.8-Max是阿里通义千问最新旗舰模型,参数规模达2.4T。输入每百万token定价2美元,输出6美元,缓存0.25美元。官方称其可自主完成10天以上的编码开发,并支持500多轮芯片设计优化和365天电商策略。开放权重的版本将于下周发布,同时Qwen3.8-27B也将开源。AI模型Qwen3.8-MaxAlibaba开源模型推荐理由:阿里发了Qwen3.8-Max,2.4T参数,能自己写代码跑10天,下周开源权重,还有便宜缓存,想试大模型可以看看。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
12:23官方一手歸藏(guizang.ai)@op7418精选MiniMax 官方宣布 H3 模型现已公开可用。模型权重已经上传至 Hugging Face 平台。开发者可以直接下载和部署。具体细节需要查看官方仓库。AI模型MiniMaxH3Hugging Face推荐理由:MiniMax把H3开源了,模型权重在Hugging Face上,想用的可以直接去下载看。原文稍后读已读值得跟进有用关注 MiniMax
12:08orange.ai@oran_ge71°MiniMax 将开源视频生成模型海螺 H3 的权重公开至 Hugging Face。据称该模型在生成效果上达到 Seedance 2.0 的约 80% 水准。作为开源视频生成模型,H3 目前处于 SOTA 级别,性能领先同类开源方案。AI模型MiniMax-H3Seedance视频生成7 个信源在谈事件专题推荐理由:MiniMax 把海螺 H3 开源了,效果据说有 Seedance 2.0 的八成,是目前开源视频模型里最强的,Hugging Face 上直接就能下载。原文稍后读已读值得跟进有用关注 MiniMax-H3
11:56IT之家(博客/媒体)72°自变量机器人发布并开源HOST框架,让机器人仅观察29秒人类视频即可学习新技能,成功率达62%,超过零样本基线45%。相比Pi-0.5加微调方案,HOST所需数据量减少50倍,学习速度提升500倍。HOST采用双专家MoT架构,将视觉预测与动作生成分离,并通过动态时间规整按任务进度对齐人类视频与机器人操作。研究论文和代码已全部开源。AI模型HOST自变量机器人机器人学习推荐理由:自变量开源了HOST框架,机器人看一段几十秒的人类视频就能学新技能,成功率62%,比微调方案省50倍数据。原文稍后读已读值得跟进有用关注 HOST
10:57IT之家(博客/媒体)MiniMax 于 8 月 3 日开源新一代通用视频模型 H3,支持文本、图像、视频、音频统一理解与生成。H3 可输出最高 2K 分辨率、15 秒时长、32kHz 立体声音频的视频,帧率为 24 FPS。其输入规格包含 H3-Base-FL2VA 首尾帧模式和 H3-Base-Ref2VA 全模态参考模式,后者最多支持 9 张图像与 3 段视频。H3 稳定支持中英阿法等 11 种语言,完整系统由 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三模块组成。AI模型MiniMaxH3视频生成推荐理由:MiniMax 把能处理多模态上下文的视频模型直接开源了,最长生成 15 秒 2K 带立体声的视频,比一般文生视频强在能看懂图片、音频和视频混合输入。原文稍后读已读值得跟进有用关注 MiniMax
10:35IT之家(博客/媒体)阿里巴巴今日发布千问 Qwen3.8-Max,参数规模达 2.4 万亿。官方称其在编程、真实办公、长程任务与多模态智能体方面实现提升。该模型能以极少人工介入端到端完成复杂开放目标。模型权重将于下周开源。AI模型Qwen3.8-Max阿里巴巴智能体推荐理由:千问新模型 Qwen3.8-Max 有 2.4 万亿参数,编程办公更强,端到端自主干活,下周还开源。原文稍后读已读值得跟进有用关注 Qwen3.8-Max
09:54官方一手pandaily@contact@pandaily.com (Pandaily)清华团队开源VeriLoop Coder-E1,基于Qwen3.6-27B模型。模型在SWE-bench Verified获得85.20分,SWE-bench Pro为62.38分,Terminal-Bench 2.0达76.40分,DeepSWE为33.63分。该模型采用窄领域PEFT和Self-Harness技术,实现仓库级代码修复的可验证递归自改进。AI模型VeriLoop Coder-E1Qwen3.6-27B开源模型推荐理由:清华开源了个能自己改代码的模型VeriLoop Coder-E1,SWE-bench拿85.2分,比很多大模型都强,想搞代码修复的可以试试。原文稍后读已读值得跟进有用关注 VeriLoop Coder-E1
09:48官方一手pandaily@contact@pandaily.com (Pandaily)71°DeepSeek-V4-Flash-0731正式发布并开源,参数量304B,性能评分82.7。该模型超越V4-Pro预览版,定价为0.14/0.28美元。在VulcanBench基准上位列第一,HuggingFace热度榜第二。官方称其表现媲美Claude Opus-4.8。AI模型DeepSeekV4-Flash开源模型10 个信源在谈事件专题推荐理由:DeepSeek把304B的V4-Flash开源了,性能打平Claude Opus-4.8,价格还便宜,快去试试。原文稍后读已读值得跟进有用关注 DeepSeek
01:39elvis@omarsar0AI研究者Omar Sar0推文称前沿开源模型已改变智能领域对话,该推文有1643次浏览。他表示这避免了AI发展的'绝对灾难',推文获10次点赞和6条回复。他提醒,随着AI进步,不应忘记集中化AI的危害,目前转发量为0。行业开源模型AI治理集中化推荐理由:这位研究者直接说开源模型救了AI,还提醒别让AI被巨头垄断,观点很冲但值得一看。原文稍后读已读值得跟进有用关注 开源模型
22:17官方账号Nathan Lambert: Interconnects@Florian Brand开放模型系列第23期介绍了Laguna S2.1、Inkling和Kimi K3。这三个模型展示了开源权重在帕累托前沿上的竞争力,兼顾性能与效率。文中指出,训练强模型的能力正在快速扩散到更多团队。AI模型Laguna S2.1InklingKimi K37 个信源在谈事件专题推荐理由:三个新开源模型:Laguna S2.1、Inkling和Kimi K3,这期合集讲清楚了它们好在哪。原文稍后读已读值得跟进有用关注 Laguna S2.1
15:44IT之家(博客/媒体)7月31日,DeepSeek 发布 DeepSeek-V4-Flash 正式版(DeepSeek-V4-Flash-0731)API,并开启公测。国家超算互联网同步上线该模型的 API 调用服务和模型文件。新版经过大量后训练,智能体与指令遵循能力大幅增强,官方称性能可媲美最强闭源模型。超算互联网 AI 社区已汇集 1700 余款开源大模型,并成为全国首个十万卡级超智融合算力资源池。AI模型DeepSeek-V4-FlashDeepSeek国家超算互联网10 个信源在谈事件专题推荐理由:想用 DeepSeek-V4-Flash 的话,超算互联网已经上线了,不用自己配环境,一键就能调 API,试试它的智能体能力。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
14:17IT之家(博客/媒体)OpenRouter最新周榜显示,前五名全部由中国企业研发,小米MiMo-V2.5以10.5万亿Tokens单周调用量登顶,环比增长12%。DeepSeek两款模型分列第二和第五,腾讯混元Hy3单周增幅超999%。Hugging Face统计中,中国开源模型累计下载量全球第一,千问系列领先优势超10亿次。据称80%美国AI初创公司融资路演会使用中国开源模型,每日平均衍生模型超200个。行业MiMo-V2.5DeepSeek腾讯混元推荐理由:央视这篇把OpenRouter榜单讲透了,前五全是国产,小米MiMo调用量两个月翻六倍,开源生态怎么赢的可以快速get。原文稍后读已读值得跟进有用关注 MiMo-V2.5
07:35IT之家(博客/媒体)81°美国众议院两个委员会主席联合调查DoorDash,要求其说明使用中国AI大模型的情况。DoorDash创始人Andy Fang称,内部测试中月之暗面Kimi K2.6搭配Anthropic Fable 5的组合,成本低于Sonnet 4.6加Opus 4.8且效果更好。目前DoorDash已通过模型路由服务将部分底层任务交给Kimi K2.6。议员认为开放权重模型虽有成本优势,但仍存在安全风险和国家安全担忧。行业DoorDashKimi K2.6月之暗面8 个信源在谈事件专题推荐理由:DoorDash用Kimi K2.6写代码被美国国会调查,中美AI竞争现在渗透到外卖平台了。原文稍后读已读值得跟进有用关注 DoorDash