DeepSeek 的 V4.1 Flash 跑分出来了,ARC-AGI-2 拿下 72.9%,比上一代高了 11.5 分,不过每任务成本贵了两倍多,看你怎么权衡。
#开源模型
Mistral 放出 1T 总参、49B 激活的 Le Chonk,Simon Willison 亲测能画出鹈鹕 SVG 了,10 月底开放权重。
欧洲 Mistral 放出 1 万亿参数的 Large 4,主打美国闭源模型不肯做的安全任务,但离 Claude 和 GPT-6 还有距离。
复旦、腾讯混元和浙大联合开源了 Prism,能生成 2K 分辨率且声音和画面同步对齐的视频,训练速度还快了 2.5 倍,做视频生成的可以去看看。
Mistral 放了个 1T 参数的大家伙,编码分数把 Reflection 的 Beam 甩开 17 个点,月底开源权重,可以等等看。
法国 Mistral 放出了 1T 参数的 Mistral Large 4,还是多模态的,直接冲着 OpenAI 和中国的开源模型来的,可以看看实际表现。
Mistral 放出 1T 参数的多模态模型,激活只有 49B,API 现在就能用,10 月底开源权重,欧洲目前最能打的一个。
Mistral 放出 1T 总参、激活只有 49B 的 Mistral Large 4,视觉定位据说比 GPT 和 Claude 还强,月底还有开源权重版可以自己部署。
HuggingFace CEO 发推暗示 Mistral 要出新模型了,链接已经挂上他家主页,蹲模型的可以盯着这个页面。
Mistral 这次真支棱起来了,1T 参数只激活 49B,用 4000 块芯片就训出能跟 GLM-5.3 掰手腕的模型,欧洲总算有能打的了。
Amazon AGI 新出了个循环扩散语言模型,平均分同时压过扩散和自回归两类基线,代码和权重都放出来了,可以自己跑跑看。
Mistral 拿出 1T 参数的 Le Chonk,激活只有 49B,跑分号称欧洲开源第一,还能在视觉定位上压过闭源模型,10 月底开源权重,可以关注。
Mistral放出Mistral Large 4,1T参数只激活49B,跑分被DeepSeek V4.1 Flash压了一头,10月就开源,可以先试试API。
Mistral 放出 1T 参数的 Le Chonk,激活才 49B,视觉定位还能打赢闭源模型,10 月底开源权重,开源党可以蹲一下。
Mistral 放出了 1 万亿参数的 ML4 预览版,号称欧美最强开源模型,API 已经能试,权重月底放出,关注开源模型的同学可以先去跑个分看看。
NVIDIA 调了电信行业的 AI 采用情况,去年 49% 在用 AI,今年涨到 66%,还提到开源模型很关键,做行业分析的可以看看数据。
NVIDIA 把开源模型改成懂电信网络的智能体,AT&T、SoftBank、Indosat 三家在用,Indosat 还适配了本地语言。
欧洲的 Mistral 出了个 1T 总参数但只激活 49B 的多模态模型,视觉理解敢跟闭源模型叫板,权重 10 月底开源,可以蹲一下。
Mistral 放出了 1T 总参、49B 激活的多模态模型预览版,说是欧美最强开源权重模型,月底连权重一起放出来,做开源部署的可以盯着。
Meta 把 Muse Agent 接上了真实硬件,ESP32 固件和 Raspberry Pi SDK 都开源了,拿现成元件就能自己搭一个实体设备玩。
美国 Reflection 放出了首个开源模型 Beam,500 多亿参数只激活 23B,想用更低算力打 DeepSeek 和 Qwen,写代码推理的可以看看。
蚂蚁的 Ling 3.1 Flash 智能分直接从 20 涨到 41,智能体能力能跟 GLM-5.3-Flash、DeepSeek V4.1 Flash 掰手腕,权重还快开源了。
法国 Mistral AI 直接放话新模型网安能力超过中国模型,欧洲厂商开始下场对标,看看它拿什么跟 DeepSeek 掰手腕。
Kandinsky 6.0 Video 开源了,能从文字或图片生成 5 秒带音频和对口型的视频,vLLM-Omni 第一天就能跑,感兴趣可以试试。
12GB 显卡也能跑 125B 的 Qwen3.8-Flash-Next 了,Strata 开源,RTX 5070 上 94 词元/秒,配置门槛和 GitHub 链接都在文里。
Nvidia 投资的 Reflection AI 出了个开源模型,专攻写代码和跑智能体任务,摆明了要和中国开源模型掰手腕。
一条简报看全今日要点:GPT-6快了50%,Reflection开源501B参数的Beam,Claude在印度可用本地推理,还有GitHub新基准。