全部动态
英伟达用 Blackwell GB300 跑 DeepSeek-v3,每 GPU 1648 TFLOPs,比上一代快 3 倍,技术优化真猛。
英伟达新Rubin GPU细节揭秘,晶体管比Blackwell多62%,智能体AI性能翻10倍,搞AI芯片的必看。
小红书搞了个大模型 dots-note-3.0,在 IMO 2026 拿了满分金牌,第三题解法被冠军选手夸"优雅",快看看它是怎么做到的。
Poolside出了个小参数但很强的编码模型Laguna S 2.1,8B活跃参数就在SWE-Bench多语言上吊打大模型,还开放权重,单机就能跑。
Xaira不靠公开数据,自己造数据训练模型,听起来挺较真。听听他们为什么说因果模型必须配因果数据,对药物发现很有启发。
Google刚发了三款Flash模型,3.6 Flash输出便宜了17%,每百万token只要7.5刀,跑智能体任务很省钱。还有超快的Flash-Lite和专搞漏洞的Flash Cyber。
Google悄悄发了三个新Flash模型,3.6 Flash省了65%的token,但旗舰3.5 Pro还是没影,对手们已经在卷了。
谷歌一口气发了三款Flash模型,性能更强成本更低,Cyber版能抓安全漏洞,开发者和安全人员值得关注。
NVIDIA 把 40 亿参数的开放世界模型塞进设备端,机器人不用联网就能自己理解环境、推理并执行动作,适合边缘部署场景。
Sakana AI新出的Fugu Cyber在安全基准上比GPT-5.5-Cyber还强,86.9%的CyberGym成功率很硬核,搞网络安全的可以关注。
谷歌 DeepMind 用阿里 Wan2.1 搞了个逆天改造,一个模型能同时搞深度估计、分割、姿态估计,速度还快,搞 CV 和生成模型的值得一看。
阿里新出的Qwen-Image-3.0能一次生成4.5k token的复杂版面,连数学公式、多国语言小字都渲染得很清楚,做海报、UI排版效率很高。
阿里千问新语音模型能通过标签控制语气情绪,支持16种语言和20种方言,48KHz音质,试试让语音笑或生气。
Kimi K3在投资研究上直接干翻了GPT-5.5和OPUS-4.8,时间判断和证据边界控制尤其强,已经在AlphaEngine上用了,搞金融研究的可以试试。
宇树发了新模型UnifoLM-OminiA-0.3,能统筹家居康养任务,全模态理解,还能控制设备,比以往机器人模型更实用。
字节新出的 Seed Audio 1.0 能精细控制声音时间线,还能跨 20 多种语言保持音色一致,音频可用率超 90%,做视频创作很实用。