10:27ollama@ollamaNvidia新开源模型Nemotron Ultra在Ollama平台上快速增长。该模型专为开发者设计,可处理复杂且长时间运行的任务。Ollama的集成使得开发者能更便捷地使用这一模型。目前Nemotron Ultra在社区中热度持续上升。AI模型NvidiaNemotron UltraOllama8 个信源在谈事件专题推荐理由:Nvidia新出的Nemotron Ultra开源模型在Ollama上很火,能搞定复杂长流程任务,适合做深度开发。原文稍后读已读值得跟进有用关注 Nvidia
10:16官方账号NVIDIA AI@NVIDIAAINVIDIA 在社交平台感谢开源社区,并回应了关于 Nemotron 的提及。NVIDIA 最新的开源模型 Nemotron Ultra 在 Ollama 平台上的使用量迅速增长,为开发者解锁了更复杂、更长时间运行的任务执行能力。该模型是 NVIDIA 支持开源生态的又一举措,目前已被越来越多的开发者采用。AI模型NVIDIANemotron UltraOllama8 个信源在谈事件专题推荐理由:NVIDIA 发了新开源模型 Nemotron Ultra,在 Ollama 上跑得很火,专门搞定复杂长任务,比之前的版本更强。原文稍后读已读值得跟进有用关注 NVIDIA
20:28官方账号Tri Dao (FlashAttention)@tri_dao精选在运行大规模上下文智能体时,Qwen 3.5和Nemotron Ultra等混合模型面临Gated-DeltaNet/Mamba状态的瓶颈。一个简单洞察是加载状态并计算但不存储,可使速度提升2倍。该重计算技巧最终解锁了状态空间模型(SSM)的推测解码(spec decoding)功能。技巧Qwen 3.5Nemotron UltraMamba1 个信源在谈事件专题推荐理由:不用存状态,算完就扔,SSM推理直接快一倍,Qwen 3.5和Nemotron Ultra用户试试这个技巧。原文稍后读已读值得跟进有用关注 Qwen 3.5