#NVIDIA
NVIDIA团队用智能体协作拿下两个Kaggle大赛名次,还缩小了大小模型性能差距,挺有启发的。
NVIDIA老大Jensen Huang亲自发文挺开放模型,Ollama转发,说了开放模型为啥跟封闭模型一样重要,还附了公开信链接。
Shopify 老板拿到 NVIDIA DGX 工作站,专跑本地大模型,算力怪兽,看大佬怎么玩本地 AI。
NVIDIA 新出的 Jetson Thor 系列,T2000 和 T3000,专门给机器人和边缘 AI 用,性能翻倍功耗还低,做智能硬件项目可以关注。
NVIDIA 拿 Nemotron 3 Ultra 挑战 IMO 真题,30/42 分直接超金牌线,数学推理很强。
英伟达新CPU Vera专为智能体AI打造,88核3.4TB/s互连,单核内存带宽14GB/s,适合高并发推理和分析工作负载。
英伟达新硬件 Vera Rubin NVL72 实测 DeepSeek R1,每兆瓦 Token 吞吐量比 GB200 NVL72 高 10 倍,AI 推理效率飞跃。
纬创资通在德州开了家新厂,专产英伟达最先进的GB300和Vera Rubin芯片,投资7亿美元,能带动上千个岗位。想了解AI硬件制造最新动向的可以看看。
想搞分布式LLM基准测试?NVIDIA这个srt-slurm框架让你用YAML写配置,一键跑SLURM,还能做参数扫描和Pareto分析,超实用。
NVIDIA 的 Blackwell Ultra 训练 DeepSeek-V3 671B 比上一代快 3 倍,每 GPU 跑到 1648 TFLOPS,优化太狠了。
NVIDIA 把 40 亿参数的开放世界模型塞进设备端,机器人不用联网就能自己理解环境、推理并执行动作,适合边缘部署场景。
NVIDIA 把 Cosmos 3 Edge 完全开源了,模型权重和训练代码都在 Hugging Face 上,直接就能拿下来玩。
NVIDIA 开源了一个能在边缘设备上跑的世界模型 Cosmos 3 Edge,4B 参数加 2B 推理器,机器人、自动驾驶都能用,Jetson 上就能跑。
NVIDIA DeepStream 9.1 新增13个智能体技能,用自然语言就能让Claude Code帮你搭多摄像头视频分析,自动3D追踪,不再手动标定摄像头。
NVIDIA的Nemotron 3 Embed 8B在LMEB和RTEB两个排行榜都拿了第一,适合做智能体长期记忆的检索。