7月15日
23:55
23:55elvis@omarsar0
精选
Robbyant 开源了 LingBot-VLA 2.0 的训练后代码。在单张 NVIDIA GeForce RTX 4090D 上,仅需 10 步去噪,推理耗时约 130 毫秒。这意味着用户无需集群即可进行适配和测试,大幅降低了部署门槛。
事件专题

推荐理由:Robbyant 把 LingBot-VLA 2.0 的训练后代码开源了,单张 RTX 4090D 跑出 130 毫秒推理,不用集群就能自己玩。
7月9日
11:22
11:22IT之家博客/媒体
精选
蓝戟测试英特尔 Arc Pro B70 GPU 在 DeepSeek R1-Distill Qwen 32B FP16 模型推理性能。并发 128 时 Arc Pro B70 吞吐比 RTX 5090D 高 8.6%,比 RTX 4090D 高 34.2%。并发 256 时分别高 7.5% 和 48.7%。最高吞吐达 2320.76 token/s。并发低于 32 时 RTX 5090D 仍领先。

推荐理由:蓝戟实测发现 Intel Arc Pro B70 跑 DeepSeek R1 推理比 RTX 5090D 还快,高并发场景优势明显,适合做推理部署参考。