产品Agent 与开发者19:44开发者自研推理引擎 tqllm,单卡 RTX 3090 跑 Qwen 27B 达每秒 273 token一张 RTX 3090 把 27B 模型跑到每秒 273 token,作者自己写的引擎,速度直接把普通部署方案甩开了。#tqllm#Qwen#RTX 3090#推理引擎Lxfater@lxfater原文稍后读已读值得跟进有用关注 tqllm
模型Agent 与开发者多源确认精选14:19网友用阿里 Qwen3.8-27B 模型开发出僵尸射击游戏朋友,有个网友用阿里 Qwen3.8-27B 模型,花了5小时在 RTX 3090 上开发出僵尸射击游戏,挺有意思的。#Qwen3.8-27B#编程助手#僵尸射击游戏#RTX 30902 个信源在谈事件专题IIT之家3 个信源在谈原文稍后读已读值得跟进有用关注 Qwen3.8-27B
模型14:49Muse发布Glimmer与Spark开源权重,主打个人超级智能Muse开源了Glimmer和Spark,Glimmer一张3090就能跑,想本地玩大模型的可以看看。#Muse#Glimmer#Spark#开源模型官方账号Latent Space (swyx)原文稍后读已读值得跟进有用关注 Muse
论文多源确认精选11:11融合INT8 GEMM内核让Ideogram 4.0在RTX 3090上加速1.1倍INT8反超FP8,单卡RTX 3090跑1024px扩散模型#Ideogram 4.0#RTX 3090#INT8#GEMM2 个信源在谈事件专题aarXiv cs.LG@Ali Asaria 等 3 人3 个信源在谈原文稍后读已读值得跟进有用关注 Ideogram 4.0