#DeepSeek
vLLM 社区正在把 DeepSeek 的 DSpark 算法加进来,推理速度能再上一个台阶,用 vLLM 的朋友可以期待了。
BashCoder-R1用三阶段训练让AI写bash脚本更稳更可解释,在BashBench上比DeepSeek-V3.2完整率高出一大截。
DeepSeek开源了DSpark框架,能让你的V4模型推理提速60%以上,且不影响质量。它解决了投机解码在真实部署中的难题,已经稳定跑在生产环境。
DeepSeek 拿 Pro Max 模式在 LiveCodeBench 等三大编码基准上直接碾压 GPT-5.4 和 Claude Opus 4.6,分数拉满,但还没开放下载,先来围观一下。
Lindy 公司从 Claude 全切到 DeepSeek,省下数百万美元,还立竿见影降成本。想控制 AI 账单的企业可以看看他们怎么做到的。
Lindy为了省钱,把Claude全换成了DeepSeek,省了几百万美元。这家公司说再不用DeepSeek就活不下去了——模型价格战就是这么现实。
大厂AI账单太高了,UBS说60%的企业已经在换更便宜的模型,像DeepSeek、Qwen这些中国开源模型成了新选择。想省钱的企业可以看看这个趋势。
这个系统把DeepSeek和Opus组合起来,用投机解码省了近一半API成本,还快了一倍,质量也有提升,而且开源可部署。
DeepSeek Harness组在招研究员、工程师和产品经理,门槛不低但机会难得,想加入国产大模型核心团队的朋友可以试试看。
DeepSeek Harness 组在招人,研究员、工程师、产品经理都要,做 Agent Harness 的可以直接投简历。门槛不低但机会大。
Z.ai刚刚放出了GLM-5.2,MIT开源、100万上下文、跑分81.0,跟Claude Opus 4.8差距很小,做开源模型的得看看。
这帖子把2022到2026国产模型进化史盘得清清楚楚,DeepSeek、Qwen、GLM、Kimi每月一个旗舰,本地部署清单都快十个版本了,AI发烧友必看。
DeepSeek 拿到 510 亿首轮融资,估值 4000 亿,腾讯、宁德时代、京东都投了,梁文锋亲自把关,五年锁定期只留长线资本。