Tencent Hunyuan 研究批大小扩展理论,PPO 生成吞吐提升至 2.29 倍
腾讯混元把经典批大小理论搬进了 LLM 强化学习,实测 PPO 吞吐提升 2.29 倍、GRPO 训练省 29% 时间,做 RL 训练的可以看看怎么调参省钱。
腾讯混元把经典批大小理论搬进了 LLM 强化学习,实测 PPO 吞吐提升 2.29 倍、GRPO 训练省 29% 时间,做 RL 训练的可以看看怎么调参省钱。
腾讯混元做了个新基准 WebCraftBench,用 369 条真实需求测 AI 写网页到底靠不靠谱,测了 17 个模型,和 Code Arena 榜单相关性 0.89。
腾讯混元的 Hy Image 3.5 preview 上 ComfyUI 了,文字渲染和人物一致性都有提升,玩工作流的可以试试。
腾讯用自家 AI 助手 Hyra 和 Hy3 证出了一个 50 年没人能搞定的数学猜想,直接把最优指数从 1.1 推到 2,比之前所有构造都强一截。
腾讯混元开源了AngelSpec,一个能帮你的模型推理提速近2倍的投机解码框架,实测比DFlash还快10%以上,代码和权重都直接可用了。
腾讯的Hy3模型现在OpenRouter上就能用,295B参数但只激活21B,成本低,还有三种推理模式,做智能体任务很合适,而且免费到7月21号,赶紧试试。