04:17官方账号Nous Research@NousResearch腾讯混元的Hy3模型在Nous Portal上免费使用延长一周。该模型专注于成本效益的智能体应用,在编码、工具调用可靠性、推理和长上下文任务上表现突出。用户可通过Nous Portal访问此模型。AI模型Hy3TencentHunyuanNous Portal推荐理由:腾讯混元的Hy3现在免费多一周,做智能体和编程任务很划算,快去试试。原文稍后读已读值得跟进有用关注 Hy3
12:45Hunyuan@TXhunyuan腾讯混元发布了Hy3的1-bit和4-bit量化版本,该模型拥有295B参数。通过1-bit和4-bit量化,模型可在单张GPU上运行,大幅降低硬件门槛。支持使用llama.cpp进行推理,并启用MTP(多token预测)功能。模型以GGUF格式提供下载,用户可快速体验。AI模型Hy3TencentHunyuan量化模型推荐理由:腾讯把295B的模型压到1-bit和4-bit,单卡就能跑,用llama.cpp就能玩,赶快试试。原文稍后读已读值得跟进有用关注 Hy3
22:16Hunyuan@TXhunyuan腾讯混元Hy3模型获得vLLM项目支持。用户可以通过vLLM推理引擎启动Hy3进行体验。vLLM是一个高效的大模型推理框架,此次集成简化了Hy3的部署流程。AI模型Hy3TencentHunyuanvLLM推荐理由:腾讯混元让Hy3在vLLM上跑起来了,现在就能上手试玩,搞视频生成的朋友可以看看。原文稍后读已读值得跟进有用关注 Hy3
02:03官方账号LMSYS Org (SGLang)@lmsysorg76°腾讯混元发布Hy3,一个295B参数MoE模型,激活参数仅21B,支持256K上下文。在推理和智能体任务上,Hy3可媲美参数大2-5倍的开源模型。通过反幻觉训练,该模型的幻觉率从12.5%降至5.4%。多轮意图跟踪指标MRCR从42.9%提升至75.1%。Hy3支持MTP+EAGLE推测解码,并提供了FP8检查点以降低部署成本。AI模型Hy3TencentHunyuanSGLang推荐理由:腾讯混元新模型Hy3,21B激活参数就能比肩更大模型,幻觉率从12.5%降到5.4%,多轮对话能力大增,现在就能在SGLang上跑。原文稍后读已读值得跟进有用关注 Hy3