行业精选

美团内部全面限用豆包大模型,迁移至LongCat与DeepSeek

消息称美团内部全面限用豆包大模型,此前曾限用阿里云 Qwen

精选理由

美团自研LongCat-2.0万亿参数模型来了,内部禁用豆包和Qwen,全面转向自家开源大模型,值得看看。

AI 摘要

7月2日,美团内部下发通知,要求所有业务团队停止使用豆包大模型,并规划迁移至自研LongCat及DeepSeek等模型,无法迁移需提交原因经单独审批。今年4月,美团已限制阿里云Qwen模型使用,需X3级别审批。LongCat是美团2023年启动研发的大语言模型,最新LongCat-2.0为万亿参数模型(总参数1.6T,平均激活约48B),预训练数据超30T tokens,原生支持1M上下文。该模型基于五万卡国产算力集群训练,已对外开源。

原文 · IT之家

消息称美团内部全面限用豆包大模型,此前曾限用阿里云 Qwen

7 月 2 日,据大厂日爆消息,美团内部下发通知,开始限制使用豆包大模型了。 通知显示,所有业务团队需完成现有豆包相关业务自查,并规划迁移至 LongCat、DeepSeek 等模型,无法从火山引擎豆包大模型迁移的,需要提交原因 + 必要性说明,走单独的审批流程。 据了解,这并非美团首次收紧外部大模型使用门槛。今年 4 月,美团对内部大模型使用做出调整,不再推荐业务使用阿里云提供的 Qwen 模型。若业务仍需使用,需提交详细使用原因,上报至 X3 级别(老板级)进行审批。 公开信息显示,LongCat 是美团自主研发的大语言模型,2023 年启动研发,已开源并深度应用于美团内部多项业务场景,包括 APP 内置 AI 助手“小团”、商家经营助手等。 近日,美团发布新一代万亿参数大模型 LongCat-2.0,并将对外开源。作为在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型(总参数 1.6T,平均激活约 48B,动态范围 33B~56B),LongCat-2.0 预训练数据规模超过 30T tokens,覆盖中文、英文、多语言和代码等多类数据,原生支持 1M 超长上下文。 相关阅读: 《 业界首个:美团 LongCat-2.0 发布,国产芯片上跑出的万亿参数模型 》 《 豆包大模型日均 tokens 调用量达 180 万亿,字节跳动 CEO 梁汝波称聚焦提升大模型能力 》 《 美团万亿级大模型 LongCat-2.0-Preview 开放测试,全程基于国产算力集群训练 》 《 美团发布 LongCat-AudioDiT 音频生成模型:说话人相似度指标提升至 0.818,现已开源 》 《 美团发布开源原生多模态大模型 LongCat-Next,让视觉和语音成为 AI 的母语 》