AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:MiniCPM×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
5月27日
11:57
11:57IT之家(博客/媒体)
78°
面壁智能联合清华大学、OpenBMB开源社区发布ForgeTrain,这是全球首个完全由AI编写、零人类代码介入的生产级大模型训练框架。该框架已在华为昇腾芯片上成功完成MiniCPM5-1B模型的预训练,该模型综合性能在全球同尺寸中领先,位列AA榜单2B规模以下Top 1。ForgeTrain完全开源,包含框架代码和Agent Harness工具链,任何团队可复现从对齐到反超的全过程。这标志着“AI写框架→国产芯片运行→训出领先模型”的闭环被打通。
AI产品开源/仓库训练框架面壁智能华为昇腾MiniCPM

推荐理由:ForgeTrain证明了AI可以自主编写生产级训练框架,解决了大模型训练对人工编码的依赖问题。做模型训练或国产芯片适配的团队可以直接用这套开源工具链复现顶尖模型,建议点开看看具体实现。
原文
精选全部日报登录