AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:训练框架×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
5月27日
11:57
11:57IT之家(博客/媒体)
78°
面壁智能联合清华大学、OpenBMB开源社区发布ForgeTrain,这是全球首个完全由AI编写、零人类代码介入的生产级大模型训练框架。该框架已在华为昇腾芯片上成功完成MiniCPM5-1B模型的预训练,该模型综合性能在全球同尺寸中领先,位列AA榜单2B规模以下Top 1。ForgeTrain完全开源,包含框架代码和Agent Harness工具链,任何团队可复现从对齐到反超的全过程。这标志着“AI写框架→国产芯片运行→训出领先模型”的闭环被打通。
AI产品开源/仓库训练框架面壁智能华为昇腾MiniCPM

推荐理由:ForgeTrain证明了AI可以自主编写生产级训练框架,解决了大模型训练对人工编码的依赖问题。做模型训练或国产芯片适配的团队可以直接用这套开源工具链复现顶尖模型,建议点开看看具体实现。
原文
5月26日
12:57
12:57pandaily@contact@pandaily.com (Pandaily)
精选72°
Model Best 开源了 BitCPM-CANN 训练框架,首次在国产 AI 加速器上实现 1.58-bit 模型训练。该框架相比全精度训练,推理内存需求降低高达 6 倍,大幅降低硬件门槛。这一突破使得国产算力也能高效运行低比特模型,对依赖国产芯片的 AI 团队意义重大。开源框架已发布,开发者可直接使用。
AI模型开源/仓库训练框架低比特量化国产芯片Model Best

推荐理由:国产芯片终于能跑 1.58-bit 训练了,内存需求直降 6 倍,用国产算力的 AI 团队可以直接上手试试。
原文
10:16
10:16pandaily@contact@pandaily.com (Pandaily)
精选72°
Bingbi AI 开源了 BitCPM-CANN 训练框架,支持在国产 AI 加速器上进行 1.58-bit 模型训练。相比全精度训练,该框架可将推理内存需求降低最多六倍,显著降低硬件门槛。这一开源举措有望推动国产算力生态发展,让更多开发者和团队在国产芯片上高效训练和部署大模型。
AI产品开源/仓库训练框架国产算力低精度训练Bingbi AI

推荐理由:国产算力生态终于有了低精度训练的利器——1.58-bit 训练框架让国产芯片也能高效跑大模型,做国产 AI 部署的团队可以直接拿来用,内存省六倍,值得关注。
原文
精选全部日报登录