论文18:14批大小还是负样本?内存受限推荐训练的取舍规则推荐系统训练时内存不够用?这篇论文告诉你该加批大小还是加负样本,结论很实用。#推荐系统#采样softmax#内存优化#MovieLens-20MaarXiv cs.LG@Artyom Sabitov 等 3 人原文稍后读已读值得跟进有用关注 推荐系统
技巧Agent 与开发者多源确认14:09每天学一个硬核AI知识:Scaling Laws 缩放定律想搞懂大模型为什么越训越大?这个视频用动画讲清Scaling Laws的缩放规律,比看论文容易多了。#Scaling Laws#缩放定律#训练策略#大模型知识2 个信源在谈事件专题向阳乔木@vista83 个信源在谈原文稍后读已读值得跟进有用关注 Scaling Laws
模型精选18:19智源悟界·Orca:先让模型理解世界如何变化智源搞了个新训练法Orca,不让AI一上来就干杂活,先学世界怎么变。论文上了Hugging Face月榜第一,值得看看他们的思路。#悟界·Orca#智源研究院#Hugging Face#训练策略量子位@思邈原文稍后读已读值得跟进有用关注 悟界·Orca
论文精选72°11:54斯坦福研究:大模型不怕脏数据,未过滤Common Crawl效果反超这项研究挑战了数据清洗的行业惯例,做大模型训练的团队值得关注——或许可以省下大量清洗成本,直接喂原始数据。#大模型#数据清洗#Common Crawl#斯坦福向阳乔木@vista8原文稍后读已读值得跟进有用关注 大模型