论文09:10小模型对话游戏代理的训练方法研究人员为小模型对话游戏代理设计了一套三步训练法,显著提升了特定任务表现,同时保持通用能力。#LM Playschool Challenge#2B模型#对话游戏代理#监督微调aarXiv cs.LG@Nan Li原文稍后读已读值得跟进有用关注 LM Playschool Challenge
模型精选02:24Kog开源2B模型,推理速度超3000 tokens/sKog开源了一个2B模型,每秒能处理3000多个token,适合需要高速推理的任务。#Kog#HuggingFace#2B模型#开源模型官方账号Clement Delangue@ClementDelangue原文稍后读已读值得跟进有用关注 Kog