论文Agent 与开发者10:28论文:自监督置信度微调让推理模型生成 token 减少 25%只用600道题微调,不训练停止机制,就让Qwen、Gemma这些模型推理时少生成25%的token,思路挺有意思。#Qwen#Gemma#GPT-OSS#推理模型aarXiv cs.LG@Parsa Hosseini 等 9 人原文稍后读已读值得跟进有用关注 Qwen
模型中美对照多源确认16:13Meta、NVIDIA、Google 等六家发布开源权重模型,GPT-OSS 在列六大公司集体晒开源模型,GPT-OSS、Gemma、Phi 挨个看,开源党有得玩了。#GPT-OSS#Gemma#Nemotron#Phi10 个信源在谈事件专题andrew chen@andrewchen11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-OSS
模型中美对照多源确认精选11:35webAI开源3B推理模型TwiL-LM3,4项基准超GPT-OSS-120B3B 的小模型在推理上干翻了 120B 的大家伙,还能跑在树莓派上,开源了直接就能玩。#TwiL-LM3#webAI#GPT-OSS#推理模型10 个信源在谈事件专题shao__meng@shao__meng11 个信源在谈原文稍后读已读值得跟进有用关注 TwiL-LM3