12:20官方一手arXiv: DeepSeek@Mohammadsina Hassannia, Matthew A. Reyna, Reza Sameni精选研究人员开发了ECGQuest,一个包含10,904个唯一真/假问题的数据集,源自23篇心电图参考文献和2003-2025年Computing in Cardiology会议。该基准测试了3个商业和20个开源语言模型,零样本准确率在49.5%至74.4%之间,GPT-5表现最佳。微调使5个开源模型(7-14B参数)的准确率提升6.5-14.1%,其中DeepSeek-R1-Distill-Qwen-14B达到76.3%。论文ECGQuestGPT-5DeepSeek-R1-Distill-Qwen-14B推荐理由:ECGQuest为心电图领域语言模型提供了首个专业评测基准,微调让小模型接近大模型表现。原文稍后读已读值得跟进有用关注 ECGQuest