8月23日
14:43
8月22日
01:59
01:58
8月21日
00:44
8月19日
13:26
13:26官方账号阿里通义 Qwen@Alibaba_Qwen
Qwen3.8-27B在Harvey的Legal Agent基准测试中获得11.3分,与Fable 5并列第一。该模型在性能上超越Kimi K3、Qwen 3.8 Max和DeepSeek V4等模型。作为开源模型,Qwen3.8-27B能够处理专业法律任务,同时体积小到可在本地机器运行。
事件专题

推荐理由:阿里Qwen的Qwen3.8-27B在法律基准上并列第一,还能本地运行,比其他大模型更实用。
8月13日
18:06
18:06官方账号NVIDIA AI@NVIDIAAI
精选71°
Harvey联合Trajectory Labs对NVIDIA的Nemotron 3.5 Lightning进行后训练,在Legal Agent Bench上得分从0%升至8.3%。该成绩超过了Opus 4.6和更大的后训练版Nemotron 3 Ultra。后训练覆盖九个执业领域,未出现能力退化。平均输出长度从90k tokens降至37k tokens,每token奖励提升2.4倍。
事件专题

推荐理由:Harvey把Nemotron 3.5 Lightning后训练了一把,法律Agent评测从0冲到8.3%,比Opus 4.6还强,输出也从90k缩到37k,省Token。
6月25日
14:45
6月4日