16:36官方账号阿里通义 Qwen@Alibaba_Qwen精选Qwen3.8-27B 在 ArtificialAnlys Intelligence Index 中获得 52 分。该模型性能与 GPT-5.6 Luna (max) 持平。Qwen3.8-27B 是一个开源权重模型。它支持在本地运行,甚至能通过 WebGPU 在浏览器中运行。AI模型Qwen3.8-27BGPT-5.6 Luna开源模型2 个信源在谈事件专题推荐理由:阿里 Qwen3.8-27B 性能追平 GPT-5.6 Luna,还能在浏览器跑。原文稍后读已读值得跟进有用关注 Qwen3.8-27B
15:36小互@imxiaohu根据ArtificialAnlys的测算报告,DeepSeek完成相同基准任务的成本比Fable低105倍。这意味着DeepSeek的推理开销约为Fable的1/105。该对比数据来自ArtificialAnlys发布的模型成本分析。AI模型DeepSeekFableArtificialAnlys推荐理由:同一基准,DeepSeek成本只要Fable的1/105,这数字挺离谱的,可以点进去看看。原文稍后读已读值得跟进有用关注 DeepSeek
12:09官方账号NVIDIA AI@NVIDIAAIArtificialAnlys发布新基准AA-Briefcase,用于评估复杂项目中的现实任务。Nemotron 3 Ultra在该基准开放模型中排名靠前。该模型在多种长时间运行的智能体任务上表现强劲,即使首次面对这些任务也能保持性能。该基准旨在测试模型的长期执行与泛化能力。AI模型AA-BriefcaseNemotron 3 UltraArtificialAnlys推荐理由:新出的AA-Briefcase基准可以看看,Nemotron 3 Ultra在开放模型里排前面,适合对比它处理复杂任务的能力。原文稍后读已读值得跟进有用关注 AA-Briefcase