Gorard团队实测了GPT-5.6、Fable 5等模型,发现它们连基础非线性PDE都解不对,而Lanyon用更少token就能搞定,想了解模型短板可以看看。
Qwen3.8-Max 发布,2.4T 参数下周开源
2026年8月4日,Qwen3.8-Max 正式发布,总参数2.4T、激活95B,官方宣布下周首次开源。同日,OpenAI 发布数学手稿与 Lean 证书,实现机器逐条验证推理。三大主题:其一,开源旗舰竞争白热化,Qwen3.8-Max 在编码、电商等场景表现惊人,输入每百万token定价2美元;其二,可验证推理成为新焦点,Lean 证书让数学证明可自动检查;其三,Agent 基础设施加速落地,Cloudflare 发布 @cloudflare/computer 动态调度计算资源,TokTier 将智能体 TTFT 降低34%。
模型发布/更新
5 篇英特尔把 MiniMax H3 跑在多卡 GPU 上,锐炫 Pro B70 首发支持,还搞了 2TP×4USP 混合并行,视频生成部署有参考了。
产品发布/更新
5 篇联发科AI加速器路线图清楚了,第一款2026年量产,第二款2028年,还押注英特尔EMIB封装,搞AI硬件的可以观望下。
行业动态
5 篇F1和AWS搞了个Data Accelerator,用agentic AI把数据接入从几周干到40分钟,还自动处理表结构变化,搞数据的值得看看。
SK海力士联合闪迪定了HBF存储新标准,带宽最高3TB/s,明年FMS上发布,还拉上了谷歌和Tenstorrent,搞AI存储的可以关注。
LMSYS CEO 在 20VC 直接开讲:Kimi K3 已经超越西方闭源模型,还警告开源权重可能藏后门。想听不绕弯的行业实话,可以看这个。
论文研究
5 篇把 Muon 更新压成每参数 1 bit 的符号,实验里 sign-after-LMO 最强,尽管理论上会发散,结论很反直觉。
Llamaindex出的ExtractBench基准测文档提取。商业VLM长文档会截断,LlamaExtract Agentic Plus更准还更便宜。