#推理模型
朋友,OpenAI 的研究人员每天花 7000-8000 美元用 Codex,一年要花 20 多万,还在指数级增长,说明这个工具太值了。
OpenAI 新发布的 GPT-6 Astra 模型太牛了,在《宝可梦火红》里 18 小时就通关了,比之前快了 78%,还玩过《因斯瑞克》和《辐射3》,但《我的世界》里一次爆炸就种土豆了,很有意思。
智谱 GLM 做了个很酷的事,让 AI 自己去优化自己的推理系统,在十万张国产卡上把效率提升了三倍,比用普通 GPU 还划算。
朋友,AMD 用 512 个 GPU 刷新了 AI 推理纪录,比英伟达的同类配置快,值得关注。
朋友,Infinigence AI 开源了 APXInf 模型,能在 Jetson Thor 上把推理延迟降到 26ms,比原来快很多。
Yann LeCun(深度学习之父)在讨论AI推理的本质,指出当前主流LLM并非自回归模型,而是通过搜索生成序列,并强调推理应在抽象空间而非语言空间进行,观点很有深度。
Anthropic 推出了 Claude 3.5 Sonnet,这个新模型在多项任务上比 GPT-4 更强,你可以用它来写代码、做推理,甚至处理图片信息。
谷歌新出的Gemini 3.8 Live和Extended Thinking,能一边说话一边思考,比如查资料时能同步汇报进度,比普通语音助手更智能。
朋友,刚看到 JustFit 这个技术,它能让 27B 的 Qwen 模型在 24GB 笔记本上处理 20万token,比之前的方法快很多,对本地开发很有用。
谷歌新出的Gemini 3.8 Live Extended Thinking版本,编程辅导能力更强了,能实时理解代码和屏幕,还能自动处理多种语言,比之前版本好用。
Anthropic 新发布的 Claude Fable 5.1 在最新 AI 指数中表现不错,和 GPT-6 Astra 并列第一,而且能帮你省点钱。
Salesforce 和英伟达一起搞了个叫 Koa 的模型,专门给企业用,处理销售和客服这些实际业务,比 Claude 和 ChatGPT 更省钱,还不会泄露客户数据,是个不错的备选方案。
Salesforce 和 Nvidia 联合发布了新的推理模型 Koa,这个模型在数学和逻辑推理方面表现很棒,适合做销售、营销和客服工作。
腾讯新出的 EvolveScaler 模型,能通过逻辑状态机生成可执行文本,比普通模型在 8 个基准测试上平均提升 5.25 分。
DeepSeek 新出的 V4.1-Flash (Max) 模型在 Agent Arena 排名第三,成本还特别低,适合做任务。