全部动态
OpenAI 把 GPT-6 Astra 的能力塞进了两个更快更便宜的模型,API 价格直接砍半,Genspark 上已经能用了。
一个只会做选择题的模型,100 万次判断才 42 美元,Agent 里几十个判断步骤全靠它省钱省时间,Vercel 上线一天就 13% 付费团队接入了。
一天之内 Opus 5.5、GPT-6 Sol/Luna、Grok 4.7、Mimo v2.6 全来了,Opus 5.5 还降了 40% 成本,这篇帮你梳理各家提升方向和 benchmark。
Qwen 的图像模型这次在 LMArena 两个榜单都是开源第一,图像编辑拿到 1367 分,总榜离 GPT-Image-1.5 只差 3 分,做图的朋友可以试试。
有人在比 GPT-6-Luna 和 DeepSeek-V4.1-Flash 的实际成本,短上下文选 Luna,272K 以上大输入选 DeepSeek,做 agent 的可以看看怎么省钱。
浏览器操作智能体的性价比榜刷新了,GPT-6 Sol 比.Opus 便宜三倍还高分,挑模型前可以看看这份数据。
理想把车端模型拆成大脑、世界模型和视觉语言三块来做,35B 和 4B 边缘版都给了,做具身智能的可以看看架构思路。
中国电信开源了个 29B 的 MoE 模型,只激活 4B 参数、支持 256K 上下文,全程在昇腾芯片上训练,权重挂在 Hugging Face 和 ModelScope 上可以直接下载。
OpenAI 一口气发了 GPT-6 Sol 和 Luna 两款新模型,API 价格砍半,Sol 在基准测试里能跟 Claude 旗舰打平,性价比党可以直接上手试试。
Anthropic 出了 Claude Opus 5.5,能力对标 Fable 5.1,价格还降了 40%,写代码的用户可以直接换上试试。
Simon Willison 把 Claude Opus 5.5 和 GPT-6 两个版本放在同一套画鹈鹕测试里对比,想快速了解三者差别看这篇就够了。
GP-6 Sol 价格砍半,OPPO Find X10 也只要 4999 起,还有 iQOO 16 和荣耀 Magic9 的新机信息,一条看完全部。
GPT 6 Sol 和 Luna 直接砍半价,Benchmark 上比 Opus 5 便宜 10 倍,同天 Claude 也降价了,这波价格战值得看看对比数据。
Anthropic 和 OpenAI 前后脚发新模型还互相砍价,GPT-6 Luna 只要 $0.10/M,做应用的成本又降一半,附完整价格对比表。
Perplexity 分享了怎么让 Computer 模型从自己的错误里学习,A/B 测试里工具调用失败率降了 21.2%,做法挺值得看看的。
LlamaIndex 跑了 ParseBench,Opus 5.5 解析 PDF 表格比 Opus 5 高 7 个点,但每页 5.8 美分不便宜,文中还对比了 LlamaParse 的替代方案。
OpenAI 的 GPT-6 Sol 和 Luna 已经能在 Augment 的 Cosmos 里直接用了,他们还打算把整套 GPT-5.6 工作流迁过去,想看迁移实测数据的可以蹲一下。
OpenAI 把 GPT-6 Astra 的能力下放到了 Sol 和 Luna 这两个便宜一半的型号上,批量跑任务的可以看看价格。
Vercel 又更新 Next.js 评测了,GPT-6 Sol 首秀就并列第一,Grok 4.7 便宜一半到七倍,选模型前可以看看这份榜单。
xAI 的 Grok 4.7 (xHigh) 悄悄上线了,WebDev 排行榜冲到第10,比上一版涨了16分,价格速度还不变,写前端的朋友可以试试。
Genspark 把做幻灯片的模型 Gen-1 Slides 放进了 FireworksAI 的 SII 指数,价格只有常规的 1/17,做 PPT 的可以看看成绩单。
GPT-6 两个新模型已经在 LMArena 可以测了,评分还没出,想抢先体验可以现在去投票。有人还拿它和 GPT-5.6 同条件跑了对比,token 用量和速度都测了。
OpenAI 把 Astra 的能力做成大中小三档,Sol 跑分超 Claude Opus 5 但成本只有 9%,跑长任务智能体的开发者账单能省不少。
OpenAI 把 GPT-6 Astra 的能力下放到了 Sol 和 Luna 两个便宜模型上,API 价格直接砍半,跑批量任务的成本党可以看看。
300 亿参数的 MoE 模型跑进手机了,内存砍半,预填充 330 Token/s,邮件、行程规划全在本地完成,不用联网。
OpenAI把GPT-6 Sol和Luna价格砍到一半,性能基本没变,摆明了冲Anthropic来的,但Opus 5.5同天发布,有点撞车。
OpenAI 上了 GPT-6 Sol 和 Luna,比 5.6 系列更强还便宜一半,用 API 的朋友可以直接看看价格表了。
OpenAI 的 GPT-6 Sol 和 Luna 已悄悄上线 LMArena,现在能免费对比测试,还能开 Agent Mode 玩玩,趁匿名期去投你的票。
OpenAI 把 GPT-6 Astra 的能力下放到了 Sol 和 Luna 两个便宜一半的新模型上,还能在 Agent Arena 里亲手测试投票。
Anthropic 放出了 Claude Opus 5.5 的早期试用片段,有人拿它写了一篇西瓜短篇故事,想看新模型写作水平的可以围观。
OpenAI 又出新款了,GPT-6 Sol 和 Luna 是 Astra 的省钱版,API 价格直接比 GPT-5.6 便宜一半,跑批量任务的可以看看。
OpenAI 把 GPT-6 Astra 的能力塞进了更便宜更快的 Sol 和 Luna,缓存读取打 1 折,API 价格比 GPT-5.6 还低一半。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档