TypeSafe AI 把 Jev 做成路由器接进了 OpenRouter,实测比固定用 GPT-6 Sol 便宜一半多还更快,做智能体的可以去看看。
#GPT-6
有人用 GPT-6 加 Hyper3D Rodin 的 MCP,两句提示词就做出 3D 赛车游戏,一行代码没写,教程步骤都列出来了。
OpenAI 的 GPT-6 Astra 看一眼照片就能指出你 IKEA 柜子哪步装错了,准确率 80%,比半年前的 28% 高出不少。
GPT-6 Astra 打 Minecraft 打出了史无前例的进度,结果一只苦力怕把箱子连人一起炸了,看它气到自我复盘还挺有意思。
GPT-6 Astra 打 Minecraft 打到收集烈焰棒和末影珍珠这一步,比之前所有 AI 都远,结果被一只苦力怕清空存档,直播全程挺有意思。
OpenAI 新模型在 Agent Arena 用一半价格逼近 Claude Fable 5 的表现,做智能体应用的成本压力小多了
Replit Agent 一次上了 GPT-6 两款和 Claude Opus 5.5 三个模型,还能做 VR 应用了,搞开发的朋友可以试试哪个顺手。
Cline 免费开放了匿名模型 Pixel Canary,跑分和 GPT-6 Astra 打平、超过 Kimi K3,写 Next.js 的可以试试。
Meta 做了个 AI 电子宠物 Muse,数据居然跑赢 ChatGPT 早期成绩,还要装进智能眼镜里,这条视频讲清了三家同周发模型的门道。
Google DeepMind 的新掌门亲自确认 Gemini 4 在做 post-training 了,毕竟 3.5 Pro 跳票、对手 Claude 5 和 GPT-6 都已经出街,这篇讲清楚了 Google 下一步怎么追。
马斯克放话:SpaceX 做 AI 才 3 年,只要加速度够猛,6 个月就能追上做了 6 年的 Anthropic 和 10 年的 OpenAI,他还预告 2-3 个月内出 GPT-6 级模型。
OpenAI 把 GPT-6 Astra 的能力下放到 Sol 和 Luna 两个便宜模型,Luna 编码榜涨了 74 分,API 价格还砍了一半,跑批量任务可以看看。
OpenAI 新出的 GPT-6 Sol 和 Luna 被拿来做法律场景实测了,Sol 抓合同变更、Luna 管细节核查,做法律 AI 的可以看看成绩。
Claude Opus 5.5 拿下 58 分登顶,但 $0.13 的 MiMo-V2.6-Pro 得分 46,性价比党可以直接看这张图选模型。
OpenAI 给 ChatGPT 语音加了插件支持,还能跑 GPT-6 的三个模型,动嘴就能写文档、建表格、查邮件。
OpenAI 拉了 80 多位心理医生做了个心理健康对话基准,GPT-6 Astra 考了 57.3 分,GPT-4o 只有 32.1,想看模型心理对话靠谱程度可以关注这套评测。
开源助理 OpenClaw 更新了,一次接入 Opus 5.5 和 GPT-6,还能记会议笔记、恢复中断任务,自己搭助理的可以看看。
有人用 Codex 复刻了《是男人就下18层》联机版,从想法到上线全程记录,素材、音效、部署都是 AI 生成,流程很值得抄。
OpenAI 拿出 1215 段心理对话让各家模型答题,GPT-6 Astra 拿 57.3% 第一,Gemini 2.5 Pro 只有 29.5%,数据集已开放下载。
Airbnb拿到了OpenAI新模型GPT-6 Astra的访问权,连写代码的Codex和远程Agent都已经在用了,看看大公司怎么把模型接进自家业务。
OpenAI 新出的 GPT-6 Sol 和 Luna 便宜了一半,Sol 跑分还超过了 Claude Opus 5,做大批量任务可以认真看看这个定价。
OpenAI 给 ChatGPT 语音加上了邮件、日历和 Slack 权限,动动嘴就能发邮件、约会议,底层换成了新的 GPT-6 系列模型。
ChatGPT 语音模式升级了,能用日历、Slack 这些插件,还能靠说话直接在浏览器里做文档和表格,今天全球推送。
OpenAI 新的 GPT-6 Sol 在真实用户投票的 Code Arena 拿了第4,价格只要 Claude Opus 5 的一半不到,做 Web 开发的可以看看分数再决定用哪个。
OpenAI 一次出了 GPT-6 Sol 和 Luna 两个模型,价格砍半还带新缓存,跑业务任务比 Claude Opus 5 便宜九成,做 API 应用的可以看看。
OpenAI 把 GPT-6 Astra 的能力塞进了两个更快更便宜的模型,API 价格直接砍半,Genspark 上已经能用了。
一天之内 Opus 5.5、GPT-6 Sol/Luna、Grok 4.7、Mimo v2.6 全来了,Opus 5.5 还降了 40% 成本,这篇帮你梳理各家提升方向和 benchmark。
浏览器操作智能体的性价比榜刷新了,GPT-6 Sol 比.Opus 便宜三倍还高分,挑模型前可以看看这份数据。
OpenAI 一口气发了 GPT-6 Sol 和 Luna 两款新模型,API 价格砍半,Sol 在基准测试里能跟 Claude 旗舰打平,性价比党可以直接上手试试。
Simon Willison 把 Claude Opus 5.5 和 GPT-6 两个版本放在同一套画鹈鹕测试里对比,想快速了解三者差别看这篇就够了。
OpenAI 把 GPT-6 打到五折,阿里自家 AI 芯片算力翻了三倍,还有高通 2nm 新旗舰芯片,一天大事全在这。
GPT 6 Sol 和 Luna 直接砍半价,Benchmark 上比 Opus 5 便宜 10 倍,同天 Claude 也降价了,这波价格战值得看看对比数据。
Simon Willison 的命令行工具 llm 更新了,这次能直接调用 OpenAI 的 GPT-6 Sol 和 Luna,单轮模型也有专门的处理机制。