#GPT
共 104 条 · 7 天 9 条 · 30 天 30 条
信息流里打上「GPT」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
Claude Haiku 阶梯定价揭秘:上下文超 100k 价格翻 5 倍
归藏聊的 Anthropic 压价其实是阶梯定价,上下文超 100k 价格直接翻 5 倍,GPT 分界线是 272k,长上下文用户选型前得算算真实成本。
10月8日
实测 GPT 的 IntelligentUI:回答会自动切换到文字以外的形式
有人实测了 GPT 的 IntelligentUI,提问时它会自动判断用图表或界面来回答,不再只会打字聊天,视频里能看到实际效果。
teortaxesTex 发文重提 GPT 风格近期能力通用智能话题
这条推文在问一个扎心问题:模型都能碾压十年人类数学了,还算不算 AGI?评论区讨论挺热闹,适合关心 AGI 定义和安全问题的人看看。
10月5日
斯坦福新课 CME 295 开讲:138 页讲义拆解从 Transformer 到 GPT 的演进
斯坦福 138 页 LLM 讲义免费公开,从缩放定律讲到 RoPE 和 GQA,想系统补基础的直接看这份。
GPT 模型 computer-use 能力实测:像人一样操作 Safari 几乎不出错
连常批评 OpenAI 的博主都服了:GPT 操作 Safari 像真人,任务独立完成几乎零失误,可以看看实测细节。
10月4日
10月3日
10月2日
10月1日
9月30日
9月29日
9月28日
9月26日
9月24日
Zenith 系统让 DeepSeek v4.1 Flash 在长程任务上超过 GPT 5.6 Sol
Zenith 用最便宜的 DeepSeek v4.1 Flash 打赢了 GPT 5.6 Sol,开源党可以看看它怎么做到的。
9月23日
9月22日
9月19日
谷歌推出 Android 开发模型基准测试 Android Bench 2.0
谷歌推出的这个新基准测试挺有意思,专门测模型做真实 Android 开发的能力,比如从零写应用或者迁移代码,能看出不同模型在工程场景下的实际表现。
9月16日
Vercel AI Gateway v0 变为多模型支持,可选用 Claude、GPT 等多种模型
Vercel 新的 AI Gateway v0 能让你直接用 Claude、GPT 这些模型,不用再隐藏选择,更灵活。
9月14日
Agent Harnesses 成新一代 GPT 封装器,可循环运行模型并调用工具
朋友,你试试这个 Agent Harnesses,它就像给大模型穿了件新衣服,能让它持续工作、调用工具,还能记住之前的事。比如处理货运索赔,它比 GPT 更懂具体流程,而且越用越聪明,还能按成果收费,挺有意思的。
9月9日
9月8日
9月7日
9月4日
9月3日
9月1日
8月29日