#GPT-5
共 56 条 · 7 天 3 条 · 30 天 12 条 · 话题观测 →
信息流里打上「GPT-5」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
10月7日
10月5日
一条提示词生成粗野主义城市建造游戏:Fable 5.1 单次输出可用 Demo
Ethan Mollick 试了 Fable 5.1,一句话直接生出一个能玩的粗野主义城市建造游戏,对比一年前 GPT-5 的水平挺直观。
10月2日
9月30日
9月28日
美国作家协会诉OpenAI案解封文件显示高管明知使用盗版图书训练模型
OpenAI被告知偷书训练模型的内部邮件解封了,连GPT-5续写《冰与火之歌》的计划都被翻出来,John Grisham这些作家联手起诉,细节相当劲爆。
9月25日
9月20日
9月18日
GPT模型存在性别歧视转化问题,安全训练后表面无歧视但内容实质未改善
朋友间推荐:看这篇论文,作者发现GPT模型在安全训练后,针对女性的歧视内容被转化而非减少,比如GPT-5会把乳腺癌和男性权利扯上关系,挺有意思的。
9月15日
9月14日
9月10日
9月9日
9月7日
Substrate-Aware AI Agents: Execution Context as a First-Class Input
Claude、GPT-5和Gemini在代码生成时加入执行约束后,代码效率大幅提升,最高快3.1倍。
9月3日
9月1日
8月28日
8月20日
8月17日
8月10日
8月5日
8月3日
8月2日
Replit Design 上线多模型选择,支持 Claude、GPT-5 等对比生成
Replit 把 Claude、GPT-5、Gemini 这些模型都塞进一个设计工具里,同一个设计能换着模型生成对比,选最满意的。
7月31日
7月30日
7月29日
7月28日
LLM政治对齐可控性审计:上下文框架主导模型立场偏移
这篇论文用70道政治题+12种人格提示,测了GPT-5、Claude、Grok等7个模型,发现提示词比模型本身更能左右回答方向。想了解AI怎么被‘带节奏’的可以看看。
7月26日
7月20日
7月15日
7月14日
论文12:13
AI改写邮件语气影响接收者行为:121人随机交叉现场实验这篇论文不是教你怎么用AI写邮件,而是用真实实验数据告诉你:AI改写邮件语气不会直接提高回复率,但会让读邮件的人感觉更积极,从而更愿意打开和回复。
Claude Fable 5在生物医学挑战问题上的能力评估
这篇论文很有意思,告诉你Claude Fable 5在医学难题上不是不会答,而是经常拒绝回答。一旦它愿意回答,准确率反而是最高的。如果你想了解模型的安全边界和真实能力,值得看看。