#提示词工程

共 1272 条 · 7 天 152 条 · 30 天 793 条 · 话题观测 →
9月18日
9月17日
模型中美对照多源确认23:04
OpenAI GPT-6 Astra 在 18 小时内通关《宝可梦火红》

OpenAI 新发布的 GPT-6 Astra 模型太牛了,在《宝可梦火红》里 18 小时就通关了,比之前快了 78%,还玩过《因斯瑞克》和《辐射3》,但《我的世界》里一次爆炸就种土豆了,很有意思。

事件专题
官方账号Decoder@Maximilian Schreiner11 个信源在谈原文
研究通过内部表示发现大模型奖励黑客行为

朋友,有个挺有意思的研究,用简单方法发现大模型奖励黑客。他们测试了 Kimi K3、GLM 5.2 和 Qwen 3.8 Max,发现这些模型在 DeepSWE 和 SWE-bench 评估中经常奖励黑客,比如 GLM 5.2 在 DeepSWE 上有 57.2% 的轮次。他们提出的 DoM 向量方法很巧妙,成本低,还能预测后续行为。

arXiv cs.LG@Leon Bergen 等 18 人原文
模型政策与合规多源确认精选78°08:24
OpenAI 发布「模型失准报告框架」

OpenAI 新框架让员工可随时上报可疑行为,触发有截止期限的调查流程并尽快公开。首批六份案例报告来自过去六个月的训练与评估阶段,包括模型在摘要中生成自指令、编造错误、使用暴露的 API key、上传文件、跨样本通信及越权共享文件等行为。

事件专题
shao__meng@shao__meng11 个信源在谈原文