Thinking

general · 首次出现 2026-05-22 · 最近出现 2026-09-11 · 累计提及 413

综述

Thinking 近期进展

AGI 建设的挑战

Gary Marcus 在其文章中指出,尽管人工智能领域取得了显著进展,但关于如何构建通用人工智能(AGI)的问题仍然存在争议。原文标题

Claude Code 的优化

shao__meng 发布了关于 Claude Code 会话价值最大化的指南,涵盖了缓存、上下文和 Subagent 成本优化等方面。原文标题

开源权重模型发布

Meta、NVIDIA、Google 等六家公司共同发布了开源权重模型,其中包括 GPT-OSS。原文标题

DeepSeek 的实测报告

宝玉分享了 DeepSeek Harness 的用户实测报告,指出其启动门槛较高但速度较快。原文标题

LLM 的纵向行为轨迹

arXiv 上的一项研究探讨了大型语言模型(LLM)如何回应逐步升级的妄想,并提出了四种纵向行为轨迹。原文标题

MAI Thinking 试用链接

Mustafa Suleyman 分享了 MAI Thinking 的试用链接。原文标题

微软发布 MAI-Thinking-1

微软发布了自研推理模型 MAI-Thinking-1,并已在 Foundry 提供。原文标题

稀疏自编码器研究

一项关于稀疏自编码器的研究揭示了大型模型思考与直接作答的推理机制差异。原文标题

ChatGPT 更新

归藏(guizang.ai)报道,ChatGPT 现由 GPT-5.6 驱动,付费用户可使用,免费用户则向 Luna 开放。原文标题

DeepSeek-V4-Flash 性价比

DeepSeek-V4-Flash (High) 以 0.024 美元单任务成本重塑了 Agent Arena 的性价比。原文标题

当前焦点与观察点

当前,人工智能领域的焦点在于如何构建通用人工智能,以及如何优化和提升现有模型的能力。同时,开源模型和自研模型的竞争也在加剧,这可能会推动技术的进一步发展。

相关报道

10 条在档