hard·general

Hard

别名
首次出现
2026-05-22
最近出现
2026-07-28
累计提及
144
§ 01综述

Hard 近期进展

Perplexity AI 发布 WANDR 基准:评估研究智能体的搜索广度与深度

Perplexity AI 发布 WANDR 基准:评估研究智能体的搜索广度与深度 WANDR 基准旨在评估智能体在搜索广度和深度方面的能力,为智能体研究提供了新的评估标准。

OpenAI 奥尔特曼调侃 Anthropic 最新广告:我还以为这是讽刺短片

OpenAI 奥尔特曼调侃 Anthropic 最新广告:我还以为这是讽刺短片 OpenAI 高管对 Anthropic 的广告进行了幽默的回应,反映了人工智能领域的竞争态势。

Perplexity AI 提出软分数与硬分数评估方法

Perplexity AI 提出软分数与硬分数评估方法 Perplexity AI 提出的评估方法旨在更全面地评估智能体的性能。

当前焦点与观察点

硬智能(Hard AI)作为人工智能领域的一个重要分支,近年来在搜索广度与深度、评估方法、安全与稳定性等方面取得了显著进展。Perplexity AI 发布的 WANDR 基准和提出的评估方法为智能体研究提供了新的工具和标准。同时,OpenAI 奥尔特曼对 Anthropic 广告的回应也反映出人工智能领域的竞争激烈。此外,微软CEO纳德拉对AGI的展望和Token经济的讨论,也引发了人们对人工智能未来发展的关注。

§ 02相关报道10 条在档
  1. 01
    工作流局部机制学习:结构化Agent技能的归因修复与知识复用
    arXiv: DeepSeek
  2. 02
    Perplexity AI 发布 WANDR 基准:评估研究智能体的搜索广度与深度
    marktechpost
  3. 03
    OpenAI 奥尔特曼调侃 Anthropic 最新广告:我还以为这是讽刺短片
    IT之家
  4. 04
    Perplexity AI 提出软分数与硬分数评估方法
    Perplexity
  5. 05
    Relaxing Faithfulness with Intervention-Only Causal Discovery
    arXiv cs.LG
  6. 06
    基数约束投资组合优化:增强多目标进化算法实现更快收敛
    arXiv cs.AI
  7. 07
    DT-Guard:面向无推理LLM安全护栏的意图驱动推理主动训练
    arXiv cs.AI
  8. 08
    R^2LPL:通过错误回滚与终身学习实现自动驾驶策略持续改进
    arXiv cs.AI
  9. 09
    LMSYS Arena排行榜评估流程揭秘:从内部基准到社区投票
    lmarena.ai
  10. 10
    Claude Code v2.1.183 更新:增强安全与稳定性修复
    Claude Code: GitHub Releases
§ 03邻近话题

本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

/topic/Hard