模型精选

Perplexity AI 开源内部基准测试 WANDR

精选理由

Perplexity AI 把他们自己用来测试 AI 研究深度的工具 WANDR 开源了,想测测自家模型的研究能力可以用它。

Perplexity AI 宣布开源其内部基准测试 WANDR,该基准用于评估计算机在深度与广度研究能力上的表现。WANDR 最初是为构建 Perplexity Computer 而开发的。开源后,开发者可利用此基准测试自己的模型或系统。目前该基准已发布在 research.perplexity.ai 上。

图片来源 · Perplexity
原文 · Perplexity

We’re open sourcing WANDR. WANDR is an internal benchmark we built and used for building deep and wide research capabilities inside Perplexity Computer. research.perplexity.ai/articles/wandr… 💬 14 🔄 17 ❤️ 158 👀 18421 📊 39 ⚡