Claude Opus 5.5 进了 Perplexity Computer,跑 WANDR 比 Fable 5.1 分数略高,价格还便宜六成多。
#WANDR
共 19 条 · 7 天 0 条 · 30 天 1 条
信息流里打上「WANDR」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月23日
Claude Opus 5.5 上线 Perplexity Computer,成本降低 67.6%
9月5日
9月4日
9月2日
产品04:28
Claude Fable 5.1 登陆 Perplexity ComputerPerplexity 上线了 Claude Fable 5.1,性能提升成本降低,Pro 和 Max 用户可用。
8月29日
8月19日
产品06:41
DeepSeek V4 Pro 登陆 Perplexity Computer,美国托管Perplexity 把 DeepSeek V4 Pro 放进自家电脑了,跑分 0.359,每任务才 0.75 美元,比同档便宜六成多,性价比很能打。
8月14日
Grok 4.6 登陆 Perplexity 和 Perplexity Computer
Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。
7月25日
Claude Opus 5 登陆 Perplexity,WANDR 评测超多数模型并便宜 57%
Perplexity 上了 Claude Opus 5,WANDR 跑分只输 Fable 5,价格还便宜一半多,可以试试。
7月19日
Perplexity AI 发布 WANDR 基准:评估研究智能体的搜索广度与深度
想测你的研究智能体能不能又广又深地搜证据?Perplexity 新出 WANDR 基准,500个任务等着,看看 Search as Code 怎么跑到了0.36 F1。
7月15日
Perplexity Agent API 推出 Wide Research 功能及 WANDR 基准
Perplexity 把搜索从单点命中升级成全面取证,还自建了 500 个真实任务的硬基准 WANDR,做研究自动化的话值得试试这个 preset。
Perplexity AI发布WANDR:智能体实体发现与事实验证评测基准
Perplexity AI搞了个新评测WANDR,专门看智能体能不能找到一堆实体并核实每个的具体信息,比单一评分更清楚哪里不行。
7月11日
Grok 4.5 现已支持 Perplexity Enterprise 组织用户
Perplexity 现在能用 Grok 4.5 做编排了,比 Opus 4.8 便宜一半,性能还更强,Pro 和 Max 用户快去试试。
Grok 4.5 成为 Perplexity Computer 编排模型,成本低于 Opus 4.8
Perplexity 给 Pro 和 Max 用户升级了 Grok 4.5 做编排模型,在 WANDR 上比 Opus 4.8 便宜一半还得分更高,值得试试。
Grok 4.5以半价在WANDR基准上击败Claude Opus 4.8
Perplexity把Grok 4.5作为Computer的编排模型,代理研究任务得分最高,价格只有Opus 4.8的一半,值得试。