Perplexity 免费推出 Deep Research:性能超过 R1、o3-mini 等

2.15 AI界竞争加剧,AI搜索老大哥Perplexity,刚刚也推出了自家的DeepResearch随意给个话题,就能生成深度研究报告,免费向所有人开放

AI界竞争加剧,AI 搜索“老大哥”Perplexity,刚刚也推出了自家的 Deep Research —— 随意给个话题,就能生成深度研究报告,免费向所有人开放!

使用该功能,一般用户每天最多可查询 5 次,Pro 用户每天可查询 500 次。

20250215151338

在性能方面,Perplexity 官方也给出了他们的测试结果。

他们采用的基准,是最近考验 AI 推理能力大火的 Humanity’s Last Exam(人类的最后考试),准确率达到了 20.5%。

(注:“人类的最后考试”涵盖 100 多个科目、包含 3000 多个问题,涉及数学、科学、历史和文学等领域。)

20250215151654

从成绩上来看,是优于 Gemini Thinking、o3-mini、o1、DeepSeek-R1 和其他许多主流模型。