让比较有据可依
Yeedot AI Rankings 是 Yeedot 的研究项目,汇总公开评测,帮助用户了解大语言模型(LLM)与 Agent(智能体)的能力表现。
研究的价值不仅在于呈现排名,也在于说明数据从哪里来、如何比较,以及结论适用于什么范围。
一个分数,不是全部答案
不同评测关注不同任务,公开成绩也有各自的时间与条件。我们希望使用者在查看榜单时,一起阅读评分方法、数据来源与更新时间。
排名是理解能力的入口。选择模型时,还需要结合自己的任务、使用方式和实际体验作出判断。
研究进展 · 研究介绍
汇总公开评测,以透明的方法比较 LLM 与 Agent 的能力。