Yeedot AI Rankings

看清能力,选对模型。

汇总公开评测,比较模型与 Agent。每一项分数,都有据可查。

个模型与 Agent 个数据源 个能力维度快照更新

更新计划:每天 06:30、16:30(北京时间)。正在检查采集状态…

能力排行榜

正在载入榜单数据…

正在加载榜单…点击条目查看评测详情

综合分为 0–100 分;请结合数据覆盖率阅读。实际选型还需考虑成本、速度与任务匹配。

Source map

数据从哪里来

每天定时检查公开来源,仅更新能准确对应的模型版本与 Agent 组合。未匹配或采集失败的指标保留历史快照;各项采集时间可在详情中查看。

Weight lab

调整你的能力偏好

按任务需要调整各项权重,点击“应用并重排”更新榜单。比例会自动归一,无需凑满 100%。

当前合计100%

Provider

详情

Yeedot score
数据置信度

Methodology · Yeedot AI Rankings 1.0

我们如何得到综合分

01

同名实体对齐

以模型版本或 Agent 与模型组合为最小单位,避免把不同快照混成一个名字。

02

前沿区间归一

每个原始分数按公开的上下界线性映射到 0—100,并对越界值截断。

03

加权平均

按任务重要性加权;缺失项不记为零,而是在已有指标上重新归一权重。

04

显示覆盖率

综合分必须与数据覆盖一起阅读。覆盖不足的条目会显示更低置信度。

边界说明

公开榜单的提示词、推理预算、工具权限和测试日期可能不同。Yeedot AI Rankings 用于形成方向判断,不替代你自己的任务评测。