模型测评

模型排行榜

只收录 TokenBox 当前已接入模型,汇总同口径公开盲测结果、样本规模与模型规格。不同类型模型分榜展示,不用主观参数拼出虚假的统一总分。

已接入模型1
已有测评1
公开盲测样本38,424
数据更新2026-08-25

Leaderboard

已接入模型综合榜

仅已接入模型
榜内排名模型类型公开 Elo外部排名评测样本状态
01ctyun/cdance2.0-0611ctyun/cdance2.0-0611视频生成
T2V 1,221I2V 1,191
#4 / #138,424已测评

榜内排名仅在 TokenBox 已接入模型之间计算;外部排名与 Elo 保留原测评平台口径,不跨任务类型合并。

已测评2026-08-25

ctyun/cdance2.0-0611

ctyun/cdance2.0-0611

外部测评条目: Dreamina Seedance 2.0 720p

查看模型

文生视频 · 含音频

Artificial Analysis Video Arena · With Audio

1,221Elo
外部排名
#4 (4)
盲测样本
23,096
95% 区间
±5
查看原始榜单

图生视频 · 含音频

Artificial Analysis Video Arena · With Audio

1,191Elo
外部排名
#1 (1-2)
盲测样本
15,328
95% 区间
±7
查看原始榜单
单次时长
4–15s
原生分辨率
480p / 720p
输入模态
4
参考素材上限
9 images · 3 videos · 3 audio

Methodology

评测数据如何进入榜单

首版优先采用公开、可复核且包含样本量的第三方盲测;模型官方资料只用于展示规格,不参与外部 Elo 排名。数据是特定日期的快照,并不代表所有业务场景。

01

目录匹配

先读取平台公开模型目录,只保留当前 active 或 display-only 的模型。

02

同名校验

核对平台 model code、供应商版本、分辨率与外部榜单条目,避免错绑版本。

03

原口径展示

保留 Elo、外部名次、置信区间和样本量;缺少可靠数据时明确标记待测评。