Apakah skor Elo?
Sistem Elo berasal dari catur dan diambil oleh Artificial Analysis untuk penilaian model AI. Mekanismenya:
- Output dua model dibandingkan dalam penilaian buta
- Hakim (manusia atau AI) memilih output terbaik
- Skor Elo diselaraskan secara dinamik mengikut menang/kalah
Ini bermakna skor Elo mencerminkan kekuatan relatif, bukan metrik mutlak. 1269 bermakna Seedance 2.0 menang jauh lebih kerap berbanding model lain.
Kedudukan semasa (Februari 2026)
| Kedudukan | Model | Skor Elo |
|---|---|---|
| 1 | Seedance 2.0 | 1269 |
| 2 | Google Veo 3 | 1241 |
| 3 | OpenAI Sora 2 | 1228 |
| 4 | Runway Gen-4.5 | 1205 |
| 5 | Kling 2.0 | 1198 |
Di manakah Seedance 2.0 menang?
1. Penyelarasan audiovisual mengubah permainan
Dalam ujian Elo buta, video dengan audio asli hampir sentiasa mengatasi video senyap. Seedance 2.0 ialah satu-satunya model arus perdana yang konsisten menghasilkan audio-video berkualiti tinggi dan diselaraskan.
2. Konsistensi temporal panjang
Dalam output multishot 15 saat, Seedance 2.0 mengekalkan konsistensi watak dan adegan jauh lebih baik daripada pesaing terhad 4–8 saat. Dalam perbandingan Elo, «video manakah terasa seperti karya lengkap?» menjadi kriteria utama.
3. Realisme fizikal
Dalam prompt dengan pergerakan, perlanggaran dan bendalir, Seedance 2.0 mempunyai kadar kemenangan tertinggi. Hakim kerap melaporkan output «kelihatan benar-benar dirakam».
4. Ketepatan mengikut arahan
Dalam senario prompt kompleks, Seedance 2.0 kurang cenderung «abaikan separuh arahan».
Had skor Elo
Perlu diingat Elo tidak sempurna:
- Subjektiviti: penilaian buta bergantung citarasa hakim
- Bias prompt: set ujian mungkin condong ke kekuatan model tertentu
- Tidak mencerminkan kelajuan/kos: Elo hanya nilai kualiti
Signifikansi industri
Seedance 2.0 mendahului Elo menandakan fasa baharu: fokus beralih dari «siapa boleh jana video» ke «siapa boleh jana karya audiovisual lengkap». Bagi pembangun dan pencipta, penjanaan multimodal bersama ialah hala tuju masa depan.