Was ist Elo-Scoring?
Das Elo-System stammt aus dem Schach und wurde von Artificial Analysis für KI-Modellbewertungen übernommen. Der Kernmechanismus:
- Zwei Modellausgaben werden blind verglichen
- Richter (Menschen oder KI) wählen die bessere Ausgabe
- Elo-Werte werden dynamisch nach Sieg/Niederlage angepasst
Elo spiegelt relative Stärke wider, keine absoluten Metriken. 1269 bedeutet, dass Seedance 2.0 deutlich häufiger gegen andere Modelle gewinnt.
Aktuelle Rangliste (Februar 2026)
| Rang | Modell | Elo |
|---|---|---|
| 1 | Seedance 2.0 | 1269 |
| 2 | Google Veo 3 | 1241 |
| 3 | OpenAI Sora 2 | 1228 |
| 4 | Runway Gen-4.5 | 1205 |
| 5 | Kling 2.0 | 1198 |
Wo gewinnt Seedance 2.0?
1. AV-Sync ist ein Quantensprung
In blinden Elo-Tests schlagen Videos mit nativem Audio fast immer stumme Videos. Seedance 2.0 ist das einzige Mainstream-Modell, das konsistent hochwertiges synchronisiertes AV liefert.
2. Langzeit-Konsistenz
Bei 15-Sekunden-Multishot-Ausgaben hält Seedance 2.0 Charakter- und Szenenkonsistenz deutlich besser als Konkurrenten mit 4–8 Sekunden. In Elo-Vergleichen zählt: «Welches Video wirkt wie ein vollständiges Werk?»
3. Physikalischer Realismus
Bei Prompts mit Bewegung, Kollisionen und Fluiden gewinnt Seedance 2.0 am häufigsten. Richter sagen, es «sehe wirklich gefilmt aus».
4. Präzision bei Instruktionsbefolgung
Bei komplexen Prompts «ignoriert Seedance 2.0 seltener die Hälfte der Anweisungen».
Grenzen von Elo
Elo ist nicht perfekt:
- Subjektivität: Blinde Bewertung hängt vom Geschmack der Richter ab
- Prompt-Bias: Testsets können bestimmte Modelle begünstigen
- Keine Geschwindigkeit/Kosten: Elo bewertet nur Qualität
Branchenbedeutung
Seedance 2.0 an der Elo-Spitze markiert eine neue Phase: Der Fokus verschiebt sich von «wer Video erzeugt» zu «wer vollständige AV-Werke erzeugt». Für Entwickler und Creator ist multimodale gemeinsame Generierung die Zukunft.