Cos’è il punteggio Elo?
Il sistema Elo proviene dagli scacchi ed è stato adottato da Artificial Analysis per valutare i modelli IA. Meccanismo centrale:
- Due output di modelli vengono confrontati in valutazione cieca
- I giudici (umani o IA) scelgono l’output migliore
- I punteggi Elo si aggiustano dinamicamente in base a vittorie/sconfitte
Elo riflette forza relativa, non metriche assolute. 1269 significa che Seedance 2.0 vince nettamente più spesso rispetto a qualsiasi altro modello.
Classifica attuale (febbraio 2026)
| Posizione | Modello | Punteggio Elo |
|---|---|---|
| 1 | Seedance 2.0 | 1269 |
| 2 | Google Veo 3 | 1241 |
| 3 | OpenAI Sora 2 | 1228 |
| 4 | Runway Gen-4.5 | 1205 |
| 5 | Kling 2.0 | 1198 |
Dove vince Seedance 2.0?
1. La sincronizzazione AV è un salto qualitativo
Nei test Elo ciechi, i video con audio nativo battono quasi sempre quelli muti. Seedance 2.0 è l’unico modello mainstream che produce costantemente AV sincronizzato di alta qualità.
2. Coerenza temporale lunga
Negli output multishot da 15 secondi, Seedance 2.0 mantiene coerenza di personaggi e scene nettamente superiore ai concorrenti limitati a 4–8 secondi. Nei confronti Elo, «quale video sembra un’opera completa?» è diventato criterio chiave.
3. Realismo fisico
Nei prompt con movimento, collisioni e fluidi, Seedance 2.0 ha il tasso di vittoria più alto. I giudici dicono che sembra «realmente girato».
4. Precisione nel seguire le istruzioni
Nei prompt complessi, Seedance 2.0 raramente «ignora metà delle istruzioni».
Limiti di Elo
Elo non è perfetto:
- Soggettività: la valutazione cieca dipende dal gusto dei giudici
- Bias dei prompt: i set di test possono favorire certi modelli
- Non velocità/costo: Elo valuta solo la qualità
Significato per il settore
Seedance 2.0 in cima all’Elo segna una nuova fase: il focus passa da «chi genera video» a «chi genera opere audiovisive complete». Per sviluppatori e creator, la generazione congiunta multimodale è il futuro.