
¿Cuándo tendrá xAI un Grok #1 a la vez en LMArena Text (sin style control) y Artificial Analysis, por encima de OpenAI y Anthropic, durante 2+ semanas?
Elon Musk se declaró "cautelosamente optimista" esta semana: según él, SpaceXAI tendrá un modelo equivalente a Fable de Anthropic o GPT-6 de OpenAI en dos a tres meses, y podría liderar el campo en seis meses. Para medirlo seguimos dos benchmarks que se complementan: LMArena Text (https://lmarena.ai/leaderboard/text, sin style control) mide la preferencia humana en votaciones a ciegas y es la fuente que usan Polymarket y Kalshi para resolver sus mercados. Artificial Analysis Intelligence Index (https://artificialanalysis.ai/leaderboards/models) agrega de forma independiente benchmarks de razonamiento, conocimiento, matemáticas y ciencia. ARC-AGI queda fuera porque evalúa una habilidad puntual con acertijos visuales, depende mucho del cómputo por tarea y no todos los laboratorios lo reportan de forma comparable. Fuentes: AI Magazine (https://aimagazine.com/news/elon-musk-spacexai-may-surpass-anthropic-in-6-months)
¿Qué opinas?
Elige una opción. Puedes cambiarla mientras la predicción esté abierta.
Cómo ha cambiado la opinión
n = 12
Recta semitransparente ajustada a lo ya observado en este periodo. No es el pronóstico.
No se muestran los momentos con menos de 5 opiniones.
Pronóstico
Cómo ha cambiado cada opción y, cuando los datos alcanzan, una estimación de lo que sigue.
n = 0Por semana
Todavía no hay periodos con suficientes respuestas para dibujar esta serie.
No se muestran los periodos con menos de 5 respuestas.











