Tabla de contenido
¿Nos estamos preparando para entrar en un nuevo punto destacado de la carrera de AI? En los últimos días, algunos usuarios franceses han comenzado a beneficiarse de Google IA Previews. La compañía fundada en 1998, después de un lanzamiento difícil, surge de una buena secuencia marcada al mejorar la API, el lanzamiento de un nuevo modelo de luz y una asociación con Canva para Video. Prueba de que Google sabe cómo ser omnipresente en todos los frentes de la IA. Y este mes, la empresa continúa Dominar el chatbot de la arenaque ella tomó la iniciativa hace dos semanas. ¡Pero nuestra clasificación tradicional de modelos conoce algunos cambios!
El chatbot de la arena se diversifica y se convierte en lmarena
No es uno, sino siete clasificaciones que el chatbot arena ahora nos ofrecerá. Hasta ahora, una tabla de clasificación dinámica clasificó modelos generales. Pero no tuvo en cuenta la diversidad de la IA. Si esta clasificación general siempre está presente (ver imagen de uno), ahora se acompaña de otros seis, más específicos:
- Texto : Esta clasificación evalúa la capacidad de los modelos para comprender y generar texto. Mide su desempeño por escrito, reformulación y respuesta.
- Desarrollo web: Esta clasificación analiza la capacidad de los modelos para escribir, corregir o explicar el código web.
- Análisis de imágenes: Esta clasificación mide la capacidad de los modelos para comprender y describir imágenes.
- Búsqueda en línea: Esta clasificación compara los modelos sobre su capacidad para simular la búsqueda de información y restaurar una síntesis confiable.
- COPILOTO: Esta clasificación evalúa la relevancia de los modelos en la asistencia del código, en particular en la finalización o generación de funciones.
- Generador de imágenes: Esta clasificación juzga la capacidad de los modelos para crear imágenes a partir de descripciones textuales.
Para reflejar esta nueva orientación, el dispositivo ahora toma el nombre de Lmarena.
AI: los modelos más eficientes por dominio
Por lo tanto, el gran ganador de la clasificación global es Gemini-2.5-Préview, que parece sobresalir en código, así como en matemáticas o en la escritura creativa. En la segunda posición, el modelo O3 de OpenAI también muestra un excelente rendimiento, pero parece pescar en las consultas más largas. Debes llegar al sexto lugar para ver un modelo que no pertenece a Google ni a OpenAi, con Claude-Opus-4. Obviamente, la nueva fórmula de Lmarena parece beneficiar a Anthrope, que se usó a las profundidades de la clasificación durante varios meses.
Texto: los 10 mejores modelos IA
En la categoría de texto, hay un trío principal dominado por Gemini y ChatGPT, que parece compartir los primeros lugares sin mucha sorpresa. Las diferencias de puntaje siguen siendo mínimas, una señal de que la batalla se desarrolla en detalles, a veces subjetivos.
Desarrollo web: los 10 mejores modelos de IA
En el lado del desarrollo web, la jerarquía evoluciona ligeramente con la aparición de Deepseek y varios modelos Claude. Pero el pelotón principal permanece dominado por Géminis.

Análisis de imágenes: los 10 mejores modelos de IA
En tareas visuales, Google y OpenAI no tienen ninguna competencia. El Top 10 está completamente dominado por sus modelos. Una clasificación elocuente, que revela los ángulos muertos de la versión anterior de Lmarena.

Búsqueda en línea: los 10 mejores modelos de IA
La clasificación dedicada a la investigación en línea confirma el aumento de modelos especializados como los de perplejidad, muy presentes en el top 5 gracias a su motor de respuesta de sonar. Pero es Google, con su modelo GEMINI-2.5-Grupo, lo cual es esencial. Openai, por otro lado, permanece detrás de este terreno, con versiones API de GPT-4O confinadas al fondo.

Asistentes de código: los 10 mejores modelos de IA
Sobre las funciones del asistente de código, hay una gran diversidad de actores: Deepseek, Claude, Qwen, Mistral o Gemini compiten con su cabeza. A diferencia de las clasificaciones anteriores, ningún gigante logra imponer una dominio claro.

Generación de imágenes: los 10 mejores modelos de IA
En la generación de imágenes, OpenAi tiene éxito en un avance notable con GPT-IMage-1, que actualiza los modelos de Google, por bien establecido. Detrás, hay una cadena de competidores especializados, como el ideograma, el recloft o la difusión estable.

Lmarena: los criterios de la clasificación
Lmarena es una plataforma de código abierto para evaluar modelos de inteligencia artificial a partir de comparaciones anónimas hechas por los usuarios. Estos están invitados a elegir, para cada mensaje, cuál de los dos modelos presentados ha proporcionado la mejor respuesta. Este sistema de duelos permite limitar los sesgos y garantizar una evaluación más equilibrada del rendimiento.
Cada confrontación influye en una puntuación ELO atribuida a cada modelo. Esta puntuación, tomada del mundo del ajedrez, aumenta cuando un modelo prevalece frente a un oponente mejor clasificado y disminuye en caso de una derrota ante un competidor que se considere más bajo. De ahora en adelante, Lmarena ya no se limita a una clasificación global: ofrece seis pinturas separadas, que se basan en el mismo sistema que en Origin.