Los 20 modelos de IA más eficientes principales en junio de 2025: la clasificación completa


¿Nos estamos preparando para entrar en un nuevo punto destacado de la carrera de AI? En los últimos días, algunos usuarios franceses han comenzado a beneficiarse de Google IA Previews. La compañía fundada en 1998, después de un lanzamiento difícil, surge de una buena secuencia marcada al mejorar la API, el lanzamiento de un nuevo modelo de luz y una asociación con Canva para Video. Prueba de que Google sabe cómo ser omnipresente en todos los frentes de la IA. Y este mes, la empresa continúa Dominar el chatbot de la arenaque ella tomó la iniciativa hace dos semanas. ¡Pero nuestra clasificación tradicional de modelos conoce algunos cambios!

El chatbot de la arena se diversifica y se convierte en lmarena

No es uno, sino siete clasificaciones que el chatbot arena ahora nos ofrecerá. Hasta ahora, una tabla de clasificación dinámica clasificó modelos generales. Pero no tuvo en cuenta la diversidad de la IA. Si esta clasificación general siempre está presente (ver imagen de uno), ahora se acompaña de otros seis, más específicos:

  • Texto : Esta clasificación evalúa la capacidad de los modelos para comprender y generar texto. Mide su desempeño por escrito, reformulación y respuesta.
  • Desarrollo web: Esta clasificación analiza la capacidad de los modelos para escribir, corregir o explicar el código web.
  • Análisis de imágenes: Esta clasificación mide la capacidad de los modelos para comprender y describir imágenes.
  • Búsqueda en línea: Esta clasificación compara los modelos sobre su capacidad para simular la búsqueda de información y restaurar una síntesis confiable.
  • COPILOTO: Esta clasificación evalúa la relevancia de los modelos en la asistencia del código, en particular en la finalización o generación de funciones.
  • Generador de imágenes: Esta clasificación juzga la capacidad de los modelos para crear imágenes a partir de descripciones textuales.

Para reflejar esta nueva orientación, el dispositivo ahora toma el nombre de Lmarena.

AI: los modelos más eficientes por dominio

Por lo tanto, el gran ganador de la clasificación global es Gemini-2.5-Préview, que parece sobresalir en código, así como en matemáticas o en la escritura creativa. En la segunda posición, el modelo O3 de OpenAI también muestra un excelente rendimiento, pero parece pescar en las consultas más largas. Debes llegar al sexto lugar para ver un modelo que no pertenece a Google ni a OpenAi, con Claude-Opus-4. Obviamente, la nueva fórmula de Lmarena parece beneficiar a Anthrope, que se usó a las profundidades de la clasificación durante varios meses.

Texto: los 10 mejores modelos IA

En la categoría de texto, hay un trío principal dominado por Gemini y ChatGPT, que parece compartir los primeros lugares sin mucha sorpresa. Las diferencias de puntaje siguen siendo mínimas, una señal de que la batalla se desarrolla en detalles, a veces subjetivos.

La clasificación en la categoría de «texto». © LMSYS

Desarrollo web: los 10 mejores modelos de IA

En el lado del desarrollo web, la jerarquía evoluciona ligeramente con la aparición de Deepseek y varios modelos Claude. Pero el pelotón principal permanece dominado por Géminis.

Chatbot Arena - Webdev junio 2025
La clasificación en la categoría «Desarrollo web». © LMSYS

Análisis de imágenes: los 10 mejores modelos de IA

En tareas visuales, Google y OpenAI no tienen ninguna competencia. El Top 10 está completamente dominado por sus modelos. Una clasificación elocuente, que revela los ángulos muertos de la versión anterior de Lmarena.

Chatbot Arena - Visión de junio de 2025
La clasificación en la categoría «Análisis de imágenes». © LMSYS

Búsqueda en línea: los 10 mejores modelos de IA

La clasificación dedicada a la investigación en línea confirma el aumento de modelos especializados como los de perplejidad, muy presentes en el top 5 gracias a su motor de respuesta de sonar. Pero es Google, con su modelo GEMINI-2.5-Grupo, lo cual es esencial. Openai, por otro lado, permanece detrás de este terreno, con versiones API de GPT-4O confinadas al fondo.

Chatbot Arena - Buscar junio de 2025
La clasificación en la categoría de «investigación en línea». © LMSYS

Asistentes de código: los 10 mejores modelos de IA

Sobre las funciones del asistente de código, hay una gran diversidad de actores: Deepseek, Claude, Qwen, Mistral o Gemini compiten con su cabeza. A diferencia de las clasificaciones anteriores, ningún gigante logra imponer una dominio claro.

Chatbot Arena - Copilot junio 2025
La clasificación en la categoría «Asistente de código». © LMSYS

Generación de imágenes: los 10 mejores modelos de IA

En la generación de imágenes, OpenAi tiene éxito en un avance notable con GPT-IMage-1, que actualiza los modelos de Google, por bien establecido. Detrás, hay una cadena de competidores especializados, como el ideograma, el recloft o la difusión estable.

Chatbot arena-text-to-image junio 2025
La clasificación en la categoría «Generación de imágenes». © LMSYS

Lmarena: los criterios de la clasificación

Lmarena es una plataforma de código abierto para evaluar modelos de inteligencia artificial a partir de comparaciones anónimas hechas por los usuarios. Estos están invitados a elegir, para cada mensaje, cuál de los dos modelos presentados ha proporcionado la mejor respuesta. Este sistema de duelos permite limitar los sesgos y garantizar una evaluación más equilibrada del rendimiento.

Cada confrontación influye en una puntuación ELO atribuida a cada modelo. Esta puntuación, tomada del mundo del ajedrez, aumenta cuando un modelo prevalece frente a un oponente mejor clasificado y disminuye en caso de una derrota ante un competidor que se considere más bajo. De ahora en adelante, Lmarena ya no se limita a una clasificación global: ofrece seis pinturas separadas, que se basan en el mismo sistema que en Origin.

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *