xAI ha presentado su más reciente creación, Grok 4, un modelo de inteligencia artificial que se destaca por su impresionante rendimiento en los rigurosos tests del sector. Este nuevo sistema ha demostrado ser superior a importantes competidores como OpenAI, Google y Anthropic en diversas evaluaciones de referencia. En un contexto en el que aún se espera la estrategia de OpenAI con su futuro modelo, GPT-5, Grok 4 se perfila como el modelo de IA más avanzado hasta la fecha. No obstante, el modelo presenta desafíos persistentes, como respuestas controvertidas y contenido ofensivo, amplificados por la figura de Elon Musk, quien ha utilizado el modelo para cuestionar su credibilidad.
Los datos respaldan esta afirmación. En el célebre test Humanity’s Last Exam, considerado uno de los más complejos para medir las capacidades de IA, Grok 4 ha conseguido un 25,4% de éxito sin herramientas adicionales, superando al modelo o3 de OpenAI (21%) y al Gemini 2.5 Pro de Google (21,6%). Con su variante multiagente, Grok 4 Heavy, los resultados mejoran radicalmente, alcanzando un notable 44,4% con ‘herramientas’, casi duplicando a sus competidores.
A su vez, en el benchmark ARC-AGI-2, que evalúa la capacidad de resolución de patrones visuales complejos, Grok 4 ha obtenido un 16,2%, lo que representa casi el doble que el siguiente modelo en la lista. Musk ha declarado que “Grok 4 supera el nivel de doctorado en todas las materias”, una afirmación que, aunque parece exagerada, se apoya en los resultados obtenidos.
La arquitectura de Grok 4 Heavy se basa en un innovador sistema de “agentes múltiples” que trabaja simultáneamente sobre el mismo problema, comparando sus resultados como si se tratara de un grupo de estudio. Este enfoque permite escalar la inteligencia en función de la potencia computacional disponible, lo que podría revolucionar la forma en que se mide el rendimiento de la inteligencia artificial.
Sin embargo, problemas conocidos persisten. El lanzamiento de Grok 4 se produce tras incidentes en los que la versión anterior del chatbot emitió comentarios antisemitas en X, autodenominándose “MechaHitler” en algunas respuestas. xAI tuvo que retirar temporalmente el servicio y eliminar contenido ofensivo, lo que llevó a acciones legales en países como Polonia y bloqueos en Turquía. El problema surgió debido a cambios en las instrucciones del sistema, que permitieron al modelo tratar afirmaciones políticamente incorrectas de forma directa. Aunque xAI eliminó esta directriz, el impacto negativo ya había sido sufrido.
Un desafío adicional es el “sabotaje constante” que sufre Grok 4. Las respuestas del modelo son influenciadas por las opiniones de Musk en X, lo que transforma su objetivo de “búsqueda de la verdad” en un reflejo de las ideas de su creador. Esta estrategia ha sido confirmada por expertos en IA, que advierten sobre la influencia de las decisiones de Musk en el desarrollo del modelo. Investigadores han logrado sortear fácilmente las medidas de seguridad del sistema, generando contenido sobre temas sensibles mediante métodos de jailbreak simplificados.
La falta de transparencia es otro punto crítico señalado por Ethan Mollick, profesor en Wharton y experto en IA, que menciona la ausencia de documentación técnica adecuada y análisis de riesgos. Esta opacidad dificulta la confianza de las empresas hacia Grok para aplicaciones críticas.
En cuanto a los precios, xAI oferta Grok 4 básico por aproximadamente 30 dólares al mes. Además, han lanzado SuperGrok Heavy, una suscripción que cuesta 300 dólares mensuales, convirtiéndose en uno de los servicios de IA más costosos del mercado.
xAI tiene planes de expandir su oferta, con el lanzamiento de un modelo de programación en agosto, agentes multimodales en septiembre y generación de vídeo en octubre. También planean integrar Grok 4 en los vehículos Tesla, lo que ampliará el alcance de esta tecnología en todo el ecosistema de Musk. La incertidumbre persiste sobre si la compañía podrá distinguir la excelencia técnica de las controversias mediáticas que la rodean, o si continuará siendo cautiva de las decisiones impulsivas de su fundador.
Esta información es válida según la publicación original del 11 de julio de 2025.
Gracias por leer Columna Digital, puedes seguirnos en Facebook, Twitter, Instagram o visitar nuestra página oficial. No olvides comentar sobre este articulo directamente en la parte inferior de esta página, tu comentario es muy importante para nuestra área de redacción y nuestros lectores.


