Grok 4.20 Beta, de xAI, reduce drásticamente las alucinaciones con una arquitectura multiagente
El nuevo modelo alcanza una tasa de alucinación del 22% —la más baja jamás registrada— mientras ofrece una velocidad vertiginosa de 265 tokens por segundo.

La carrera por el modelo de IA más inteligente ha dado un giro brusco hacia lo práctico. xAI acaba de presentar su Grok 4.20 Beta y, en lugar de simplemente perseguir puntuaciones de razonamiento más altas, aborda el mayor dolor de cabeza de la industria: la fiabilidad. Con una nueva arquitectura multiagente que obliga al sistema a debatir consigo mismo, xAI demuestra que el futuro de la IA empresarial no consiste solo en ser inteligente, sino en tener razón.
El fin del modelo lobo solitario
En el corazón del avance de Grok 4.20 hay un giro que se aleja del modelo tradicional de cadena de pensamiento única. En lugar de un único proceso aislado, Grok 4.20 emplea un sistema multiagente en el que agentes internos especializados —bautizados Grok, Harper, Benjamin y Lucas— trabajan en paralelo. Estos agentes debaten y verifican de forma cruzada las respuestas del otro antes de presentar una respuesta final al usuario. Este proceso de revisión entre pares cambia las reglas del juego para las aplicaciones empresariales, donde una sola afirmación inexacta puede tener consecuencias reales significativas.
“el futuro de la IA empresarial no consiste solo en ser inteligente, sino en tener razón.”
Los resultados hablan por sí mismos. Un análisis independiente de Artificial Analysis confirma que Grok 4.20 Beta logró la tasa de alucinación más baja jamás registrada en el benchmark AA-Omniscience, fallando solo el 22% de las veces en que no conocía una respuesta. Junto con el primer puesto en la evaluación de seguimiento de instrucciones de IFBench, este modelo demuestra que la inteligencia estructurada y colaborativa supera con claridad a la generación anterior de modelos monolíticos.
Velocidad, escala y el futuro del trabajo

La velocidad sigue siendo un punto crítico de fricción para los flujos de trabajo agénticos, y Grok 4.20 también responde en ese frente. Con una velocidad vertiginosa de 265 tokens por segundo, es más del doble de rápido que su predecesor, Grok 4.1 Fast. Este rendimiento de alta velocidad, combinado con una enorme ventana de contexto de 2 millones de tokens, lo convierte en un candidato ideal para tareas exigentes, como analizar conjuntos masivos de documentación o ejecutar bucles de agentes autónomos de larga duración, donde la latencia puede arruinar el proyecto.
Este lanzamiento señala una maduración más amplia de todo el campo de la IA. La industria está dejando atrás la era de los "trucos de magia" para entrar en un periodo de despliegue riguroso y listo para producción. Al priorizar el "aprendizaje rápido" —una arquitectura que actualiza sus capacidades semanalmente en función de datos del mundo real, en lugar de esperar a actualizaciones estáticas—, xAI posiciona a Grok como el motor para desarrolladores empresariales que necesitan un socio fiable y de alta velocidad. A medida que los flujos de trabajo agénticos pasan de ser un experimento a convertirse en infraestructura, este enfoque en la honestidad y el cumplimiento probablemente se convertirá en el estándar con el que se juzgue a todos los demás modelos.
An AI That Argues With Itself
The Brief
Mantén la curiosidad
IA y tecnología: qué cambia y por qué importa.
Tu selección diaria, en inglés o español.
Gratis para siempre. Cancela cuando quieras.
Más historias

The Specialty News





Conversación
Inicia la conversación