OpenAI retrasa GPT Astra mientras rivales en la sombra procesan billones de tokens
Mientras OpenAI pausa su modelo Astra para la resolución de problemas matemáticos por riesgos cibernéticos, un modelo chino en la sombra acaba de procesar 9,4 billones de tokens de forma gratuita

El sector de la inteligencia artificial acaba de vivir una semana vertiginosa. Entre modelos silenciosos y anónimos que procesan billones de tokens de forma gratuita, filtraciones accidentales de la API de Anthropic y avances en razonamiento matemático a nivel de doctorado, el panorama está experimentando un salto masivo y simultáneo. Es el "momento de la banda ancha" para la inteligencia de las máquinas.
El despliegue de fuerza de los 9,4 billones de tokens
La comunidad tecnológica ha estado obsesionada con "Ox Alpha", un modelo silencioso que reventó los precios de todo el mercado al ofrecer capacidades de vanguardia y una ventana de contexto de 1 millón de tokens por exactamente cero dólares.
En lugar de esperar a un comunicado de prensa corporativo, los desarrolladores hicieron ingeniería inversa al modelo. Al medir las respuestas del tokenizador en docenas de idiomas, los analistas descubrieron un desfase constante de +75 tokens.
“Todos los demás modelos divagan. Ese 75 es un prompt del sistema oculto, y el rastro de razonamiento revela para qué sirve: 'según el prompt del sistema, si me preguntan por mi identidad digo ox-alpha'.”— PromptEngineer48
Esta peculiaridad coincide perfectamente con la arquitectura de instrucciones del sistema ocultas de la familia GLM-5.3 de Zhipu AI. El consenso es claro: Ox Alpha es una prueba de esfuerzo para GLM-5.3 Flash, lo que representa una enorme demostración de fuerza de la capacidad de infraestructura china dirigida directamente al ecosistema global de desarrolladores. Al mismo tiempo, Alibaba entró en liza con el lanzamiento de Qwen 3.8-Flash-Next como un avance estructural de Qwen 4. Logra una eficiencia de enrutamiento extrema al activar solo 6.000 millones de sus 125.000 millones de parámetros por token.
La filtración accidental de 'Marshmallow' de Anthropic
Mientras los campeones de pesos abiertos inundan el mercado con computación gratuita, los hiperescaladores occidentales se esfuerzan por perfeccionar sus modelos insignia de última generación. Anthropic lanzó Claude Opus 5 en julio, pero la empresa admitió con franqueza que el rendimiento del modelo era "irregular".
Esta semana, el descubrimiento de identificadores de modelos no anunciados —claude-marshmallow-eap y claude-melon-eap— se filtró en las interfaces de la API. Estos apuntan a un perfeccionamiento de emergencia inminente a mitad de ciclo.
Dado que los identificadores utilizan la etiqueta Early Access Preview —el mismo marcador utilizado para Opus 5 semanas antes de su lanzamiento—, los desarrolladores esperan que Opus 5.1 y una nueva variante de Haiku o Sonnet lleguen en cualquier momento. La era de esperar un año para una actualización importante de un modelo ha muerto; ahora nos encontramos en un ciclo de iteración continua y en condiciones reales.
El prodigio matemático de 2.000 dólares, congelado
Según se informa, el retrasado modelo GPT Astra de OpenAI resolvió 10 problemas matemáticos abiertos desde hace décadas —incluido el empaquetamiento de esferas en dimensiones altas— utilizando menos de 2.000 dólares en computación.
Astra no logró esto solo mediante fuerza bruta. Utilizó marcos matemáticos establecidos como Lean para combinar de forma nativa el descubrimiento con la verificación automatizada paso a paso. Esto transforma a la IA de un generador de texto estocástico a un socio de investigación verificable, capaz de acelerar la física y la ciencia de materiales.
Sin embargo, el lanzamiento del modelo sigue estrictamente en pausa. Durante las pruebas de seguridad, Astra mostró capacidades autónomas de ciberseguridad que OpenAI no pudo descartar como críticas. A medida que los modelos cruzan el umbral hacia la programación agéntica, el riesgo de exploits de día cero automatizados ha activado marcos de pruebas gubernamentales voluntarios.
Bienvenidos a la era de la banda ancha de la IA
Lo que estamos presenciando es una guerra indirecta con dos frentes de batalla bien definidos. Los aspirantes como Alibaba y Zhipu AI están convirtiendo el contexto extremo en un recurso básico para hacer de sus arquitecturas la base predeterminada para las empresas emergentes de todo el mundo. Mientras tanto, los defensores de la frontera como OpenAI y Anthropic están empujando el límite absoluto de la inteligencia, incluso si eso requiere retrasar los lanzamientos de productos para evitar desastres cibernéticos geopolíticos.
Este es el momento de la banda ancha de la IA. Hace apenas tres años, las ventanas de contexto estaban limitadas a unos pocos miles de tokens, estrictamente medidas y eran costosas, de manera muy similar a la era de la conexión telefónica a internet.
Hoy en día, un laboratorio anónimo puede lanzar en línea un modelo con un contexto de 1 millón de tokens y procesar billones de tokens de forma gratuita solo para probar sus servidores. A medida que la infraestructura de la inteligencia pasa rápidamente de ser un lujo escaso a un servicio público ubicuo, la oportunidad ya no reside en proporcionar computación, sino en lo que podemos construir sobre una cognición infinita y gratuita.
Lo que dice la gente
“GPT-6 Astra Is NOT Delayed - Sam confirmed OpenAI still expects to ship great new models soon. - This suggests Astra is still on track as one of the next major releases. - OpenAI already has more models ready to compete with Anthropic. Good that Sam clarified this.”

“🚨 This is getting way more interesting than people realize. OpenAI has reportedly already finished pretraining Bel, the successor to Doug Doug is expected to become the base for Astra and eventually GPT 6 after further post training. Bel is reportedly a 10T parameter pretrain,”
“No Astra this week sadly. But we will have some fire Neo lab updates later this year. Hark will unveil new hardware this fall So will OpenAI. Astra still on track for early September. But I feel OpenAI has waited too long just in time for Anthropic to reclaim the throne shortly”
The AI Proxy War: Two Fronts
The Brief
Mantén la curiosidad
IA y tecnología: qué cambia y por qué importa.
Tu selección diaria, en inglés o español.
Gratis para siempre. Cancela cuando quieras.
Más historias

The Specialty News





Conversación
Inicia la conversación