The Specialty News
IA

Z.ai lanza un modelo de IA de $0.045 que rivaliza con Claude — y Silicon Valley pensó que era de Google

Al lanzar sigilosamente GLM-5.3-Flash bajo un seudónimo, un laboratorio chino demostró que la inteligencia de frontera puede ejecutarse en chips nacionales por unos pocos centavos.

Por The Specialty News DeskEditado por 4 min read
Z.ai lanza un modelo de IA de $0.045 que rivaliza con Claude — y Silicon Valley pensó que era de Google
Foto: reuters.com

Durante casi una semana en agosto, los desarrolladores de software occidentales estuvieron convencidos de que un misterioso modelo de IA que dominaba las listas de OpenRouter era una versión filtrada de Gemini de Google. Procesaba un millón de tokens a la vez y apareció de la nada bajo el seudónimo Ox Alpha. Pero el modelo no pertenecía a Mountain View. Fue desarrollado en Beijing, se ejecuta completamente en silicio nacional chino y acaba de romper el suelo de precios de la inteligencia artificial de frontera.

El disfraz

Cuando el modelo llegó a OpenRouter, se desataron las especulaciones de que se trataba de un lanzamiento secreto de un gigante tecnológico occidental. Un grupo de investigadores independientes ignoró los rumores. Al hacerle preguntas al modelo en chino y analizar sus tasas de compresión, descubrieron que devolvía errores de excepción de API exactos vinculados a Zhipu AI, un destacado laboratorio chino.

El lanzamiento sigiloso fue totalmente intencionado. Al eliminar su nombre del lanzamiento, Zhipu —que opera a nivel mundial como Z.ai— obligó a los desarrolladores occidentales a evaluar el modelo puramente por sus méritos. Patrick Collison, CEO de Stripe, lo probó pronto y calificó públicamente el código de muy impresionante, validando la arquitectura antes de que nadie conociera su origen.

La estrategia de distracción funcionó a la perfección. El internet chino celebró el desenmascaramiento, pero los departamentos financieros de las empresas en EE. UU. se enfrentan ahora a un problema mucho mayor.

El paradigma de los diez centavos

El paradigma de los diez centavos
Foto: reuters.com

El modelo desenmascarado, GLM-5.3-Flash, introduce una arquitectura de 320 mil millones de parámetros que depende de solo 18 mil millones de parámetros activos durante la inferencia. Z.ai publicó los pesos bajo una licencia de código abierto MIT y anunció precios para empresas con un gran descuento de 15 centavos por millón de tokens de entrada.

Para poner en perspectiva la referencia de $0.045 por tarea, esto representa aproximadamente un colapso de precios de 10 veces para este nivel específico de razonamiento. Es el equivalente a descubrir que un menú degustación con estrella Michelin ahora cuesta exactamente lo mismo que una chocolatina de máquina expendedora.

Las implicaciones geopolíticas son igual de agudas. Z.ai afirma que están ofreciendo una capacidad de hasta 100 billones de tokens al día ejecutada por completo en hardware de producción nacional. Demostraron que el rendimiento de la IA de primer nivel puede escalar globalmente sin depender del silicio occidental más reciente. Pero ejecutar modelos de frontera a bajo coste oculta un enorme inconveniente operativo.

Z.ai's Stealth AI Breaks Price Floor

A visual summary of this story

The Brief

Mantén la curiosidad

IA y tecnología: qué cambia y por qué importa.
Tu selección diaria, en inglés o español.

Gratis para siempre. Cancela cuando quieras.

Conversación

Inicia la conversación

No necesitas cuenta. Los comentarios se revisan automáticamente: mantén el respeto.

Más historias

Seguir leyendo