Inteligencia en el borde: Qwen 3.5 lleva IA de nivel de escritorio al iPhone 17 Pro
Cómo el último modelo de Alibaba y el chip A19 Pro de Apple están redefiniendo la computación móvil.

Durante años, el sueño de una IA de bolsillo se vio frenado por una realidad sencilla: los chips móviles carecían de la potencia bruta para gestionar un razonamiento complejo sin agotar la batería en minutos. Esa barrera acaba de derrumbarse. El 2 de marzo de 2026, el desarrollador Adrien Grondin mostró el modelo Qwen 3.5 de Alibaba funcionando de forma nativa en el iPhone 17 Pro, con un rendimiento que rivaliza con modelos cuatro veces más grandes.
La arquitectura de la eficiencia
En el centro de esta demostración está el modelo Qwen 3.5 2B, una potencia ligera que utiliza la nueva arquitectura híbrida Gated DeltaNet de Alibaba. Al combinar atención lineal con un diseño de Mezcla de Expertos (MoE) disperso, el modelo alcanza lo que la industria llama alta densidad de inteligencia. Esto permite que un modelo relativamente pequeño, de 2.000 millones de parámetros, supere a predecesores mucho más grandes en pruebas de lógica y matemáticas. Para que cupiera en los 12 GB de RAM del iPhone, el equipo utilizó una cuantización de 6 bits, que reduce la huella de memoria del modelo sin sacrificar su precisión cognitiva.
“Esta transición de herramientas dependientes de la nube a una inteligencia nativa del dispositivo representa un cambio fundamental en cómo interactuamos con nuestros aparatos.”
La optimización es la otra mitad de la historia. Grondin utilizó MLX, el framework especializado de Apple para aprendizaje automático en sus chips Silicon, que según se informa ofrece hasta el doble de velocidad frente a frameworks más genéricos. Esta integración profunda permite que el modelo acceda directamente al Neural Engine de 16 núcleos del A19 Pro. El resultado es una experiencia de usuario ágil y local, que elimina la latencia y las preocupaciones de privacidad inherentes a las soluciones de IA basadas en la nube. Esta transición de herramientas dependientes de la nube a una inteligencia nativa del dispositivo representa un cambio fundamental en cómo interactuamos con nuestros aparatos.
El interruptor del razonamiento móvil
Una de las funciones más innovadoras de Qwen 3.5 es su capacidad para alternar entre los modos de Pensamiento y No Pensamiento. En su estado predeterminado, el modelo ofrece respuestas rápidas y de baja latencia para tareas cotidianas como redactar correos o poner recordatorios. Sin embargo, ante un problema complejo de programación o lógica, los usuarios pueden activar el razonamiento. En este modo, el modelo genera tokens de razonamiento ocultos, realizando esencialmente una versión digital de 'pensar' el problema antes de dar una respuesta final. Esta flexibilidad permite a los usuarios gestionar la duración de la batería del dispositivo y el presupuesto computacional según la tarea que tengan entre manos.
El hardware desempeña un papel crucial para que estas tareas intensivas sean sostenibles. El iPhone 17 Pro es el primer dispositivo de Apple con un sistema de refrigeración por cámara de vapor, que evita que el chip A19 Pro sufra throttling térmico durante sesiones de razonamiento largas. Además, Qwen 3.5 es nativamente multimodal, lo que significa que no depende de adaptadores de visión separados para entender imágenes o vídeo. Un único conjunto de pesos se encarga de todo, lo que permite una integración más fluida de la comprensión visual. Desde analizar hojas de cálculo complejas a través de la cámara hasta ofrecer retroalimentación de vídeo en tiempo real, la era del agente multimodal nativo ha llegado oficialmente al móvil.
Desktop Brains, Pocket Body
The Brief
Mantén la curiosidad
IA y tecnología: qué cambia y por qué importa.
Tu selección diaria, en inglés o español.
Gratis para siempre. Cancela cuando quieras.
Más historias

The Specialty News




Conversación
Inicia la conversación