Durante años, «IA en Windows» significó casi siempre lo mismo: un botón que enviaba tu petición a un centro de datos y esperaba la respuesta. En Build 2026 (2 de junio), Microsoft dio un giro a esa idea con Aion 1.0: una familia de modelos de IA pequeños diseñados para ejecutarse dentro del propio Windows, en tu dispositivo, sin llamar a la nube. Para quien construye con agentes, el matiz es importante: parte del razonamiento y la orquestación pueden ocurrir en local, con la privacidad, la latencia y el coste que eso cambia. En esta guía verás qué es Aion 1.0, sus dos variantes, por qué los modelos locales importan para los agentes y qué hay disponible de verdad hoy.
En resumen
- Aion 1.0 es una familia de modelos de lenguaje pequeños (SLM) para ejecutarse en el dispositivo, presentada por Microsoft en Build 2026.
- Tiene dos variantes: Instruct (ligera, para tareas cotidianas) y Plan (razonamiento y uso de herramientas para flujos de agentes locales).
- Según Microsoft, Aion 1.0 Plan es un modelo de 14.000 millones de parámetros con 32K de contexto que se enviará integrado en Windows en dispositivos compatibles.
- Hoy solo hay vista previa de la variante Instruct; las cifras son las que declara Microsoft y aún no hay verificación independiente.
El giro: un modelo de IA dentro del propio Windows
La idea de fondo es un cambio de arquitectura. Hasta ahora, la IA generativa en el PC se parecía más a una llamada remota: escribes en una caja, el texto o el audio salen del equipo, se procesan en algún servidor y vuelve una respuesta si la red y la cuota acompañan. Aion 1.0 propone lo contrario para una parte del trabajo: que el modelo viva en el sistema operativo, igual que un controlador de archivos o el renderizador de fuentes, presente y funcionando antes de que instales una sola aplicación. Microsoft, además, construye estos modelos a través de Microsoft Research, en un movimiento que la prensa ha leído como una forma de reducir su dependencia de proveedores externos y abaratar costes para los desarrolladores.
Las dos variantes de Aion 1.0
Aion 1.0 Instruct es el modelo de uso diario. Microsoft lo describe como un SLM más pequeño, rápido y eficiente que el que ya venía integrado en Windows, pensado para el trabajo frecuente y poco vistoso: resumir un documento, reescribir un párrafo, detectar la intención del usuario o dar soporte a funciones de accesibilidad. Tiene dos detalles que lo hacen relevante. El primero: según Microsoft, se ejecuta en CPU, sin necesidad de NPU ni GPU dedicada, lo que lo hace viable en muchos más PCs que cualquier modelo de IA local anterior de Windows. El segundo: llega con pesos abiertos, y Microsoft se ha comprometido a publicarlo en abierto en Hugging Face en julio de 2026. Ya hay una vista previa accesible en los canales Insider de Microsoft Edge.
Aion 1.0 Plan es el hermano ambicioso. Microsoft lo describe como un modelo de razonamiento y uso de herramientas de 14.000 millones de parámetros con una ventana de contexto de 32K, capaz de ejecutar flujos de trabajo de agente directamente en el dispositivo: razonar sobre la intención, invocar herramientas, gestionar archivos e incluso orquestar subagentes, todo en local. La idea es que ese tipo de trabajo no tenga que salir del equipo: menos latencia, los archivos sensibles se quedan en la máquina y desaparece el coste de orquestación en la nube.
Por qué los modelos locales importan para los agentes
Muchas tareas útiles para un agente son locales por naturaleza: encontrar archivos, manipular documentos, interactuar con aplicaciones instaladas, leer el estado del sistema o repetir flujos que nunca necesitaron salir del equipo. Llevar el modelo a donde están los datos tiene cuatro ventajas claras que el sector lleva tiempo persiguiendo:
- Privacidad: los datos sensibles pueden quedarse en el dispositivo en lugar de viajar a servidores externos.
- Latencia: la ejecución local elimina el viaje de ida y vuelta por la red y permite respuestas casi instantáneas.
- Coste: menos procesamiento en la nube significa menos factura por tokens. Microsoft habla de «inteligencia sin contador» en el dispositivo.
- Funcionamiento sin conexión: las aplicaciones pueden seguir funcionando aunque no haya internet.
El dato que varias coberturas señalan como el más importante no es el de los 14.000 millones de parámetros, sino que la variante Instruct se ejecute en CPU. Casi todas las propuestas de IA en el dispositivo de 2026 llevan un asterisco de hardware: unas requieren silicio concreto, otras un PC con NPU. Si Instruct corre en cualquier Windows 11 con un procesador moderno, el número de equipos donde una aplicación puede ofrecer IA local crece de golpe.
Dónde encaja: una arquitectura por capas
Aion no plantea que toda la IA deba correr en local. Plantea que el sistema operativo sea lo bastante listo para decidir qué puede y qué debe ejecutarse en el dispositivo y qué sigue perteneciendo a la nube. La arquitectura que dibuja Microsoft tiene tres niveles: inteligencia local barata para el trabajo rutinario (Instruct), razonamiento local más pesado donde el hardware lo permita (Plan), y modelos en la nube para las tareas que aún necesitan escala de frontera. Es la misma lógica de orquestador y subagentes que vemos en la nube, pero con la opción de que parte ocurra puertas adentro del equipo. Junto a Aion, Microsoft amplió sus APIs de IA de Windows a CPU, GPU y NPU, e incorporó capacidades como el reconocimiento de voz en local.
Los límites de hoy (y lo que conviene no dar por hecho)
- Plan todavía no está disponible. Microsoft dice que llegará «en los próximos meses». Hoy lo que se puede probar es la vista previa de Instruct en los canales Insider de Edge; Plan es una promesa con fecha aproximada, no algo que puedas ejecutar ya.
- Las cifras las declara Microsoft. Los 14.000 millones de parámetros, los 32K de contexto y el resto de especificaciones provienen de los materiales de Microsoft del Build 2026. No hay verificación independiente ni hay todavía pruebas públicas de calidad del modelo.
- El hardware mínimo no está publicado. Microsoft habla de «dispositivos compatibles» con suficiente capacidad de NPU o GPU para ejecutar un modelo de 14.000 millones de parámetros a velocidad interactiva, pero no ha detallado los requisitos exactos de memoria o almacenamiento. Para un equipo de IT, esa falta de datos complica la planificación.
- La gobernanza empresarial está por aclarar. Si un modelo de 14.000 millones de parámetros se envía integrado en cada equipo nuevo, queda la pregunta de si los administradores podrán deshabilitarlo, configurarlo o auditarlo con las herramientas de gestión que ya usan. Microsoft no lo ha abordado en los materiales disponibles.
- Una corrección útil: en los días previos a Build circuló el rumor de un modelo de nube llamado «MAI-Thinking-1». No se anunció tal cosa; conviene no darlo por hecho.
Cómo probarlo hoy
- Para la variante Instruct, instala un canal Insider de Microsoft Edge y activa la función correspondiente para empezar a prototipar.
- Si te interesan los pesos abiertos, la cita es Hugging Face en julio de 2026 (es un compromiso con fecha, no una publicación ya hecha).
- Para Plan, de momento toca esperar: sigue el blog de desarrolladores de Windows para el anuncio de su disponibilidad.
Conclusión
Aion 1.0 es la señal más clara hasta ahora de que Microsoft quiere que el PC deje de ser solo un punto de acceso a la IA de la nube y pase a ser parte de la propia infraestructura de IA. Para los agentes, abre la puerta a que el razonamiento y la orquestación ocurran en local cuando tenga sentido. Pero hoy es sobre todo una declaración de dirección: la variante potente aún no está disponible, las cifras son las que da Microsoft sin verificación externa y faltan datos clave de hardware y gobernanza. La forma sensata de acercarse es probar lo que ya hay —la vista previa de Instruct—, seguir de cerca la llegada de Plan y medir con tus propios casos antes de diseñar nada crítico alrededor.
Artículo elaborado por Daniel Bellido. Las especificaciones citadas proceden de los materiales de Microsoft del Build 2026 y, salvo indicación, no cuentan todavía con verificación independiente.
Preguntas frecuentes
¿Qué es Aion 1.0?
Una familia de modelos de lenguaje pequeños de Microsoft, presentada en Build 2026, diseñada para ejecutarse localmente dentro de Windows sin llamar a la nube. Tiene dos variantes: Instruct y Plan.
¿Qué diferencia hay entre Aion 1.0 Instruct y Plan?
Instruct es un SLM ligero para tareas cotidianas (resumir, reescribir, detectar intención) que, según Microsoft, corre en CPU. Plan es un modelo de razonamiento y uso de herramientas de 14.000 millones de parámetros con 32K de contexto, pensado para flujos de agente locales.
¿Está disponible ya?
Hoy solo hay vista previa de la variante Instruct en los canales Insider de Microsoft Edge. Plan llegará, según Microsoft, «en los próximos meses». Los pesos abiertos de Instruct están comprometidos para Hugging Face en julio de 2026.
¿Por qué interesa un modelo local para los agentes?
Porque muchas tareas de un agente son locales por naturaleza (archivos, documentos, apps instaladas) y ejecutarlas en el dispositivo mejora la privacidad, la latencia y el coste, y permite funcionar sin conexión.
¿Qué hardware necesita Aion 1.0 Plan?
Microsoft habla de «dispositivos compatibles» con suficiente NPU o GPU para ejecutar un modelo de 14.000 millones de parámetros a velocidad interactiva, pero no ha publicado los requisitos mínimos exactos.
¿Las cifras de Aion están verificadas?
No de forma independiente. Provienen de los materiales de Microsoft del Build 2026 y, por ahora, no hay pruebas públicas de calidad ni verificación externa.

