
Conoce Qwen3.6 35B-A3B: el modelo open-source que ejecuta esta instancia.
Quizás hayas notado la información del modelo en la parte inferior de esta página. No es una API propietaria, no depende de la nube ni requiere suscripción. Es Qwen3.6 35B-A3B, un modelo de lenguaje open-source que se ejecuta localmente en este hardware.
¿Qué es Qwen3.6 35B-A3B?
Qwen3.6 es un modelo de 35 mil millones de parámetros desarrollado por el equipo Qwen de Alibaba. El sufijo "A3B" indica una arquitectura de Mezcla de Expertos (MoE) donde solo 3.500 millones de parámetros se activan por generación de token. Esta es la diferencia clave con los modelos densos: ofrece rendimiento comparable a modelos mucho más grandes mientras requiere significativamente menos capacidad de cómputo.
En esta instancia, el modelo se ejecuta con 22 CPUs activos, soporta una ventana de contexto de 64K tokens, y se sirve mediante llama.cpp — el mismo motor de inferencia de alto rendimiento que impulsa despliegues locales de LLM en todo el mundo.
Por qué importa el open-source
Los modelos propietarios requieren enviar tus datos a un tercero. Los modelos open-source como Qwen3.6 pueden ejecutarse completamente en tu infraestructura. Esto significa:
- Sin fugas de datos — tus prompts, tu código y tu lógica de negocio permanecen en tu infraestructura
- Sin facturas de API — una vez que el modelo está ejecutándose, los costes de inferencia son solo electricidad
- Sin límites de velocidad — genera todo lo que necesites sin preocuparte por los throttles
- Personalización total — ajusta, cuantiza o modifica el modelo para adaptarlo a tus necesidades
Características de rendimiento
Los 35 mil millones de parámetros con arquitectura MoE sitúan a Qwen3.6 en un punto dulce práctico: lo suficientemente potente para razonamiento complejo, generación de código y análisis técnico, pero eficiente para ejecutarse en hardware convencional. La ventana de contexto de 64K maneja documentos largos, conversaciones multironda y especificaciones técnicas detalladas sin truncamiento.
Este es el modelo que impulsa la asistencia de IA que estás experimentando ahora mismo — de forma transparente, local, y sin externalizar la inteligencia a un proveedor de nube.