Qwen 3.5
Modelo sucesor de Qwen 3 con línea MoE especializada de 35B a 122B.
Qwen 3.5 es una línea de modelos Mixture of Experts de Alibaba. Su arquitectura MoE activa pocos parámetros en cada token, permitiendo inferencia rápida en GPU ligera. El modelo 35B activa aproximadamente 3B–8B parámetros, consume menos VRAM que un modelo denso equivalente y mantiene calidad similar o superior a GPT-4o-mini. Admite contexto de 262K tokens, licencia Apache 2.0, instalación con Ollama y modo de razonamiento.
💻 Requisitos del sistema
35B MoE ~20 GB; 122B MoE ~81 GB con cuantización Q4.
35B ~20 GB; 122B ~81 GB.
⚡ Instalación
ollama run qwen3.5
🧬 Casos de uso en biociencias
Análisis de informes clínicos extensos
Cargue informes de fase III de más de 200 páginas en una ventana de 262K sin dividirlos en fragmentos.
Revisión de múltiples artículos
Compare simultáneamente 15 artículos y genere un borrador de metaanálisis identificando concordancias y contradicciones.
Pipeline multimodelo eficiente
Ejecute el modelo MoE junto con BGE-M3 en una sola GPU para realizar búsqueda y generación RAG.
FAQ
¿Qué es Qwen 3.5?
Qwen 3.5 es una línea de modelos Mixture of Experts de Alibaba. Su arquitectura MoE activa pocos parámetros en cada token, permitiendo inferencia rápida en GPU ligera. El modelo 35B activa aproximadamente 3B–8B parámetros, consume menos VRAM que un modelo denso equivalente y mantiene calidad similar o superior a GPT-4o-mini. Admite contexto de 262K tokens, licencia Apache 2.0, instalación con Ollama y modo de razonamiento.
¿Cuándo debería usar Qwen 3.5?
Modelo sucesor de Qwen 3 con línea MoE especializada de 35B a 122B.
¿Cuál es un caso de uso biomédico de Qwen 3.5?
Análisis de informes clínicos extensos: Cargue informes de fase III de más de 200 páginas en una ventana de 262K sin dividirlos en fragmentos.
📝 Notas de actualización
Aún no hay notas de actualización.
🧪 Código de la vida relacionado
Aún no hay publicaciones relacionadas de Código de la vida.