Qwen3-32B¶
En este artículo
Información
Qwen3-32B es een modelo de lenguaje avanzado de próxima generación de la serie Qwen que requiere recursos computacionales significativos para su implementación local a través de la plataforma Ollama. La implementación se basa en sistemas modernos que utilizan aceleradores gráficos NVIDIA. La integración con Open Web UI proporciona una interfaz conveniente para interactuar con el modelo manteniendo el control total sobre los datos.
Funcionalidades principales de Qwen3-32B¶
- Arquitectura multilingüe: El modelo tiene 32 mil millones de parámetros y admite 119 idiomas y dialectos, entrenados con 36 billones de palabras, lo que garantiza la comprensión de los matices culturales y una traducción de alta calidad;
- Modos de operación: Optimizado tanto para el razonamiento profundo (modo thinking) como para respuestas rápidas (modo non-thinking), lo que permite la adaptación a varios tipos de tareas;
- Integración con Open Web UI: Proporciona una interfaz web moderna para una interacción cómoda con el modelo a través del puerto 8080, garantizando el control total sobre los datos y el procesamiento de las solicitudes;
- Escalabilidad: Admite diferentes niveles de cuantización (FP16, 8-bit, 4-bit) para la optimización del uso de memoria dependiendo de los recursos disponibles;
- Seguridad y control: La implementación local completa garantiza la confidencialidad de los datos, mientras que los ajustes OLLAMA_HOST y OLLAMA_ORIGINS garantizan la seguridad de la red;
- Alto rendimiento: Alcanza alrededor de 34 tokens por segundo en GPUs de consumo de alto rendimiento, lo que hace que el modelo sea viable para uso local;
- Tolerancia a fallos: Un sistema integrado de reinicio automático de contenedores y servicios garantiza un funcionamiento estable.
- Ejemplos de uso:
- Atención al cliente: Automatización de respuestas a las preguntas de los usuarios con soporte para múltiples idiomas;
- Educación: Creación de materiales educativos, asistencia en la resolución de tareas complejas;
- Programación: Generación y análisis de código con soporte para varios lenguajes de programación;
- Contenido multilingüe: Creación y traducción de textos considerando las especificidades culturales.
Funcionalidades de implementación¶
| ID | Nombre del Software | SO Compatible | VM | BM | VGPU | GPU | CPU Mín. (Núcleos) | RAM Mín. (GB) | HDD/SSD Mín. (GB) | Dominio Personalizado | Activo |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 334 | qwen3:32b | Ubuntu 22.04 | - | - | + | + | 4 | 64 | - | No | PEDIR |
Información
Para obtener información sobre las funcionalidades de implementación de este software, consulte este enlace.
- El servidor Ollama carga y ejecuta el LLM en memoria;
- Open WebUI se despliega como una aplicación web conectada al servidor Ollama;
- Los usuarios interactúan con el LLM a través de la interfaz web de Open WebUI, enviando solicitudes y recibiendo respuestas;
- Todos los cálculos y el procesamiento de datos ocurren localmente en el servidor. Los administradores pueden configurar el LLM para tareas específicas a través de las herramientas de OpenWebUI.
Primeros pasos tras implementar Qwen3-32B¶
Tras el pago del pedido al correo electrónico especificado durante el registro, se enviará una notificación sobre la preparación del servidor para trabajar. Esta incluirá la dirección IP del VPS, así como el login y la contraseña para conectarse al servidor y un enlace para acceder al panel OpenWebUI. Los clientes de nuestra empresa gestionan el equipo en el server management panel y API — Invapi.
- Los datos de autenticación para el acceso al sistema operativo del servidor (por ejemplo, vía SSH) se le enviarán en el correo electrónico recibido.
- Enlace para acceder al panel de gestión de Ollama con la interfaz web de Open WebUI: en la etiqueta webpanel en la pestaña Configuration >> Tags del panel de control Invapi. El enlace exacto con el formato
https://qwen3-32b<Server_ID_from_Invapi>.hostkey.inse envía por correo electrónico tras la entrega del servidor.
Tras hacer clic en el enlace de la etiqueta webpanel, se abrirá una ventana de inicio de sesión Get started with Open WebUI, donde deberá crear un nombre de cuenta de administrador, correo electrónico y contraseña para su chatbot, y luego presionar el botón Create Admin Account:

Atención
Tras registrar al primer usuario, el sistema le asigna automáticamente un rol de administrador. Para garantizar la seguridad y el control sobre el proceso de registro, todas las solicitudes de registro posteriores deben ser aprobadas en OpenWebUI desde la cuenta de administrador.
Tras completar el registro con éxito, se abrirá la interfaz principal de Open WebUI:

Nota
Puede encontrar una descripción detallada de las funcionalidades para trabajar con el panel de gestión de Ollama con Open WebUI en el artículo AI Chatbot on Your Own Server
Nota
Para un funcionamiento óptimo, se recomienda utilizar una GPU con más de los requisitos mínimos de 16 GB de memoria de vídeo, lo que proporcionará un búfer para procesar contextos grandes y solicitudes paralelas. Puede encontrar información detallada sobre la configuración principal de Ollama y Open WebUI en la documentación para desarrolladores de Ollama y en la documentación para desarrolladores de Open WebUI.
Pedir un servidor con Qwen3-32B mediante API¶
Para instalar este software utilizando la API, siga estas instrucciones.