Gemma-4-31B¶
En este artículo
Información
Gemma 4-31B es el modelo más grande y potente de la familia Gemma 4, diseñado para resolver las tareas más complejas. A diferencia de la versión MoE, este modelo utiliza una arquitectura Dense clásica con 30.7 mil millones de parámetros, lo que proporciona una estabilidad y profundidad de razonamiento excepcionales. El despliegue se basa en Ubuntu 22.04 y requiere recursos computacionales significativos: el funcionamiento completo requiere aproximadamente 62 GB de VRAM; sin embargo, con cuantización de 4 bits, el modelo funciona correctamente en sistemas con 20 GB de memoria. La integración con Open WebUI proporciona una interfaz conveniente para interactuar con el modelo manteniendo un control total sobre los datos.
Características principales¶
- Arquitectura densa potente: El modelo es líder en la categoría de pesos abiertos densos (dense open-weights), ofreciendo la más alta calidad de generación y análisis;
- Multimodalidad nativa: La arquitectura admite el procesamiento simultáneo de entradas de texto e imagen con salida de texto;
- Ventana de contexto masiva: El soporte para hasta 256K tokens permite cargar repositorios de código enteros o documentos largos en memoria;
- Modo de pensamiento: Elmodelo es capaz de generar pasos de razonamiento intermedios antes de formular la respuesta final;
- Capacidades agénticas: El soporte integrado para la llamada a funciones nativa (native function calling) simplifica la creación de agentes de IA autónomos;
- Integración con Open WebUI: Proporciona una interfaz web moderna para una interacción cómoda con el modelo a través del puerto 8080, garantizando un control total sobre los datos y el procesamiento de solicitudes;
- Escalabilidad: Soporte para configuraciones multi-GPU y la capacidad de distribuir la carga entre varias GPUs para un rendimiento óptimo;
- Seguridad y control: El despliegue local completo garantiza la privacidad de los datos, mientras que los ajustes
OLLAMA_HOSTyOLLAMA_ORIGINSgarantizan la seguridad de la red; - Rendimiento: Utiliza la tecnología
LLAMA_FLASH_ATTENTIONpara acelerar el procesamiento de solicitudes y optimizar el funcionamiento del modelo; - Tolerancia a fallos: Un sistema de reinicio automático integrado para contenedores y servicios garantiza un funcionamiento estable.
Características de despliegue¶
| ID | Nombre del Software | SO Compatible | VM | BM | VGPU | GPU | CPU Mín. (Núcleos) | RAM Mín. (GB) | HDD/SSD Mín. (GB) | Dominio Personalizado | Activo |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 647 | Gemma-4-31b | Ubuntu 22.04 | + | + | + | + | 8 | 12 | 40 | No | PEDIR |
Nota
A menos que se especifique lo contrario, instalamos por defecto la última versión de lanzamiento del software desde el sitio web del desarrollador o los repositorios del sistema operativo.
Primeros pasos tras desplegar Gemma-4-31B¶
Una vez completado el pago, se enviará una notificación sobre la preparación del servidor a la dirección de correo electrónico proporcionada durante el registro. Esta contendrá la dirección IP del VPS, el login y la contraseña para conectarse al servidor, y un enlace para acceder al panel Open WebUI. Los clientes gestionan su hardware a través del Server Control Panel and API — Invapi.
-
Las credenciales de autorización para acceder al sistema operativo del servidor (por ejemplo, vía SSH) se le enviarán por correo electrónico.
-
Enlace para acceder al panel de control de Ollama con la interfaz web Open WebUI: ubicado bajo la etiqueta webpanel en la pestaña Configuration >> Tags del panel de control Invapi. El enlace exacto, con el formato
https://gemma31b<Server_ID_from_Invapi>.hostkey.com, se envía en el correo electrónico proporcionado tras la entrega del servidor.
Tras hacer clic en el enlace de la etiqueta webpanel, se abrirá la ventana de autorización Get started with Open WebUI, donde deberá crear un nombre de usuario de administrador, un correo electrónico y una contraseña para el chatbot, y luego hacer clic en el botón Create Admin Account:

Atención
Después de que el primer usuario se registre, el sistema le asigna automáticamente el rol de Administrator. لPara garantizar la seguridad y el control sobre el proceso de registro, todas las solicitudes de registro posteriores deben ser aprobadas en la interfaz de Open WebUI desde una cuenta de administrador.
Nota
Puede encontrar una descripción detallada de cómo trabajar con el panel de control de Ollama a través de Open WebUI en el artículo AI Chatbot on Your Own Server.
Nota
Para un rendimiento óptimo, se recomienda utilizar una GPU con más de los requisitos mínimos de 24 GB de VRAM, lo que proporciona margen para procesar contextos grandes y solicitudes paralelas. Puede encontrar información detallada sobre la configuración principal de Ollama y Open WebUI en la documentación para desarrolladores de Ollama y la documentación para desarrolladores de Open WebUI.