Saltar a contenido

Gemma-4-31B

En este artículo

Información

Gemma 4-31B es el modelo más grande y potente de la familia Gemma 4, diseñado para resolver las tareas más complejas. A diferencia de la versión MoE, este modelo utiliza una arquitectura Dense clásica con 30.7 mil millones de parámetros, lo que proporciona una estabilidad y profundidad de razonamiento excepcionales. El despliegue se basa en Ubuntu 22.04 y requiere recursos computacionales significativos: el funcionamiento completo requiere aproximadamente 62 GB de VRAM; sin embargo, con cuantización de 4 bits, el modelo funciona correctamente en sistemas con 20 GB de memoria. La integración con Open WebUI proporciona una interfaz conveniente para interactuar con el modelo manteniendo un control total sobre los datos.

Características principales

  • Arquitectura densa potente: El modelo es líder en la categoría de pesos abiertos densos (dense open-weights), ofreciendo la más alta calidad de generación y análisis;
  • Multimodalidad nativa: La arquitectura admite el procesamiento simultáneo de entradas de texto e imagen con salida de texto;
  • Ventana de contexto masiva: El soporte para hasta 256K tokens permite cargar repositorios de código enteros o documentos largos en memoria;
  • Modo de pensamiento: Elmodelo es capaz de generar pasos de razonamiento intermedios antes de formular la respuesta final;
  • Capacidades agénticas: El soporte integrado para la llamada a funciones nativa (native function calling) simplifica la creación de agentes de IA autónomos;
  • Integración con Open WebUI: Proporciona una interfaz web moderna para una interacción cómoda con el modelo a través del puerto 8080, garantizando un control total sobre los datos y el procesamiento de solicitudes;
  • Escalabilidad: Soporte para configuraciones multi-GPU y la capacidad de distribuir la carga entre varias GPUs para un rendimiento óptimo;
  • Seguridad y control: El despliegue local completo garantiza la privacidad de los datos, mientras que los ajustes OLLAMA_HOST y OLLAMA_ORIGINS garantizan la seguridad de la red;
  • Rendimiento: Utiliza la tecnología LLAMA_FLASH_ATTENTION para acelerar el procesamiento de solicitudes y optimizar el funcionamiento del modelo;
  • Tolerancia a fallos: Un sistema de reinicio automático integrado para contenedores y servicios garantiza un funcionamiento estable.

Características de despliegue

ID Nombre del Software SO Compatible VM BM VGPU GPU CPU Mín. (Núcleos) RAM Mín. (GB) HDD/SSD Mín. (GB) Dominio Personalizado Activo
647 Gemma-4-31b Ubuntu 22.04 + + + + 8 12 40 No PEDIR

Nota

A menos que se especifique lo contrario, instalamos por defecto la última versión de lanzamiento del software desde el sitio web del desarrollador o los repositorios del sistema operativo.

Primeros pasos tras desplegar Gemma-4-31B

Una vez completado el pago, se enviará una notificación sobre la preparación del servidor a la dirección de correo electrónico proporcionada durante el registro. Esta contendrá la dirección IP del VPS, el login y la contraseña para conectarse al servidor, y un enlace para acceder al panel Open WebUI. Los clientes gestionan su hardware a través del Server Control Panel and APIInvapi.

  • Las credenciales de autorización para acceder al sistema operativo del servidor (por ejemplo, vía SSH) se le enviarán por correo electrónico.

  • Enlace para acceder al panel de control de Ollama con la interfaz web Open WebUI: ubicado bajo la etiqueta webpanel en la pestaña Configuration >> Tags del panel de control Invapi. El enlace exacto, con el formato https://gemma31b<Server_ID_from_Invapi>.hostkey.com, se envía en el correo electrónico proporcionado tras la entrega del servidor.

Tras hacer clic en el enlace de la etiqueta webpanel, se abrirá la ventana de autorización Get started with Open WebUI, donde deberá crear un nombre de usuario de administrador, un correo electrónico y una contraseña para el chatbot, y luego hacer clic en el botón Create Admin Account:

Atención

Después de que el primer usuario se registre, el sistema le asigna automáticamente el rol de Administrator. لPara garantizar la seguridad y el control sobre el proceso de registro, todas las solicitudes de registro posteriores deben ser aprobadas en la interfaz de Open WebUI desde una cuenta de administrador.

Nota

Puede encontrar una descripción detallada de cómo trabajar con el panel de control de Ollama a través de Open WebUI en el artículo AI Chatbot on Your Own Server.

Nota

Para un rendimiento óptimo, se recomienda utilizar una GPU con más de los requisitos mínimos de 24 GB de VRAM, lo que proporciona margen para procesar contextos grandes y solicitudes paralelas. Puede encontrar información detallada sobre la configuración principal de Ollama y Open WebUI en la documentación para desarrolladores de Ollama y la documentación para desarrolladores de Open WebUI.

Pedir un servidor con Gemma-4-31B mediante la API

question_mark
Is there anything I can help you with?
question_mark
AI Assistant ×