Saltar a contenido

Gemma-4-26B

En este artículo

Información

Gemma-4-26B es een modelo de lenguaje extenso multimodal de próxima generación de Google, disponible para despliegue local a través de Ollama. La arquitectura Mixture of Experts (MoE) con 26 mil millones de parámetros, donde solo aproximadamente 3.8B se utilizan activamente por token, proporciona un rendimiento comparable al de un modelo de 4B mientras mantiene la inteligencia de modelos densos mucho más grandes. El modelo admite una ventana de contexto de 256K, Thinking Mode, llamada a funciones nativa y procesamiento de imágenes. El despliegue en Ubuntu 22.04 con integración de Open WebUI garantiza un control total de los datos y una interfaz fácil de usar.

Características clave

  • Arquitectura Mixture of Experts (MoE): El modelo contiene 25,2B de parámetros activos de un total de 26B, activando solo ~3,8B de parámetros por token; esto proporciona la velocidad de un modelo denso de 4B con el nivel de inteligencia de un modelo de 26B;
  • Multimodalidad: Soporte nativo para procesar entrada de texto e imagen con generación de salida de texto;
  • Ventana de contexto masiva: El soporte para hasta 256K tokens permite trabajar con documentos largos, bases de código extensas y diálogos complejos;
  • Modo Thinking (Pensamiento): Un modo de razonamiento personalizable para resolver tareas lógicas y analíticas complejas;
  • Capacidades agénticas: Soporte nativo para la llamada a funciones (function calling) y salida estructurada para la integración con herramientas externas y APIs;
  • Flexibilidad de despliegue: La versión completa requiere ~80GB de VRAM, pero la cuantización Q4 permite ejecutar el modelo en una GPU de 24GB, mientras que las builds optimizadas pueden ejecutarse con 16GB de VRAM;
  • Integración con Open WebUI: Una interfaz web moderna para la interacción a través del puerto 8080 con control total sobre los datos y el procesamiento de solicitudes;
  • Escalabilidad: Soporte para configuraciones multi-GPU y equilibrado de carga entre varias GPUs;
  • Seguridad y control: El despliegue local garantiza la privacidad de los datos; los ajustes OLLAMA_HOST y OLLAMA_ORIGINS garantizan la seguridad de la red;
  • Rendimiento: Utilización de LLAMA_FLASH_ATTENTION y una arquitectura MoE eficiente para acelerar el procesamiento de solicitudes;
  • Tolerancia a fallos: Sistema de reinicio automático integrado para contenedores y servicios para garantizar un funcionamiento estable.

Funcionalidades de despliegue

ID Nombre del Software SO Compatible VM BM VGPU GPU CPU Mín. (Núcleos) RAM Mín. (GB) HDD/SSD Mín. (GB) Dominio Personalizado Activo
644 Gemma-4-26b Ubuntu 22.04 + + + + 8 12 40 No PEDIR

Nota

A menos que se especifique lo contrario, instalamos por defecto la versión de lanzamiento más reciente del software desde el sitio web del desarrollador o los repositorios del sistema operativo.

Primeros pasos tras el despliegue de Gemma-4-26B

Una vez completado el pago, se enviará una notificación a la dirección de correo electrónico proporcionada durante el registro cuando el servidor esté listo para operar. Esta notificación incluirá la dirección IP del VPS, el login y la contraseña para la conexión al servidor, y un enlace para acceder al panel Open WebUI. Los clientes pueden gestionar su hardware en el Server Control Panel y la APIInvapi.

  • Las credenciales de autorización para acceder al sistema operativo del servidor (por ejemplo, vía SSH) se le enviarán por correo electrónico.

  • Enlace para acceder al panel de control de Ollama con la interfaz web Open WebUI: ubicado bajo la etiqueta webpanel en la sección Configuración >> Tags del panel de control Invapi. El enlace exacto, con el formato https://gemma26b<Server_ID_from_Invapi>.hostkey.com, se envía en el correo electrónico entregado tras la entrega del servidor.

Tras hacer clic en el enlace de la etiqueta webpanel, se abrirá la ventana de autorización Get started with Open WebUI, donde deberá crear un nombre de usuario de administrador, correo electrónico y contraseña para el chatbot, y luego hacer clic en el botón Create Admin Account:

Atención

Después de que el primer usuario se registre, el sistema le asigna automáticamente el rol de Administrator. Para garantizar la seguridad y el control del proceso de registro, todas las solicitudes de registro posteriores deben ser aprobadas en la interfaz de Open WebUI desde una cuenta de administrador.

Nota

Puede encontrar una descripción detallada de cómo trabajar con el panel de control de Ollama y Open WebUI en el artículo AI Chatbot on Your Own Server.

Nota

Para un rendimiento óptimo, se recomienda utilizar una GPU con más de los 24GB de VRAM requeridos como mínimo; esto proporciona margen para procesar contextos grandes y solicitudes paralelas. Puede encontrar información detallada sobre la configuración principal de Ollama y Open WebUI en la Ollama developer documentation y en la Open WebUI developer documentation.

Pedir un servidor con Gemma-4-26B mediante la API

Para instalar este software utilizando la API, siga estas instrucciones.

question_mark
Is there anything I can help you with?
question_mark
AI Assistant ×