Aller au contenu

Gemma-4-26B

Dans cet article

Information

Gemma-4-26B est ein modèle de langage multimodal de nouvelle génération de Google, disponible pour un déploiement local via Ollama. L'architecture Mixture of Experts (MoE) avec 26 milliards de paramètres, dont seulement environ 3,8 Md sont utilisés activement par jeton, offre des performances comparables à un modèle 4B tout en conservant l'intelligence de modèles denses beaucoup plus grands. Le modèle prend en charge une fenêtre de contexte de 256K, le mode Thinking Mode, l'appel de fonctions natif et le traitement d'images. Un déploiement sur Ubuntu 22.04 avec intégration Open WebUI garantit un contrôle total des données et une interface conviviale.

Caractéristiques principales

  • Architecture Mixture of Experts (MoE) : Le modèle contient 25,2 Md de paramètres actifs sur un total de 26 Md, n'activant qu'environ 3,8 Md de paramètres par jeton ; cela offre la vitesse d'un modèle dense 4B avec le niveau d'intelligence d'un modèle 26B ;
  • Multimodalité : Prise en charge native du traitement des entrées texte et image avec génération de sorties textuelles ;
  • Fenêtre de contexte massive : La prise en charge jusqu'à 256K jetons permet de travailler sur de longs documents, de grandes bases de code et des dialogues complexes ;
  • Thinking Mode : Un mode de raisonnement personnalisable pour résoudre des tâches logiques et analytiques complexes ;
  • Capacités agentique : Prise en charge native de l'appel de fonctions (function calling) et de la sortie structurée pour l'intégration avec des outils et API externes ;
  • Flexibilité de déploiement : La version complète nécessite environ 80 Go de VRAM, mais la quantification Q4 permet de faire fonctionner le modèle sur un GPU de 24 Go, tandis que les builds optimisés peuvent fonctionner sur 16 Go de VRAM ;
  • Intégration Open WebUI : Une interface web moderne pour l'interaction via le port 8080 avec un contrôle total sur les données et le traitement des requêtes ;
  • Scalabilité : Prise en charge des configurations multi-GPU et de l'équilibrage de charge sur plusieurs GPU ;
  • Sécurité et contrôle : Le déploiement local garantit la confidentialité des données ; les paramètres OLLAMA_HOST et OLLAMA_ORIGINS garantissent la sécurité du réseau ;
  • Performance : Utilisation de LLAMA_FLASH_ATTENTION et d'une architecture MoE efficace pour accélérer le traitement des requêtes ;
  • Tolance aux pannes : Système de redémarrage automatique intégré pour les conteneurs et les services afin d'assurer un fonctionnement stable.

Fonctionnalités de déploiement

ID Nom du logiciel Système d'exploitation compatible VM BM VGPU GPU Min CPU (Cœurs) Min RAM (GB) Min HDD/SSD (GB) Domaine personnalisé Actif
644 Gemma-4-26b Ubuntu 22.04 + + + + 8 12 40 Non COMMANDER

Information

Vous pouvez trouver des informations concernant les fonctionnalités de déploiement de ce logiciel à ce lien.

Remarque

Sauf indication contraire, nous installons par défaut la dernière version de la release du logiciel depuis le site web du développeur ou les dépôts du système d'exploitation.

Prise en main après le déploiement de Gemma-4-26B

Une fois le paiement effectué, une notification sera envoyée à l'adresse e-mail fournie lors de l'inscription dès que le serveur est prêt à fonctionner. Cette notification comprendra l'adresse IP du VPS, l'identifiant et le mot de passe pour la connexion au serveur, ainsi qu'un lien pour accéder au panneau Open WebUI. Les clients peuvent gérer leur matériel dans le Server Control Panel and APIInvapi.

  • Les identifiants d'autorisation pour accéder au système d'exploitation du serveur (par exemple, via SSH) vous seront envoyés par e-mail.

  • Le lien pour accéder au panneau de contrôle Ollama avec l'interface web Open WebUI : situé sous la balise webpanel dans la section Configuration >> Tags du panneau de contrôle Invapi. Le lien exact, formaté comme https://gemma26b<Server_ID_from_Invapi>.hostkey.com, est envoyé dans l'e-mail remis lors de la remise du serveur.

Après avoir cliqué sur le lien de la balise webpanel, la fenêtre d'autorisation Get started with Open WebUI s'ouvrêra, où vous devrez créer un nom d'utilisateur administrateur, une adresse e-mail et un mot de passe pour le chatbot, puis cliquer sur Create Admin Account :

Attention

Après l'enregistrement du premier utilisateur, le système lui attribue automatiquement le rôle d'Administrateur. Pour garantir la sécurité et le contrôle du processus d'inscription, toutes les demandes d'inscription ultérieures doivent être approuvées dans l'interface Open WebUI à partir d'un compte administrateur.

Remarque

Une description détaillée de la manière de travailler avec le panneau de contrôle Ollama et Open WebUI est disponible dans l'article AI Chatbot on Your Own Server.

Remarque

Pour des performances optimales, il est recommandé d'utiliser un GPU avec une capacité supérieure au minimum requis de 24 Go de VRAM ; cela offre une marge pour le traitement de contextes volumineux et de requêtes parallèles. Des informations détaillées concernant les paramètres de base d'Ollama et d'Open WebUI peuvent être trouvées dans la documentation développeur Ollama et sa documentation développeur Open WebUI.

Commande d'un serveur avec Gemma-4-26B via l'API

Pour installer ce logiciel en utilisant l'API, suivez les instructions suivantes.