Ga naar inhoud

Gemma-4-26B

In dit artikel

Informatie

Gemma-4-26B is een multimodal large language model van de volgende generatie van Google, beschikbaar voor lokale implementatie via Ollama. De Mixture of Experts (MoE) architectuur met 26 billion parameters, waarvan er slechts ~3,8B actief worden gebruikt per token, biedt prestaties die vergelijkbaar zijn met een 4B-model, terwijl het de intelligentie van veel grotere dense modellen behoudt. Het model ondersteunt een 256K context window, Thinking Mode, native function calling en beeldverwerking. Implementatie op Ubuntu 22.04 met Open WebUI-integratie zorgt voor volledige controle over gegevens en een gebruiksvriendelijke interface.

Belangrijkste kenmerken

  • Mixture of Experts (MoE) Architecture: Het model bevat 25,2B actieve parameters van de in totaal 26B; er worden slechts ~3,8B parameters per token geactiveerd; dit biedt de snelheid van een dense 4B-model met het intelligentieniveau van een 26B-model;
  • Multimodality: Native ondersteuning voor het verwerken van tekst- en beeldinvoer met tekstuele outputgeneratie;
  • Massive Context Window: Ondersteuning voor tot 256K tokens maakt het werken met lange documenten, grote codebases en complexe dialogen mogelijk;
  • Thinking Mode: Een aanpasbare redeningsmodus voor het oplossen van complexe logische en analytische taken;
  • Agentic Capabilities: Native ondersteuning voor function calling en gestructureerde output voor integratie met externe tools and API's;
  • Deployment Flexibility: De volledige versie vereist ~80GB VRAM, maar Q4-quantization maakt het mogelijk om het model op een 24GB GPU te draaien, terwijl geoptimaliseerde builds kunnen draaien op 16GB VRAM;
  • Open WebUI Integration: Een moderne webinterface voor interactie via poort 8080 met volledige controle over gegevens en verwerking van verzoeken;
  • Scalability: Ondersteuning voor multi-GPU-configuraties and load balancing over meerdere GPU's;
  • Security and Control: Lokale implementatie garandeert gegevensprivacy; de OLLAMA_HOST en OLLAMA_ORIGINS instellingen garanderen netwerkbeveiliging;
  • Performance: Gebruik van LLAMA_FLASH_ATTENTION en een efficiënte MoE-architectuur om de verwerking van verzoeken te versnellen;
  • Fault Tolerance: Ingebouwd automatisch restartsysteem voor containers en services om een stabiele werking te garanderen.

Implementatiekenmerken

ID Softwarenaam Compatibel OS VM BM VGPU GPU Min CPU (Kernen) Min RAM (GB) Min HDD/SSD (GB) Aangepast Domein Actief
644 Gemma-4-26b Ubuntu 22.04 + + + + 8 12 40 Nee BESTELLEN

Opmerking

Tenzij anders aangegeven, installeren we standaard de nieuwste releaseversie van de software vanaf de website van de ontwikkelaar of uit de repositories van het besturingssysteem.

Aan de slag na het implementeren van Gemma-4-26B

Nadat de betaling is voltooid, wordt er een melding naar het e-mailadres gestuurd dat tijdens de registratie is opgegeven zodra de server klaar is voor gebruik. Deze melding bevat het VPS IP-adres, de login en het wachtwoord voor de serververbinding, en een link om toegang te krijgen tot het Open WebUI paneel. Klanten kunnen hun hardware beheren in het Server Control Panel and APIInvapi.

  • Autorisatiegegevens voor toegang tot het besturingssysteem van de server (bijv. via SSH) worden per e-mail naar u verzonden.

  • Link om toegang te krijgen tot het Ollama control panel met de Open WebUI webinterface: te vinden onder de webpanel tag in de sectie Configuration >> Tags van het Invapi control paneel. De exacte link, geformatteerd als https://gemma26b<Server_ID_from_Invapi>.hostkey.com, wordt verzonden in de e-mail die bij de overdracht van de server wordt geleverd.

Na het klikken op de link van de webpanel tag, wordt het Get started with Open WebUI autorisatiewenster geopend, waar u een gebruikersnaam voor de administrator, e-mailadres en wachtwoord voor de chatbot moet aanmaken, en vervolgens op de Create Admin Account knop moet klikken:

Let op

Nadat de eerste gebruiker zich heeft geregistreerd, wijst het systeem deze automatisch de rol Administrator toe. Om de veiligheid en controle over het registratieproces te waarborgen, moeten alle daaropvolgende registratieverzoeken worden goedgekeurd in de Open WebUI-interface vanaf een administrator account.

Opmerking

Een gedetailleerde beschrijving van hoe u werkt met het Ollama control paneel en Open WebUI vindt u in het artikel AI Chatbot on Your Own Server.

Opmerking

Voor optimale prestaties wordt het aanbevolen om een GPU te gebruiken met meer dan de minimale vereiste van 24GB VRAM; dit biedt extra ruimte voor het verwerken van grote contexten en parallelle verzoeken. Gedetailleerde informatie over de kerninstellingen van Ollama en Open WebUI vindt u in de Ollama developer documentation and the Open WebUI developer documentation.

Een server bestellen met Gemma-4-26B via de API

Om deze software te installeren met behulp van de API, volgt u deze instructies.

question_mark
Is there anything I can help you with?
question_mark
AI Assistant ×