Gemma-4-26B¶
Bu makalede
Bilgi
Gemma-4-26B, Google tarafından geliştirilen ve Ollama aracılığıyla yerel olarak çalıştırılabilen yeni nesil multimodal bir büyük dil modelidir. 26 milyar parametreli Mixture of Experts (MoE) mimarisi sayesinde, her token için yalnızca ~3.8B parametre aktif olarak kullanılarak, çok daha büyük yoğun (dense) modellerin zekasını korurken 4B'lik bir modelle kıyaslanabilir performans sunar. Model; 256K context window, Düşünme Modu (Thinking Mode), yerel fonksiyon çağırma ve görüntü işleme özelliklerini destekler. Ubuntu 22.04 üzerinde Open WebUI entegrasyonu ile çalıştırma, tam veri kontrolü ve kullanıcı dostu bir arayüz sağlar.
Temel Özellikler¶
- Mixture of Experts (MoE) Mimarisi: Model, toplam 26B parametrenin 25.2B'sini içerir ancak her token için yalnızca ~3.8B parametreyi etkinleştirir; bu da 26B bir modelin zeka seviyesini sunarken 4B yoğun bir modelin hızını sağlar;
- Multimodality: Metin ve görüntü girdilerini işleme ve metin çıktısı üretme konusunda yerel destek;
- Devasa Context Window: 256K token'a kadar destek, uzun dokümanlar, büyük kod tabanları ve karmaşık diyaloglarla çalışmaya olanak tanır;
- Düşünme Modu (Thinking Mode)): Karmaşık mantıkal ve analitik görevleri çözmek için özelleştirilebilir bir muhakeme modu;
- Agentic Yetenekler: Harici araçlar ve API'ler ile entegrasyon için fonksiyon çağırma ve yapılandırılmış çıktı için yerel destek;
- Çalıştırma Esnekliği: Tam sürüm ~80GB VRAM gerektirir, ancak Q4 kuantizasyonu modelin 24GB GPU üzerinde çalışmasına olanak tanırken, optimize edilmiş sürümler 16GB VRAM ile çalışabilir;
- Open WebUI Entegrasyonu: Veri ve istek işleme üzerinde tam kontrol sağlayan, port 8080 üzerinden etkileşim için modern bir web arayüzü;
- Ölçeklenebilirlik: Çoklu GPU konfigürasyonları ve birkaç GPU arasında yük dengeleme desteği;
- Güvenlik ve Kontrol: Yerel çalıştırma veri gizliliğini sağlar;
OLLAMA_HOSTveOLLAMA_ORIGINSayarları ağ güvenliğini garanti eder; - Performans: İstek işlemeyi hızlandırmak için
LLAMA_FLASH_ATTENTIONkullanımı ve verimli MoE mimarisi; - Hata Toleransı: Kararlı çalışma sağlamak için konteynerler ve servisler için yerleşik otomatik yeniden başlatma sistemi.
Çalıştırma Özellikleri¶
| ID | Yazılım Adı | Uyumlu OS | VM | BM | VGPU | GPU | Min CPU (Çekirdekler) | Min RAM (GB) | Min HDD/SSD (GB) | Özel Alan Adı | Aktif |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 644 | Gemma-4-26b | Ubuntu 22.04 | + | + | + | + | 8 | 12 | 40 | Hayır | SİPARİŞ VER |
Not
Aksi belirtilmedikçe, varsayılan olarak yazılımın en son sürümünü geliştiricinin web sitesinden veya işletim sistemi depolarından yükleriz.
Gemma-4-26B Çalıştırıldıktan Sonra Başlangıç¶
Ödeme tamamlandıktan sonra, sunucu çalışmaya hazır olduğunda kayıt sırasında verilen e-posta adresine bir bildirim gönderilecektir. Bu bildirim; VPS IP adresi, sunucu bağlantısı için giriş ve password bilgilerini ve Open WebUI paneline erişim için bir bağlantı içerecektir. Müşteriler donanımlarını Server Control Panel and API — Invapi üzerinden yönetebilirler.
-
Sunucu işletim sistemine erişim için yetkilendirme bilgileri (örneğin SSH yoluyla) size bir e-posta ile gönderilecektir.
-
Open WebUI web arayüzü ile Ollama kontrol paneline erişim bağlantısı: Invapi kontrol panelinin Configuration >> Tags bölümünde webpanel etiketi altında bulunur.
https://gemma26b<Invapi'den gelen_Server_ID>.hostkey.comşeklinde formatlanmış tam bağlantı, sunucu teslimatı sırasında gönderilen e-postada yer alır.
webpanel etiketindeki bağlantıya tıkladıktan sonra, chatbot için bir yönetici kullanıcı adı, e-posta ve password oluşturmanız gereken Get started with Open WebUI yetkilendirme penceresi açılacaktır; ardından Create Admin Account düğmesine tıklayın:

Dikkat
İlk kullanıcı kayıt olduktan sonra, sistem onlara otomatik olarak Administrator rolünü atar. Kayıt süreci üzerinde güvenlik ve kontrol sağlamak için, sonraki tüm kayıt isteklerinin Open WebUI arayüzünde bir yönetici hesabı üzerinden onaylanması gerekir.
Not
Ollama kontrol paneli ve Open WebUI ile nasıl çalışılacağına dair ayrıntılı açıklama Kendi Sunucunuzdaki AI Chatbot makalesinde bulunabilir.
Not
Optimal performans için, minimum 24GB VRAM gereksiniminden daha fazla VRAM'e sahip bir GPU kullanılması önerilir; bu, büyük bağlamların ve paralel isteklerin işlenmesi için ek alan sağlar. Temel Ollama ve Open WebUI ayarlarıyla ilgili ayrıntılı bilgiler Ollama geliştirici dokümantasyonunda ve Open WebUI geliştirici dokümantasyonunda bulunabilir.
API ile Gemma-4-26B Sunucusu Sipariş Etme¶
Bu yazılımı API kullanarak kurmak için bu talimatları izleyin.