Qwen3-32B¶
Dans cet article
Information
Qwen3-32B est un modèle de langage de nouvelle génération avancé de la série Qwen qui nécessite des ressources de calcul importantes pour un déploiement local via la plateforme Ollama. Le déploiement repose sur des systèmes modernes utilisant des accélérateurs graphiques NVIDIA. L'intégration avec Open Web UI fournit une interface pratique pour interagir avec le modèle tout en conservant un contrôle total sur les données.
Principales fonctionnalités de Qwen3-32B¶
- Architecture multilingue : Le modèle possède 32 milliards de paramètres et prend en charge 119 langues et dialectes, entraîné sur 36 billions de mots, garantissant une compréhension des nuances culturelles et une traduction de haute qualité ;
- Modes de fonctionnement : Optimisé à la fois pour le raisonnement profond (mode thinking) et pour les réponses rapides (mode non-thinking), permettant une adaptation à différents types de tâches ;
- Intégration avec Open Web UI : Fournit une interface web moderne pour une interaction pratique avec le modèle via le port 8080, garantissant un contrôle total sur les données et le traitement des requêtes ;
- Évolutivité : Prend en charge différents niveaux de quantification (FP16, 8-bit, 4-bit) pour l'optimisation de l'utilisation de la mémoire en fonction des ressources disponibles ;
- Sécurité et contrôle : Un déploiement local complet garantit la confidentialité des données, tandis que les paramètres OLLAMA_HOST et OLLAMA_ORIGINS garantissent la sécurité du réseau ;
- Haute performance : Atteint environ 34 tokens par seconde sur des GPU grand public haute performance, rendant le modèle viable pour une utilisation locale ;
- Tolérance aux pannes : Un système intégré de redémarrage automatique des conteneurs et des services assure un fonctionnement stable.
- Exemples d'utilisation :
- Support client : Automatisation des réponses aux questions des utilisateurs avec prise en charge de plusieurs langues ;
- Éducation : Création de matériel pédagogique, aide à la résolution de tâches complexes ;
- Programmation : Génération et analyse de code avec prise en charge de divers langages de programmation ;
- Contenu multilingue : Création et traduction de textes tenant compte des spécificités culturelles.
Fonctionnalités de déploiement¶
| ID | Nom du logiciel | Système d'exploitation compatible | VM | BM | VGPU | GPU | Min CPU (Cœurs) | Min RAM (GB) | Min HDD/SSD (GB) | Domaine personnalisé | Actif |
|---|---|---|---|---|---|---|---|---|---|---|---|
| 334 | qwen3:32b | Ubuntu 22.04, Ubuntu 24.04 | - | - | + | + | 4 | 64 | - | Non | COMMANDER |
- Le serveur Ollama charge et exécute le LLM en mémoire ;
- Open WebUI est déployé en tant qu'application web connectée au serveur Ollama ;
- Les utilisateurs interagissent avec le LLM via l'interface web Open WebUI, en envoyant des requêtes et en recevant des réponses ;
- Tous les calculs et le traitement des données s'effectuent localement sur le serveur. Les administrateurs peuvent configurer le LLM pour des tâches spécifiques via les outils OpenWebUI.
Prise en main après le déploiement de Qwen3-32B¶
Après le paiement de la commande à l'adresse e-mail spécifiée lors de l'inscription, une notification concernant la disponibilité du serveur pour le travail sera envoyée. Elle inclura l'adresse IP du VPS, ainsi que l'identifiant et le mot de passe pour se connecter au serveur et un lien pour accéder au panneau OpenWebUI. Les clients de notre entreprise gèrent l'équipement dans le panneau de gestion du serveur et l'API — Invapi.
- Les données d'authentification pour l'accès au système d'exploitation du serveur (par exemple, via SSH) vous seront envoyées dans l'e-mail reçu.
- Lien pour accéder au panneau de gestion Ollama avec l'interface web Open Web UI : dans le tag webpanel dans l'onglet Configuration >> Tags du panneau de contrôle Invapi. Le lien exact sous la forme
https://qwen3-32b<Server_ID_from_Invapi>.hostkey.inest envoyé par e-mail lors de la livraison du serveur.
Après avoir cliqué sur le lien du tag webpanel, une fenêtre de connexion Get started with Open WebUI s'ouvrira, où vous devrez créer un nom de compte administrateur, une adresse e-mail et un mot de passe pour votre chatbot, puis appuyez sur le bouton Create Admin Account :

Attention
Après l'enregistrement du premier utilisateur, le système lui attribue automatiquement un rôle d'administrateur. Pour garantir la sécurité et le contrôle du processus d'inscription, toutes les demandes d'inscription ultérieures doivent être approuvées dans OpenWebUI depuis le compte administrateur.
Une fois l'enregistrement réussi, l'interface principale d'Open WebUI s'ouvrira :

Remarque
Une description détaillée des fonctionnalités de travail avec le panneau de gestion Ollama avec Open WebUI peut être trouvée dans l'article AI Chatbot on Your Own Server
Remarque
Pour un fonctionnement optimal, il est recommandé d'utiliser un GPU avec plus que la configuration minimale de 16 Go de mémoire vidéo, ce qui fournira une marge pour le traitement de contextes volumineux et de requêtes parallèles. Des informations détaillées sur les paramètres principaux d'Ollama et d'Open WebUI peuvent être trouvées dans la documentation des développeurs d'Ollama et dans la documentation des développeurs d'Open WebUI.
Commander un serveur avec Qwen3-32B via l'API¶
Pour installer ce logiciel en utilisant l'API, suivez les instructions suivantes.