Aller au contenu

Phi-4-14b

Dans cet article

Information

Phi4-14b est un modèle de langage moderne adapté pour une utilisation locale via la plateforme Ollama. Cette solution combine les performances du modèle Phi-4 avec la commodité d'utilisation d'Open Web UI. Le système est déployé sur Ubuntu 22.04 et nécessite un accélérateur graphique moderne pour un fonctionnement efficace. La combinaison d'Ollama et d'Open Web UI crée une solution locale complète pour travailler avec l'intelligence artificielle, offrant un contrôle total sur les données et le processus de traitement des requêtes.

Fonctionnalités principales de Phi-4-14b

  • Architecture de base puissante : le modèle possède 14 milliards de paramètres et une fenêtre de contexte de 16 mille tokens, ce qui lui permet de traiter des textes longs et des tâches complexes avec une grande précision ;

  • Interface Open Web UI pratique : fournit une interface web moderne pour interagir avec le modèle, incluant l'historique du chat, les paramètres de configuration et la gestion de différents modèles dans une interface unique ;

  • Capacités RAG avancées : prise en charge intégrée de la recherche de documents dans divers formats (PDF, PPT, fichiers texte) et du web scraping, permettant au modèle de travailler avec des informations actuelles et des données utilisateur ;

  • Multitâche : le modèle gère efficacement diverses tâches, notamment la gestion de dialogue, la réponse à des questions, l'analyse de données, la création de textes et la programmation de base ;

  • Sécurité et précision : le modèle a subi un entraînement multi-étapes prenant en compte les préférences des utilisateurs sous supervision experte, garantissant une grande précision des réponses, le respect des normes éthiques et le suivi des instructions utilisateur ;

  • Ouverture et flexibilité : grâce au code source ouvert d'Ollama, le système peut être configuré et modifié pour des besoins spécifiques, y compris l'intégration avec d'autres outils et services ;

  • Prise en charge de divers types de données : le modèle est capable de travailler avec des données textuelles, du code, ainsi que des données structurées et semi-structurées, étendant son applicabilité dans divers domaines.

  • Exemples d'utilisation :

    • Support client : automatisation des réponses aux questions des utilisateurs ;

    • Éducation : création de supports pédagogiques, aide à la résolution de tâches ;

    • Marketing : génération de textes publicitaires, analyse d'avis ;

    • Développement logiciel : création et documentation de code.

Fonctionnalités de déploiement

ID Nom du logiciel Système d'exploitation compatible VM BM VGPU GPU Min CPU (Cœurs) Min RAM (GB) Min HDD/SSD (GB) Domaine personnalisé Actif
256 Phi-4-14b Ubuntu 22.04 - - + + 4 16 - Non COMMANDER
  • Le serveur Ollama charge et exécute le LLM en mémoire ;
  • Open WebUI est déployé en tant qu'application web connectée au serveur Ollama ;
  • Les utilisateurs interagissent avec le LLM via l'interface web Open WebUI, envoyant des requêtes et recevant des réponses ;
  • Tous les calculs et le traitement des données s'effectuent localement sur le serveur. Les administrateurs peuvent configurer le LLM pour des tâches spécifiques via les outils d'OpenWebUI.

Configuration requise et caractéristiques techniques

  • Accélérateur graphique : NVIDIA A4000 (ou plus puissant) ou un équivalent AMD avec au moins 16 Go de mémoire vidéo ;

  • Espace disque : suffisant pour l'installation du système, des pilotes et du modèle ;

  • Pilotes : pilotes NVIDIA et CUDA pour un fonctionnement correct du GPU ;

  • Consommation de la mémoire vidéo : 12 Go avec un contexte de 2K tokens ;

  • Redémarrage automatique : le redémarrage automatique du conteneur est configuré en cas de défaillance ;

  • Support GPU : intégration complète avec NVIDIA CUDA pour des performances maximales.

Prise en main après le déploiement de Phi-4-14b

Après le paiement, une notification de commande sera envoyée à l'adresse e-mail spécifiée lors de l'inscription indiquant que le serveur est prêt à être utilisé. Elle inclura l'adresse IP du VPS, ainsi que l'identifiant et le mot de passe pour se connecter au serveur et un lien pour accéder au panneau OpenWebUI. Les clients de notre entreprise gèrent leur équipement dans le panneau de gestion du serveur et de contrôle APIInvapi.

  • Les données d'identification pour l'accès au système d'exploitation du serveur (par exemple, via SSH) vous seront envoyées dans l'e-mail reçu.

  • Lien pour l'accès au panneau de gestion Ollama avec l'interface web Open WebUI : dans le tag webpanel sous l'onglet Configuration >> Tags du panneau de contrôle Invapi. Le lien exact au format https://phi<Server_ID_from_Invapi>.hostkey.in sera envoyé par e-mail lors de la livraison du serveur.

Après avoir cliqué sur le lien dans le tag webpanel, une fenêtre de connexion Get started with Open WebUI s'ouvrira, où vous devrez créer un nom de compte administrateur, une adresse e-mail et un mot de passe pour votre chatbot, puis appuyez sur le bouton Create Admin Account :

Attention

Après l'enregistrement du premier utilisateur, le système lui attribue automatiquement un rôle d'administrateur. Pour garantir la sécurité et le contrôle du processus d'inscription, toutes les demandes d'inscription ultérieures doivent être approuvées dans OpenWebUI depuis le compte administrateur.

Remarque

Une description détaillée des fonctionnalités de travail avec le panneau de gestion Ollama via Open WebUI est disponible dans l'article AI Chatbot on Your Own Server

Remarque

Il est recommandé d'utiliser un GPU avec plus que la configuration minimale de 16 Go de mémoire vidéo pour un fonctionnement optimal, offrant une marge pour le traitement de contextes volumineux et de requêtes parallèles. Des informations détaillées sur les paramètres principaux d'Ollama et d'Open WebUI peuvent être trouvées dans la documentation des développeurs d'Ollama et dans la documentation des développeurs d'Open WebUI.

Commander un serveur avec Phi-4-14b via l'API

Pour installer ce logiciel en utilisant l'API, suivez les instructions suivantes.