Installation
WivenLLM s'installe de trois manières. L'application est la même dans les trois cas ; ce qui change, c'est qui peut s'en servir et qui l'exploite.
Choisir son mode
| Poste de travail | Serveur | Instance hébergée | |
|---|---|---|---|
| Pour qui | Une personne | Une équipe, une entreprise | Une organisation sans équipe IT disponible |
| Multi-utilisateurs | Non | Oui | Oui |
| Widget web, API | Non | Oui | Oui |
| Exploitation | Aucune | À votre charge | Assurée pour vous |
| Données | Sur le poste | Sur votre serveur | Sur l'instance dédiée |
| Installation | Quelques minutes | Une demi-journée avec les réglages | Fournie prête à l'emploi |
Le mode multi-utilisateurs est ce qui déverrouille rôles, invitations, organisations, accès invité, widget web et clés d'API. Une installation sur poste reste mono-utilisateur par conception.
Poste de travail
Une application native pour Windows, macOS et Linux. Elle embarque tout : interface, serveur, extraction de documents, base de données, index vectoriel.
- Téléchargez l'application pour votre système d'exploitation.
- Installez-la comme n'importe quelle application.
- Lancez-la : l'assistant de première configuration s'ouvre.
Rien à configurer côté réseau, aucun port à ouvrir. Les données sont stockées dans votre profil utilisateur.
Prérequis matériels. L'application fonctionne sur une machine bureautique standard si vous utilisez un fournisseur de modèle externe. Pour exécuter un modèle localement, comptez au minimum 16 Go de mémoire vive ; une carte graphique dédiée change radicalement la vitesse. → Choisir ses modèles
Serveur — déploiement conteneurisé
C'est le mode recommandé pour une organisation. Il repose sur une image de conteneur unique et un fichier de configuration.
Principe
- Un seul conteneur porte l'application complète.
- Un volume persistant contient la base de données, les documents, les index et les modèles téléchargés. C'est le seul élément à sauvegarder.
- Le service écoute sur un port HTTP, que vous placez généralement derrière un reverse proxy assurant le TLS.
Étapes
- Préparer le volume de stockage sur l'hôte et lui donner les droits d'écriture nécessaires au conteneur.
- Créer le fichier de configuration à partir du modèle fourni. Trois valeurs sont obligatoires et doivent être des secrets aléatoires longs, propres à votre installation : - la clé de signature des sessions, - la clé et le sel de signature interne. Ne réutilisez jamais les valeurs d'exemple. → Variables d'environnement
- Démarrer le conteneur en montant le volume et en publiant le port.
- Ouvrir l'application dans un navigateur et suivre l'assistant de première configuration.
- Activer le mode multi-utilisateurs depuis
Réglages → Sécurité, puis créer les comptes ou envoyer des invitations.
Mise en production
Quelques points à traiter avant d'ouvrir l'accès :
- TLS. Placez un reverse proxy devant le service, ou activez HTTPS directement au niveau de l'application avec vos certificats.
- Sauvegarde. Sauvegardez le volume de stockage et le fichier de configuration. Les tester en restauration est le seul moyen de savoir qu'ils fonctionnent.
- Mise à jour. Une montée de version consiste à récupérer la nouvelle image et à redémarrer le conteneur en conservant le volume. Sauvegardez avant.
- Dimensionnement. Si les modèles s'exécutent sur la même machine, c'est eux qui déterminent le besoin en mémoire et en GPU — pas l'application.
Serveur — déploiement natif
Une installation sans conteneur est possible, notamment pour exploiter directement un GPU ou s'intégrer à une chaîne de déploiement existante. Elle suppose :
- un environnement d'exécution Node.js récent ;
- l'installation des trois services (interface compilée, serveur, service d'extraction) ;
- un gestionnaire de services pour les maintenir en fonctionnement ;
- un reverse proxy pour le TLS.
Ce mode demande davantage d'exploitation que le conteneur ; réservez-le aux cas où il apporte un bénéfice concret.
Instance hébergée
Une instance dédiée est provisionnée pour votre organisation, avec le même produit et les mêmes fonctionnalités. Vous recevez une URL et un compte administrateur ; l'exploitation, les sauvegardes et les mises à jour sont assurées.
C'est le mode adapté lorsque la souveraineté des données est requise mais que l'organisation ne souhaite pas exploiter l'infrastructure elle-même.
Après l'installation
Dans l'ordre :
- Assistant de première configuration — choix du fournisseur de modèle, du moteur d'embeddings et de la base vectorielle, création du compte administrateur et du premier espace de travail.
- Premiers pas — importer un document et poser une première question.
- Utilisateurs et rôles — passage en multi-utilisateurs et création des comptes.
- Sécurité et confidentialité — revue de ce qui sort du réseau, sauvegardes, contrôle des accès.
Problèmes fréquents au démarrage
| Symptôme | Cause habituelle |
|---|---|
| L'application démarre mais l'interface reste vide | L'interface n'atteint pas le serveur : vérifiez le port publié et l'adresse configurée |
| « Aucun fournisseur configuré » | L'assistant n'a pas été terminé, ou la clé du fournisseur est absente ou invalide |
| Les documents s'importent mais restent introuvables | Ils ont été extraits sans être ajoutés à l'espace de travail — l'ajout déclenche l'indexation |
| Les réponses ignorent un document ajouté | L'indexation est encore en cours, ou le moteur d'embeddings a changé depuis l'indexation |
| Perte des réglages au redémarrage | Le volume de stockage n'est pas persistant |
| Un modèle local ne démarre pas | Mémoire insuffisante pour la taille choisie → Choisir ses modèles |
