Fournisseurs supportés
La liste exacte des fournisseurs disponibles dans votre version est celle qu'affichent les écrans de réglages. Cette page donne la vue d'ensemble.
Modèles de langage
Exécution locale, gérée par WivenLLM
Un catalogue de modèles ouverts que l'application télécharge et exécute elle-même, sans dépendance externe. C'est le seul cas où WivenLLM gère lui-même le cycle de vie du modèle.
Serveurs d'inférence locaux
Les solutions d'auto-hébergement les plus répandues sont prises en charge — serveurs de modèles pour poste de travail comme pour serveur, y compris les runtimes proposés par les fabricants de matériel. Le point commun : elles exposent une API compatible avec le standard OpenAI, et WivenLLM s'y connecte comme client.
Cas particulier : tout serveur exposant une API compatible OpenAI peut être déclaré, même s'il ne figure pas nommément dans la liste. Il suffit d'en indiquer l'adresse.
Fournisseurs commerciaux
Les grands éditeurs de modèles sont pris en charge, ainsi que les plateformes cloud des principaux hébergeurs et les fournisseurs spécialisés dans l'inférence rapide.
Agrégateurs
Des passerelles donnant accès à de nombreux modèles derrière une seule clé sont également prises en charge, ce qui permet de changer de modèle sans changer de configuration.
Hébergement européen et suisse
Des fournisseurs européens, dont un hébergeur suisse, figurent parmi les intégrations — utile lorsque le tout-local n'est pas envisageable mais que la localisation des traitements compte.
Moteurs d'embeddings
Intégré (par défaut) — s'exécute localement, aucune clé, aucune sortie réseau.
Locaux — les serveurs d'inférence locaux exposant un service d'embeddings peuvent être utilisés.
Externes — les principaux fournisseurs d'embeddings du marché sont pris en charge, ainsi que tout service exposant une API compatible OpenAI.
Rappel : changer de moteur d'embeddings invalide les index existants et impose une réindexation complète. → Base vectorielle et embeddings
Bases vectorielles
Base locale intégrée (par défaut) — stockée sur disque, aucune infrastructure à exploiter.
Bases auto-hébergeables — les principales solutions open source du marché sont prises en charge, y compris l'extension vectorielle de PostgreSQL, ce qui permet de réutiliser une base existante.
Services gérés — les offres cloud des mêmes solutions sont également prises en charge.
Un service géré signifie que vos vecteurs et leurs métadonnées sortent de votre périmètre.
Génération d'images
Locale — un moteur intégré géré par WivenLLM, ainsi que les serveurs de génération d'images auto-hébergés les plus répandus.
Externe — les principaux services commerciaux de génération d'images.
Génération de vidéos
Locale — chaînes de génération vidéo auto-hébergées et moteur intégré.
Cette fonction est nettement plus exigeante en matériel et en temps que la génération d'images.
Synthèse vocale
- Voix du navigateur (par défaut) — aucune configuration, aucune sortie réseau.
- Voix locale de haute qualité, exécutée dans le navigateur.
- Services externes de synthèse vocale, dont les principaux éditeurs spécialisés, ainsi que tout service exposant une API compatible OpenAI.
Transcription audio
- Moteur intégré (par défaut) — s'exécute localement, sans clé.
- Services externes de transcription.
Moteurs de recherche pour les agents
La compétence de recherche web s'appuie sur un moteur à configurer. Les principaux services d'API de recherche sont pris en charge, ainsi que des moteurs auto-hébergeables — ce qui permet de conserver la recherche web sans dépendre d'un service commercial.
Choisir : la question à se poser
Pour chaque brique, une seule question détermine le choix :
Est-ce que j'accepte que cette donnée sorte de mon périmètre ?
| Brique | Ce qui sort avec un fournisseur externe |
|---|---|
| Modèle de langage | Les messages et le contexte documentaire |
| Moteur d'embeddings | Le texte de tous les documents indexés |
| Base vectorielle | Les vecteurs et leurs métadonnées |
| Transcription | Les fichiers audio |
| Synthèse vocale | Le texte des réponses |
| Génération d'images | Les descriptions |
| Recherche web | Les requêtes |
La ligne du moteur d'embeddings est celle qu'on oublie le plus souvent, et c'est celle qui expose le plus de contenu.
