Fournisseurs supportés

La liste exacte des fournisseurs disponibles dans votre version est celle qu'affichent les écrans de réglages. Cette page donne la vue d'ensemble.


Modèles de langage

Exécution locale, gérée par WivenLLM

Un catalogue de modèles ouverts que l'application télécharge et exécute elle-même, sans dépendance externe. C'est le seul cas où WivenLLM gère lui-même le cycle de vie du modèle.

Serveurs d'inférence locaux

Les solutions d'auto-hébergement les plus répandues sont prises en charge — serveurs de modèles pour poste de travail comme pour serveur, y compris les runtimes proposés par les fabricants de matériel. Le point commun : elles exposent une API compatible avec le standard OpenAI, et WivenLLM s'y connecte comme client.

Cas particulier : tout serveur exposant une API compatible OpenAI peut être déclaré, même s'il ne figure pas nommément dans la liste. Il suffit d'en indiquer l'adresse.

Fournisseurs commerciaux

Les grands éditeurs de modèles sont pris en charge, ainsi que les plateformes cloud des principaux hébergeurs et les fournisseurs spécialisés dans l'inférence rapide.

Agrégateurs

Des passerelles donnant accès à de nombreux modèles derrière une seule clé sont également prises en charge, ce qui permet de changer de modèle sans changer de configuration.

Hébergement européen et suisse

Des fournisseurs européens, dont un hébergeur suisse, figurent parmi les intégrations — utile lorsque le tout-local n'est pas envisageable mais que la localisation des traitements compte.


Moteurs d'embeddings

Intégré (par défaut) — s'exécute localement, aucune clé, aucune sortie réseau.

Locaux — les serveurs d'inférence locaux exposant un service d'embeddings peuvent être utilisés.

Externes — les principaux fournisseurs d'embeddings du marché sont pris en charge, ainsi que tout service exposant une API compatible OpenAI.

Rappel : changer de moteur d'embeddings invalide les index existants et impose une réindexation complète. → Base vectorielle et embeddings


Bases vectorielles

Base locale intégrée (par défaut) — stockée sur disque, aucune infrastructure à exploiter.

Bases auto-hébergeables — les principales solutions open source du marché sont prises en charge, y compris l'extension vectorielle de PostgreSQL, ce qui permet de réutiliser une base existante.

Services gérés — les offres cloud des mêmes solutions sont également prises en charge.

Un service géré signifie que vos vecteurs et leurs métadonnées sortent de votre périmètre.


Génération d'images

Locale — un moteur intégré géré par WivenLLM, ainsi que les serveurs de génération d'images auto-hébergés les plus répandus.

Externe — les principaux services commerciaux de génération d'images.


Génération de vidéos

Locale — chaînes de génération vidéo auto-hébergées et moteur intégré.

Cette fonction est nettement plus exigeante en matériel et en temps que la génération d'images.


Synthèse vocale

  • Voix du navigateur (par défaut) — aucune configuration, aucune sortie réseau.
  • Voix locale de haute qualité, exécutée dans le navigateur.
  • Services externes de synthèse vocale, dont les principaux éditeurs spécialisés, ainsi que tout service exposant une API compatible OpenAI.

Transcription audio

  • Moteur intégré (par défaut) — s'exécute localement, sans clé.
  • Services externes de transcription.

Moteurs de recherche pour les agents

La compétence de recherche web s'appuie sur un moteur à configurer. Les principaux services d'API de recherche sont pris en charge, ainsi que des moteurs auto-hébergeables — ce qui permet de conserver la recherche web sans dépendre d'un service commercial.


Choisir : la question à se poser

Pour chaque brique, une seule question détermine le choix :

Est-ce que j'accepte que cette donnée sorte de mon périmètre ?

Brique Ce qui sort avec un fournisseur externe
Modèle de langage Les messages et le contexte documentaire
Moteur d'embeddings Le texte de tous les documents indexés
Base vectorielle Les vecteurs et leurs métadonnées
Transcription Les fichiers audio
Synthèse vocale Le texte des réponses
Génération d'images Les descriptions
Recherche web Les requêtes

La ligne du moteur d'embeddings est celle qu'on oublie le plus souvent, et c'est celle qui expose le plus de contenu.