Le principe
Deux rôles distincts et indépendants : la génération des réponses (chat) et la vectorisation (embeddings). Vous pouvez les confier à des fournisseurs différents (mode mixte).
Les options
- Claude (via le proxy DGT) — défaut recommandé pour la génération.
- Mistral (souveraineté EU), OpenAI, Google Gemini — avec la clé du client, configurable par espace.
- Local / open-source (Ollama…) — auto-hébergé, aucune donnée sortante.
Configurer
Ouvrir
Administration → Configuration des fournisseurs IA.Choisir le fournisseur
Globalement ou par espace client (clé stockée chiffrée).
Vectorisation locale (option)
Pour un RAG souverain, imposez les embeddings en local (serveur Ollama), tout en gardant la génération sur Claude.
Bon à savoir
- Anthropic n'a pas d'API d'embeddings : la vectorisation passe par Mistral / OpenAI / Gemini ou un modèle local, même quand la génération reste sur Claude.
- Le compagnon utilise un modèle économique par défaut (Haiku).