Des embeddings locaux
bge-m3 calcule les embeddings sur votre CPU. Cette étape d’indexation n’envoie pas les textes à un fournisseur IA externe.
Applications → Ollama
Office inclut l’indexation et la recherche documentaire locales : les embeddings sont calculés sur votre serveur, sans option IA payante. Pour obtenir des réponses rédigées par l’IA, connectez un modèle via une clé API compatible ou l’option Managed AI, selon disponibilité.
Ollama exécute bge-m3 sur votre serveur Office pour transformer le texte documentaire en vecteurs de recherche. Calculer les embeddings d’un document ne rédige pas une réponse.
bge-m3 calcule les embeddings sur votre CPU. Cette étape d’indexation n’envoie pas les textes à un fournisseur IA externe.
Qdrant conserve l’index localement et aide à retrouver les passages pertinents, même si leur formulation diffère.
Une clé API compatible ou Managed AI, selon disponibilité, fournit la génération. Le fournisseur sélectionné reçoit la question et le contexte transmis pour cette réponse.
bge-m3 permet la recherche multilingue. La qualité dépend des documents, de l’extraction et de la question ; vérifiez toujours la source.
Office inclut le moteur local d’embeddings, pas un modèle génératif de chat ni un GPU dédié.
Ollama fournit les embeddings à Open WebUI et aux recettes d’indexation documentaire. Hermes utilise une voie de génération configurée séparément.
Détail technique
Ollama fonctionne comme service NixOS natif. bge-m3 calcule les embeddings ; Qdrant conserve l’index local. Le premier chargement et l’indexation utilisent du CPU, de la RAM et du disque.
Open WebUI retrouve les passages grâce aux embeddings locaux ; rédiger une réponse utilise la voie de génération configurée séparément. Ollama est interne, sans point d’accès public.
La durée dépend du volume documentaire, de l’extraction et des ressources. Le premier chargement peut être plus long. Aucun délai fixe ni réponse instantanée n’est promis.
Le modèle d’embeddings, les textes extraits et les vecteurs utilisent le stockage du serveur. La capacité dépend du volume et de la configuration ; cette inclusion Office ne préinstalle pas de modèle génératif de chat.
Connectez une clé API compatible ou Managed AI lorsque disponible. Les questions et le contexte sélectionné arrivent au fournisseur choisi selon ses conditions. L’indexation locale reste disponible sans cette option.
Explorez l’index inclus et ses sources dans une démo. Les réponses rédigées dépendent de la voie de génération disponible pour cette session.