Aller au contenu

Applications → Ollama

L’indexation locale, incluse dans Office.

Office inclut l’indexation et la recherche documentaire locales : les embeddings sont calculés sur votre serveur, sans option IA payante. Pour obtenir des réponses rédigées par l’IA, connectez un modèle via une clé API compatible ou l’option Managed AI, selon disponibilité.

Ce que fait Ollama

Ollama exécute bge-m3 sur votre serveur Office pour transformer le texte documentaire en vecteurs de recherche. Calculer les embeddings d’un document ne rédige pas une réponse.

Pourquoi Ollama sur ReefOffice

1

Des embeddings locaux

bge-m3 calcule les embeddings sur votre CPU. Cette étape d’indexation n’envoie pas les textes à un fournisseur IA externe.

2

Rechercher par le sens

Qdrant conserve l’index localement et aide à retrouver les passages pertinents, même si leur formulation diffère.

3

Les réponses rédigées : une étape distincte

Une clé API compatible ou Managed AI, selon disponibilité, fournit la génération. Le fournisseur sélectionné reçoit la question et le contexte transmis pour cette réponse.

4

Une recherche multilingue

bge-m3 permet la recherche multilingue. La qualité dépend des documents, de l’extraction et de la question ; vérifiez toujours la source.

5

Indexer sans option IA payante

Office inclut le moteur local d’embeddings, pas un modèle génératif de chat ni un GPU dédié.

6

Relié à vos documents

Ollama fournit les embeddings à Open WebUI et aux recettes d’indexation documentaire. Hermes utilise une voie de génération configurée séparément.

Détail technique

Comment ça fonctionne

Ollama fonctionne comme service NixOS natif. bge-m3 calcule les embeddings ; Qdrant conserve l’index local. Le premier chargement et l’indexation utilisent du CPU, de la RAM et du disque.

Comment il s'intègre à votre stack

Open WebUI retrouve les passages grâce aux embeddings locaux ; rédiger une réponse utilise la voie de génération configurée séparément. Ollama est interne, sans point d’accès public.

Questions fréquentes

Combien de temps prend l’indexation ? +

La durée dépend du volume documentaire, de l’extraction et des ressources. Le premier chargement peut être plus long. Aucun délai fixe ni réponse instantanée n’est promis.

Combien de stockage les modèles d'IA utilisent-ils ? +

Le modèle d’embeddings, les textes extraits et les vecteurs utilisent le stockage du serveur. La capacité dépend du volume et de la configuration ; cette inclusion Office ne préinstalle pas de modèle génératif de chat.

Comment obtenir des réponses rédigées par l’IA ? +

Connectez une clé API compatible ou Managed AI lorsque disponible. Les questions et le contexte sélectionné arrivent au fournisseur choisi selon ses conditions. L’indexation locale reste disponible sans cette option.

Découvrez la recherche documentaire locale

Explorez l’index inclus et ses sources dans une démo. Les réponses rédigées dépendent de la voie de génération disponible pour cette session.

Demander une démo