Aller au contenu

Applications → Ollama + Qdrant

Modèles d'IA privés et mémoire vectorielle, sur votre propre serveur.

Ollama exécute des modèles de langage open-source localement sur votre serveur ReefOffice. Qdrant stocke les embeddings vectoriels qui rendent vos documents recherchables. Ensemble, ils alimentent l'IA privée — aucune donnée ne quitte jamais votre serveur pour être traitée par un fournisseur d'IA externe.

Ce que font Ollama et Qdrant

Ollama gère le calcul — il télécharge, charge et exécute des modèles d'IA open-source (LLaMA, Mistral, Qwen, Phi, Gemma et des centaines d'autres) directement sur votre serveur. Qdrant fournit la mémoire — il stocke les embeddings vectoriels qui permettent la recherche sémantique dans vos documents. Chaque plan ReefOffice utilise Qdrant pour indexer le contenu des documents ; les plans Private AI ajoutent la génération par Ollama pour répondre aux questions sur vos documents.

Pourquoi Ollama et Qdrant sur ReefOffice

1

Exécution locale de modèles d'IA

Ollama exécute des centaines de modèles open-source sur le CPU ou GPU de votre serveur — LLaMA, Mistral, Qwen, Gemma, Phi, DeepSeek et plus. Les modèles sont téléchargés, mis en cache et exécutés localement. Pas d'appels API vers des fournisseurs externes.

2

Recherche vectorielle pour vos documents

Qdrant stocke les embeddings vectoriels de vos fichiers, factures, contrats et notes. La recherche sémantique trouve les documents par leur sens, pas seulement par mots-clés. Intégré sur chaque plan ReefOffice.

3

Réponses IA privées

Sur les plans Private AI, Ollama génère des réponses à partir de votre corpus documentaire. Les réponses sont générées sur votre serveur à partir de vos documents indexés, avec références sources.

4

Flexibilité des modèles

Choisissez le modèle adapté à votre cas d'usage. Exécutez un modèle petit et rapide pour le chat quotidien, un modèle multilingue pour les questions-réponses documentaires, ou un modèle plus grand pour le raisonnement complexe.

5

Prêt pour l'accélération GPU

Les plans Private AI incluent une capacité GPU dédiée sur l'infrastructure ReefOffice en Allemagne. Pour les configurations locales uniquement, Ollama utilise le CPU avec une inférence optimisée.

6

Indexation automatique des documents

Chaque plan ReefOffice indexe automatiquement vos documents avec les embeddings bge-m3 via Qdrant. Les nouveaux fichiers dans Nextcloud, Paperless et Dolibarr sont traités sans configuration manuelle.

Détail technique

Comment ça fonctionne

Ollama utilise llama.cpp pour l'inférence locale efficace avec support de l'accélération GPU, des modèles quantifiés (format GGUF) et du cache de prompt. Sur ReefOffice, il fonctionne comme un service NixOS natif. Qdrant est une base de données vectorielle haute performance écrite en Rust, fonctionnant comme un conteneur Docker avec stockage persisté et authentification par clé API.

Comment il s'intègre à votre stack

Ollama alimente Open WebUI pour le chat privé de type ChatGPT et Hermes Agent pour les tâches IA autonomes. Qdrant fournit la couche de recherche vectorielle utilisée par la fonction de recherche documentaire ReefOffice, par les déclencheurs Activepieces et par Hermes.

Questions fréquentes

L'IA locale sera-t-elle assez rapide pour un usage quotidien ? +

Pour la recherche et l'indexation de documents, oui — la génération d'embeddings avec bge-m3 s'exécute efficacement sur CPU. Pour le chat et les réponses IA, les performances dépendent de la taille du modèle et du matériel.

Combien de stockage les modèles d'IA utilisent-ils ? +

Les modèles varient de 1,5 Go (petit modèle quantifié) à plus de 40 Go (modèle 70B en pleine précision). Les modèles recommandés pour votre plan sont préinstallés. Les modèles supplémentaires sont téléchargés à la demande et mis en cache.

Puis-je utiliser un fournisseur d'IA externe au lieu des modèles locaux ? +

Oui. Sur les plans sans GPU local, vous pouvez connecter une clé de fournisseur d'IA externe (OpenAI, Anthropic, Mistral AI). Open WebUI et Hermes utiliseront l'API externe pour la génération tout en gardant votre recherche documentaire locale via Qdrant.

Prêt pour l'IA privée ?

Réservez une démo et voyez comment Ollama et Qdrant sur ReefOffice vous offrent des capacités d'IA privées — recherche documentaire, réponses sémantiques et exécution locale de modèles — le tout sur votre propre serveur.

Demander une démo