Lokale KI-Modellausführung
Ollama führt hunderte Open-Source-Modelle auf Ihrer Server-CPU oder GPU aus — LLaMA, Mistral, Qwen, Gemma, Phi, DeepSeek und mehr. Keine API-Aufrufe an externe Anbieter, keine Daten, die Ihre Infrastruktur verlassen.
Anwendungen → Ollama + Qdrant
Ollama führt Open-Source-Sprachmodelle lokal auf Ihrem ReefOffice-Server aus. Qdrant speichert Vektor-Embeddings, die Ihre Dokumente durchsuchbar machen. Zusammen betreiben sie private KI — keine Daten verlassen jemals Ihren Server.
Ollama übernimmt die Berechnung — es lädt und führt Open-Source-KI-Modelle (LLaMA, Mistral, Qwen, Phi, Gemma und hunderte weitere) direkt auf Ihrem Server aus. Qdrant bietet den Speicher — es speichert Vektor-Embeddings für semantische Suche in Ihren Dokumenten.
Ollama führt hunderte Open-Source-Modelle auf Ihrer Server-CPU oder GPU aus — LLaMA, Mistral, Qwen, Gemma, Phi, DeepSeek und mehr. Keine API-Aufrufe an externe Anbieter, keine Daten, die Ihre Infrastruktur verlassen.
Qdrant speichert Vektor-Embeddings Ihrer Dateien, Rechnungen, Verträge und Notizen. Semantische Suche findet Dokumente nach Bedeutung, nicht nur nach Schlüsselwörtern.
Bei Private AI-Plänen generiert Ollama Antworten aus Ihrem Dokumentenkorpus. Die Antworten werden auf Ihrem Server aus Ihren indizierten Dokumenten generiert.
Wählen Sie das Modell, das zu Ihrem Anwendungsfall passt. Führen Sie ein kleines, schnelles Modell für alltägliche Chats oder ein größeres Modell für komplexe Aufgaben aus.
Private AI-Pläne enthalten dedizierte GPU-Kapazität auf der ReefOffice-Infrastruktur in Deutschland. Für rein lokale Setups nutzt Ollama die CPU.
Jeder ReefOffice-Plan indiziert Ihre Dokumente automatisch mit bge-m3-Embeddings über Qdrant. Neue Dateien in Nextcloud, Paperless und Dolibarr werden ohne manuelle Einrichtung verarbeitet.
Technisches Detail
Ollama nutzt llama.cpp für effiziente lokale Inferenz mit GPU-Beschleunigung und quantisierten Modellen (GGUF-Format). Auf ReefOffice läuft es als nativer NixOS-Dienst. Qdrant ist eine hochperformante Vektordatenbank in Rust.
Ollama betreibt Open WebUI für privaten ChatGPT-ähnlichen Chat und Hermes Agent für autonome KI-Aufgaben. Qdrant bietet die Vektorsuche für die ReefOffice-Dokumentensuche und Activepieces-Automatisierungen.
Für Dokumentsuche und -indizierung, ja. Für Chat und KI-Antworten hängt die Leistung von der Modellgröße und Hardware ab. Private AI-Pläne enthalten GPU-Kapazität.
Modelle variieren von 1,5 GB (klein quantisiert) bis über 40 GB (70B-Modell). Die für Ihren Plan empfohlenen Modelle werden vorinstalliert.
Ja. Bei Plänen ohne lokale GPU können Sie einen externen KI-Anbieter-Schlüssel anschließen (OpenAI, Anthropic, Mistral AI). Die Dokumentsuche bleibt lokal über Qdrant.
Buchen Sie eine Demo und sehen Sie, wie Ollama und Qdrant auf ReefOffice Ihnen private KI-Funktionen bieten — Dokumentsuche und lokale Modellausführung auf Ihrem eigenen Server.