Zum Inhalt springen

Anwendungen → Ollama

Lokale Indexierung, in Office enthalten.

Office enthält lokale Dokumentenindexierung und Suche: Embeddings werden auf Ihrem Server berechnet, ohne kostenpflichtige KI-Option. Für ausformulierte KI-Antworten verbinden Sie ein Modell über einen kompatiblen API-Schlüssel oder Managed AI, je nach Verfügbarkeit.

Was Ollama macht

Ollama führt bge-m3 auf Ihrem Office-Server aus und wandelt Dokumententext in Suchvektoren um. Embeddings zu berechnen formuliert keine Antwort.

Warum Ollama auf ReefOffice

1

Lokale Embeddings

bge-m3 berechnet Embeddings auf Ihrer CPU. Dieser Indexierungsschritt sendet keine Dokumententexte an einen externen KI-Anbieter.

2

Nach Bedeutung suchen

Qdrant speichert den Index lokal und hilft, relevante Textstellen trotz anderer Formulierungen zu finden.

3

Ausformulierte Antworten: ein eigener Schritt

Ein kompatibler API-Schlüssel oder Managed AI ermöglicht die Generierung, je nach Verfügbarkeit. Der gewählte Anbieter erhält Frage und dafür übertragenen Kontext.

4

Mehrsprachige Suche

bge-m3 unterstützt mehrsprachige Suche. Die Qualität hängt von Dokumenten, Extraktion und Frage ab; prüfen Sie stets die Quelle.

5

Indexierung ohne kostenpflichtige KI-Option

Office enthält die lokale Embedding-Laufzeit, kein generatives Chatmodell und keine dedizierte GPU.

6

Mit Ihren Dokumenten verbunden

Ollama liefert Embeddings für Open WebUI und Indexierungsabläufe. Hermes nutzt einen separat konfigurierten Generierungsweg.

Technisches Detail

Wie es funktioniert

Ollama läuft als nativer NixOS-Dienst. bge-m3 berechnet Embeddings; Qdrant speichert den lokalen Index. Erstes Laden und Indexierung beanspruchen CPU, RAM und Speicherplatz.

Wie es in Ihren Stack passt

Open WebUI findet Textstellen über lokale Embeddings; Antworten werden über den separat konfigurierten Generierungsweg erstellt. Ollama ist intern, kein öffentlicher Endpunkt.

Häufig gestellte Fragen

Wie lange dauert die Indexierung? +

Die Dauer hängt von Dokumentenmenge, Extraktion und Ressourcen ab. Das erste Laden kann länger dauern. Eine feste Dauer oder sofortige Antwort wird nicht zugesagt.

Wie viel Speicher verbrauchen KI-Modelle? +

Embedding-Modell, extrahierte Texte und Vektoren belegen Serverspeicher. Der Bedarf hängt von Menge und Konfiguration ab; dieses Office-Inklusivangebot installiert kein generatives Chatmodell vor.

Wie erhalte ich ausformulierte KI-Antworten? +

Verbinden Sie einen kompatiblen API-Schlüssel oder Managed AI, sofern verfügbar. Fragen und gewählter Kontext gelangen gemäß dessen Bedingungen zum Anbieter. Lokale Indexierung bleibt ohne diese Option verfügbar.

Lokale Dokumentensuche entdecken

Erkunden Sie den enthaltenen Index und seine Quellen in einer Demo. Ausformulierte Antworten hängen vom verfügbaren Generierungsweg dieser Sitzung ab.

Demo anfragen