Lokale Embeddings
bge-m3 berechnet Embeddings auf Ihrer CPU. Dieser Indexierungsschritt sendet keine Dokumententexte an einen externen KI-Anbieter.
Anwendungen → Ollama
Office enthält lokale Dokumentenindexierung und Suche: Embeddings werden auf Ihrem Server berechnet, ohne kostenpflichtige KI-Option. Für ausformulierte KI-Antworten verbinden Sie ein Modell über einen kompatiblen API-Schlüssel oder Managed AI, je nach Verfügbarkeit.
Ollama führt bge-m3 auf Ihrem Office-Server aus und wandelt Dokumententext in Suchvektoren um. Embeddings zu berechnen formuliert keine Antwort.
bge-m3 berechnet Embeddings auf Ihrer CPU. Dieser Indexierungsschritt sendet keine Dokumententexte an einen externen KI-Anbieter.
Qdrant speichert den Index lokal und hilft, relevante Textstellen trotz anderer Formulierungen zu finden.
Ein kompatibler API-Schlüssel oder Managed AI ermöglicht die Generierung, je nach Verfügbarkeit. Der gewählte Anbieter erhält Frage und dafür übertragenen Kontext.
bge-m3 unterstützt mehrsprachige Suche. Die Qualität hängt von Dokumenten, Extraktion und Frage ab; prüfen Sie stets die Quelle.
Office enthält die lokale Embedding-Laufzeit, kein generatives Chatmodell und keine dedizierte GPU.
Ollama liefert Embeddings für Open WebUI und Indexierungsabläufe. Hermes nutzt einen separat konfigurierten Generierungsweg.
Technisches Detail
Ollama läuft als nativer NixOS-Dienst. bge-m3 berechnet Embeddings; Qdrant speichert den lokalen Index. Erstes Laden und Indexierung beanspruchen CPU, RAM und Speicherplatz.
Open WebUI findet Textstellen über lokale Embeddings; Antworten werden über den separat konfigurierten Generierungsweg erstellt. Ollama ist intern, kein öffentlicher Endpunkt.
Die Dauer hängt von Dokumentenmenge, Extraktion und Ressourcen ab. Das erste Laden kann länger dauern. Eine feste Dauer oder sofortige Antwort wird nicht zugesagt.
Embedding-Modell, extrahierte Texte und Vektoren belegen Serverspeicher. Der Bedarf hängt von Menge und Konfiguration ab; dieses Office-Inklusivangebot installiert kein generatives Chatmodell vor.
Verbinden Sie einen kompatiblen API-Schlüssel oder Managed AI, sofern verfügbar. Fragen und gewählter Kontext gelangen gemäß dessen Bedingungen zum Anbieter. Lokale Indexierung bleibt ohne diese Option verfügbar.
Erkunden Sie den enthaltenen Index und seine Quellen in einer Demo. Ausformulierte Antworten hängen vom verfügbaren Generierungsweg dieser Sitzung ab.