Przejdź do treści

Aplikacje → Ollama

Lokalne indeksowanie w pakiecie Office.

Office obejmuje lokalne indeksowanie i wyszukiwanie dokumentów: embeddingi są obliczane na Twoim serwerze, bez płatnej opcji AI. Aby uzyskać pisemne odpowiedzi AI, podłącz model przez zgodny klucz API lub Managed AI, zależnie od dostępności.

What Ollama does

Ollama uruchamia bge-m3 na serwerze Office, zmieniając tekst dokumentów w wektory wyszukiwania. Obliczanie embeddingów nie tworzy pisemnej odpowiedzi.

Why Ollama on ReefOffice

1

Lokalne embeddingi

bge-m3 oblicza embeddingi na CPU. Ten etap indeksowania nie wysyła tekstów do zewnętrznego dostawcy AI.

2

Wyszukiwanie według znaczenia

Qdrant przechowuje lokalny indeks i pomaga odnajdywać fragmenty, nawet jeśli używają innych słów.

3

Pisemne odpowiedzi: osobny etap

Zgodny klucz API lub Managed AI umożliwia generowanie, zależnie od dostępności. Wybrany dostawca otrzymuje pytanie i kontekst wysłany dla danej odpowiedzi.

4

Wyszukiwanie wielojęzyczne

bge-m3 obsługuje wyszukiwanie wielojęzyczne. Jakość zależy od dokumentów, ekstrakcji i pytania; zawsze sprawdzaj źródło.

5

Indeksowanie bez płatnej opcji AI

Office obejmuje lokalny silnik embeddingów, nie generatywny model czatu ani dedykowany GPU.

6

Połączenie z dokumentami

Ollama dostarcza embeddingi do Open WebUI i procedur indeksowania. Hermes używa osobno skonfigurowanej ścieżki generowania.

Technical detail

How it works

Ollama działa jako natywna usługa NixOS. bge-m3 oblicza embeddingi; Qdrant przechowuje lokalny indeks. Pierwsze ładowanie i indeksowanie zużywają CPU, RAM i miejsce na dysku.

How it fits your stack

Open WebUI odnajduje fragmenty dzięki lokalnym embeddingom; pisanie odpowiedzi używa osobno skonfigurowanej ścieżki generowania. Ollama jest usługą wewnętrzną, nie publicznym punktem dostępu.

Frequently asked questions

Ile trwa indeksowanie? +

Czas zależy od liczby dokumentów, ekstrakcji i zasobów. Pierwsze ładowanie może trwać dłużej. Nie obiecujemy stałego czasu ani natychmiastowych odpowiedzi.

How much storage do AI models use? +

Model embeddingów, wyodrębnione teksty i wektory zajmują miejsce na serwerze. Zapotrzebowanie zależy od liczby dokumentów i konfiguracji; ten element Office nie preinstaluje generatywnego modelu czatu.

Jak uzyskać pisemne odpowiedzi AI? +

Podłącz zgodny klucz API lub Managed AI, gdy jest dostępne. Pytania i wybrany kontekst trafiają do dostawcy na jego warunkach. Lokalne indeksowanie pozostaje dostępne bez tej opcji.

Poznaj lokalne wyszukiwanie dokumentów

Wypróbuj dołączony indeks i jego źródła w demo. Pisemne odpowiedzi zależą od ścieżki generowania dostępnej w danej sesji.

Zarezerwuj prezentację