Vai al contenuto

Applicazioni → Ollama

Indicizzazione locale, inclusa in Office.

Office include indicizzazione e ricerca documentale locali: gli embedding vengono calcolati sul vostro server, senza opzioni IA a pagamento. Per risposte scritte dall’IA, collegate un modello tramite una chiave API compatibile o Managed AI, secondo disponibilità.

Cosa fa Ollama

Ollama esegue bge-m3 sul server Office per trasformare il testo documentale in vettori di ricerca. Calcolare embedding non scrive una risposta.

Perché Ollama su ReefOffice

1

Embedding locali

bge-m3 calcola embedding sulla CPU. Questa fase di indicizzazione non invia testi a un fornitore IA esterno.

2

Cercare per significato

Qdrant conserva l’indice locale e aiuta a trovare passaggi pertinenti anche con formulazioni diverse.

3

Risposte scritte: un passaggio separato

Una chiave API compatibile o Managed AI permette la generazione, secondo disponibilità. Il fornitore scelto riceve domanda e contesto inviato per quella risposta.

4

Ricerca multilingue

bge-m3 supporta la ricerca multilingue. La qualità dipende da documenti, estrazione e domanda; verificate sempre la fonte.

5

Indicizzare senza opzioni IA a pagamento

Office include il motore locale di embedding, non un modello generativo di chat né una GPU dedicata.

6

Collegato ai documenti

Ollama fornisce embedding a Open WebUI e alle ricette di indicizzazione. Hermes usa un percorso di generazione configurato separatamente.

Dettagli tecnici

Come funziona

Ollama funziona come servizio NixOS nativo. bge-m3 calcola embedding; Qdrant conserva l’indice locale. Il primo caricamento e l’indicizzazione consumano CPU, RAM e disco.

Come si integra con il tuo stack

Open WebUI recupera passaggi con embedding locali; scrivere risposte usa il percorso di generazione configurato separatamente. Ollama è interno, non un endpoint pubblico.

Domande frequenti

Quanto dura l’indicizzazione? +

Dipende dal volume documentale, dall’estrazione e dalle risorse. Il primo caricamento può richiedere più tempo. Non sono promessi tempi fissi né risposte istantanee.

Quanto spazio di archiviazione usano i modelli AI? +

Il modello di embedding, i testi estratti e i vettori occupano spazio sul server. Il fabbisogno dipende da volume e configurazione; questa inclusione di Office non preinstalla un modello generativo di chat.

Come ottenere risposte scritte dall’IA? +

Collegate una chiave API compatibile o Managed AI quando disponibile. Domande e contesto selezionato raggiungono il fornitore secondo le sue condizioni. L’indicizzazione locale resta disponibile senza questa opzione.

Scoprite la ricerca documentale locale

Esplorate l’indice incluso e le sue fonti in una demo. Le risposte scritte dipendono dal percorso di generazione disponibile per quella sessione.

Prenota una demo