Saltar para o conteúdo

Aplicações → Ollama

Indexação local, incluída no Office.

O Office inclui indexação e pesquisa documental locais: os embeddings são calculados no seu servidor, sem opção de IA paga. Para obter respostas escritas por IA, ligue um modelo através de uma chave API compatível ou Managed AI, conforme disponibilidade.

O que o Ollama faz

O Ollama executa bge-m3 no servidor Office para transformar texto documental em vetores de pesquisa. Calcular embeddings não escreve uma resposta.

Porquê o Ollama no ReefOffice

1

Embeddings locais

O bge-m3 calcula embeddings no CPU. Esta etapa de indexação não envia textos para um fornecedor externo de IA.

2

Pesquisar pelo significado

O Qdrant guarda o índice local e ajuda a encontrar passagens relevantes, mesmo com formulações diferentes.

3

Respostas escritas: outra etapa

Uma chave API compatível ou Managed AI permite a geração, conforme disponibilidade. O fornecedor escolhido recebe a pergunta e o contexto enviado para essa resposta.

4

Pesquisa multilingue

O bge-m3 permite pesquisa multilingue. A qualidade depende de documentos, extração e pergunta; verifique sempre a fonte.

5

Indexar sem opção de IA paga

O Office inclui o motor local de embeddings, não um modelo generativo de chat nem uma GPU dedicada.

6

Ligado aos documentos

O Ollama fornece embeddings ao Open WebUI e às receitas de indexação. O Hermes usa uma via de geração configurada separadamente.

Detalhe técnico

Como funciona

O Ollama funciona como serviço NixOS nativo. O bge-m3 calcula embeddings; o Qdrant guarda o índice local. O primeiro carregamento e a indexação consomem CPU, RAM e disco.

Como se integra na sua stack

O Open WebUI recupera passagens com embeddings locais; escrever respostas usa a via de geração configurada separadamente. O Ollama é interno, não um ponto de acesso público.

Questões frequentes

Quanto demora a indexação? +

Depende do volume documental, da extração e dos recursos. O primeiro carregamento pode demorar mais. Não se promete um prazo fixo nem respostas instantâneas.

Quanto armazenamento os modelos IA utilizam? +

O modelo de embeddings, os textos extraídos e os vetores ocupam armazenamento do servidor. A capacidade depende do volume e da configuração; esta inclusão do Office não pré-instala um modelo generativo de chat.

Como obter respostas escritas por IA? +

Ligue uma chave API compatível ou Managed AI quando disponível. Perguntas e contexto selecionado chegam ao fornecedor segundo as suas condições. A indexação local continua disponível sem esta opção.

Descubra a pesquisa documental local

Explore o índice incluído e as suas fontes numa demo. As respostas escritas dependem da via de geração disponível nessa sessão.

Agendar uma demonstração