Embeddings locais
O bge-m3 calcula embeddings no CPU. Esta etapa de indexação não envia textos para um fornecedor externo de IA.
Aplicações → Ollama
O Office inclui indexação e pesquisa documental locais: os embeddings são calculados no seu servidor, sem opção de IA paga. Para obter respostas escritas por IA, ligue um modelo através de uma chave API compatível ou Managed AI, conforme disponibilidade.
O Ollama executa bge-m3 no servidor Office para transformar texto documental em vetores de pesquisa. Calcular embeddings não escreve uma resposta.
O bge-m3 calcula embeddings no CPU. Esta etapa de indexação não envia textos para um fornecedor externo de IA.
O Qdrant guarda o índice local e ajuda a encontrar passagens relevantes, mesmo com formulações diferentes.
Uma chave API compatível ou Managed AI permite a geração, conforme disponibilidade. O fornecedor escolhido recebe a pergunta e o contexto enviado para essa resposta.
O bge-m3 permite pesquisa multilingue. A qualidade depende de documentos, extração e pergunta; verifique sempre a fonte.
O Office inclui o motor local de embeddings, não um modelo generativo de chat nem uma GPU dedicada.
O Ollama fornece embeddings ao Open WebUI e às receitas de indexação. O Hermes usa uma via de geração configurada separadamente.
Detalhe técnico
O Ollama funciona como serviço NixOS nativo. O bge-m3 calcula embeddings; o Qdrant guarda o índice local. O primeiro carregamento e a indexação consomem CPU, RAM e disco.
O Open WebUI recupera passagens com embeddings locais; escrever respostas usa a via de geração configurada separadamente. O Ollama é interno, não um ponto de acesso público.
Depende do volume documental, da extração e dos recursos. O primeiro carregamento pode demorar mais. Não se promete um prazo fixo nem respostas instantâneas.
O modelo de embeddings, os textos extraídos e os vetores ocupam armazenamento do servidor. A capacidade depende do volume e da configuração; esta inclusão do Office não pré-instala um modelo generativo de chat.
Ligue uma chave API compatível ou Managed AI quando disponível. Perguntas e contexto selecionado chegam ao fornecedor segundo as suas condições. A indexação local continua disponível sem esta opção.
Explore o índice incluído e as suas fontes numa demo. As respostas escritas dependem da via de geração disponível nessa sessão.