Saltar al contenido

Aplicaciones → Ollama

Indexación local, incluida en Office.

Office incluye indexación y búsqueda documental locales: los embeddings se calculan en su servidor, sin opción de IA de pago. Para obtener respuestas redactadas por IA, conecte un modelo mediante una clave API compatible o Managed AI, según disponibilidad.

Qué hace Ollama

Ollama ejecuta bge-m3 en su servidor Office para convertir el texto documental en vectores de búsqueda. Calcular embeddings no redacta una respuesta.

Por qué Ollama en ReefOffice

1

Embeddings locales

bge-m3 calcula embeddings en su CPU. Esta etapa de indexación no envía textos a un proveedor externo de IA.

2

Buscar por significado

Qdrant conserva el índice local y ayuda a encontrar pasajes relevantes aunque la formulación sea distinta.

3

Respuestas redactadas: otro paso

Una clave API compatible o Managed AI permite generar respuestas, según disponibilidad. El proveedor elegido recibe la pregunta y el contexto enviado para esa respuesta.

4

Búsqueda multilingüe

bge-m3 permite búsquedas multilingües. La calidad depende de documentos, extracción y pregunta; compruebe siempre la fuente.

5

Indexar sin opción de IA de pago

Office incluye el motor local de embeddings, no un modelo generativo de chat ni una GPU dedicada.

6

Conectado a sus documentos

Ollama proporciona embeddings a Open WebUI y a las recetas de indexación. Hermes usa una ruta de generación configurada por separado.

Detalle técnico

Cómo funciona

Ollama funciona como servicio nativo de NixOS. bge-m3 calcula embeddings; Qdrant conserva el índice local. La carga inicial y la indexación consumen CPU, RAM y disco.

Cómo se adapta a tu stack

Open WebUI recupera pasajes con embeddings locales; redactar respuestas usa la ruta de generación configurada por separado. Ollama es interno, no un punto de acceso público.

Preguntas frecuentes

¿Cuánto tarda la indexación? +

Depende del volumen documental, la extracción y los recursos. La primera carga puede tardar más. No se promete un plazo fijo ni respuestas instantáneas.

¿Cuánto almacenamiento usan los modelos de IA? +

El modelo de embeddings, los textos extraídos y los vectores ocupan almacenamiento del servidor. La capacidad depende del volumen y la configuración; esta inclusión de Office no preinstala un modelo generativo de chat.

¿Cómo obtengo respuestas redactadas por IA? +

Conecte una clave API compatible o Managed AI cuando esté disponible. Preguntas y contexto seleccionado llegan al proveedor según sus condiciones. La indexación local sigue disponible sin esta opción.

Descubra la búsqueda documental local

Explore el índice incluido y sus fuentes en una demo. Las respuestas redactadas dependen de la ruta de generación disponible en esa sesión.

Reservar una demo