Base de conocimiento con IA

Sistemas RAG para empresas en Colombia

Un sistema RAG es una IA que, antes de responder, busca en los documentos de tu empresa —manuales, contratos, políticas— y te contesta con lo que encontró, citando la fuente.

Piloto con tus documentos en 2 semanas.

¿Qué es RAG? Una base de conocimiento con IA, en palabras simples

RAG viene del inglés «retrieval augmented generation»: respuestas generadas a partir de una búsqueda en tus documentos. En la práctica, es un chatbot con los documentos de la empresa que no responde de memoria, sino consultando tus archivos.

Preguntas como le preguntarías a un colega

«¿Cuántos días de vacaciones me corresponden?» o «¿Qué dice el contrato con este proveedor sobre penalidades?». Sin buscar carpeta por carpeta.

La IA busca en tus documentos, no en internet

Solo consulta los documentos que tu empresa decide cargar. Así, las respuestas siguen tus políticas y no lo que dice una página cualquiera.

Responde y te muestra de dónde lo sacó

Cada respuesta trae la cita del documento para que la verifiques. Si la información no está en tus documentos, te lo dice.

Piénsalo como un empleado nuevo que se leyó todos los manuales de la empresa y que, cada vez que responde, te muestra el párrafo de donde lo sacó.

Casos de uso por sector

Un chatbot con los documentos de la empresa sirve donde la gente pierde tiempo buscando información en manuales, contratos o normativa.

Salud

Protocolos clínicos, normativa del sector y auditoría de cuentas médicas, con la fuente citada.

  • Protocolos clínicos
  • Normativa del sector
  • Auditoría de cuentas médicas
Ver RAG para salud

Legal

Buscar en contratos con IA, conceptos jurídicos internos y normativa, con la cláusula citada.

  • Contratos
  • Conceptos jurídicos internos
  • Normativa
Ver RAG legal

Soporte

Un asistente IA para manuales internos, políticas y la base de conocimiento de tus agentes.

  • Manuales
  • Políticas
  • Base de conocimiento para agentes
Ver RAG para soporte
Para el equipo técnico

Cómo funciona la retrieval augmented generation (RAG)

Cuatro pasos entre tus documentos y una respuesta con cita.

  1. 1

    Documentos

    Extraemos el texto de tus PDF, Word, TXT o páginas web y lo dividimos en fragmentos por párrafos. Cada fragmento recuerda de qué documento viene.

  2. 2

    Índice

    Los fragmentos se guardan en un índice de búsqueda en el servidor. El modelo de IA no se reentrena: tus documentos quedan en el índice, no dentro del modelo.

  3. 3

    Búsqueda

    Con cada pregunta, el sistema recupera los fragmentos más relevantes (el «retrieval»). En la demo, la búsqueda es léxica, tipo BM25, y toma los 5 mejores.

  4. 4

    Respuesta con cita

    Un modelo de lenguaje (por defecto, GPT-4o mini de OpenAI) redacta la respuesta con esos fragmentos y marca cada dato con [1], [2]… para que abras la fuente.

Ejemplo ilustrativo
Pregunta
¿Con cuánta anticipación debo pedir vacaciones?
Respuesta
Debes pedirlas con mínimo 15 días hábiles de anticipación, por escrito a tu jefe inmediato [1].
Fuente

[1] Reglamento interno.pdf

«Las vacaciones se solicitan por escrito al jefe inmediato con mínimo 15 días hábiles de anticipación…»

Seguridad y privacidad de tus documentos

Esto es lo que hace hoy el sistema con tus documentos y tus preguntas.

Dónde se guardan tus documentos

En el servidor de KopTup. Allí extraemos el texto, lo dividimos en fragmentos y construimos el índice de búsqueda. Las preguntas y respuestas también quedan registradas en ese servidor.

Qué proveedor de IA usamos

OpenAI, a través de su API. El modelo por defecto es GPT-4o mini. La clave de acceso a OpenAI se queda en nuestro servidor: nunca llega al navegador.

Qué se envía a OpenAI

Solo lo necesario para redactar cada respuesta: tu pregunta, los fragmentos más relevantes (no el documento completo), las instrucciones del asistente y los últimos mensajes de la conversación.

Tus documentos no entrenan la IA

Según la política vigente de la API de OpenAI, por defecto los datos enviados por API no se usan para entrenar sus modelos. OpenAI puede conservarlos hasta 30 días para detectar abusos.

Si necesitas más control

El plan Profesional agrega permisos por rol, y el Empresarial se despliega en tu nube o en tus servidores (on-premise), con SSO y auditoría.

En la demo pública

En «Prueba con tu documento», el archivo se procesa solo en la memoria del servidor (no se guarda en disco ni en una base de datos) y el documento, su índice y la conversación se borran 1 hora después de subirlo. Solo guardamos tu email, con tu autorización, y el tipo y la extensión del documento, no su contenido. Aun así, no subas información confidencial.

Lee nuestra política de privacidad

Cómo evitamos respuestas inventadas

Una IA que inventa respuestas es peor que no tener IA. Por eso el sistema sigue tres reglas.

Responde solo con lo que está en tus documentos

El modelo recibe los fragmentos encontrados en tus documentos y la instrucción de basarse en ellos, no en lo que «sabe» de internet.

Cita la fuente

Cada respuesta indica de qué documento y fragmento sale, para que la verifiques antes de usarla.

Dice «no encontré esa información»

Cuando la respuesta no está en tus documentos, lo dice en lugar de adivinar. Esas preguntas te muestran qué documento hace falta cargar.

Y lo medimos: el piloto incluye un informe de precisión con 50 preguntas de prueba sobre tus propios documentos.

Integraciones: Google Drive, SharePoint, WhatsApp, bases de datos y APIs

Conectamos el asistente a donde ya están tus documentos y a los canales que ya usa tu gente.

Google Drive

Usa carpetas de Google Drive como fuente de documentos del asistente.

SharePoint

Conecta las bibliotecas de documentos de SharePoint de tu empresa.

WhatsApp

Tus clientes o tu equipo preguntan por WhatsApp y reciben la respuesta con su fuente. Las tarifas de Meta por mensajes se cobran aparte, al costo.

Bases de datos

Además de documentos, el asistente puede consultar información de tus bases de datos.

APIs

Lleva las respuestas a tu intranet, tu CRM o tus aplicaciones a través de una API.

La cantidad de fuentes depende del plan: una en Esencial, hasta tres en Profesional e ilimitadas en Empresarial. WhatsApp está incluido desde el plan Profesional.

Planes y precios

Empieza con un piloto de 2 semanas con tus propios documentos y escala cuando veas los resultados.

Precios en COP y USD, más IVA si aplica.

2 semanas

Piloto RAG

Valida la IA con tus propios documentos antes de implementarla.

Pago único

COP 3.900.000

USD 1.200

Más IVA si aplica

Qué incluye

  • Una fuente de documentos
  • Hasta 100 documentos
  • Interfaz web con respuestas citadas
  • Informe de precisión con 50 preguntas de prueba

Si contratas un plan en los siguientes 30 días, te descontamos del setup el 100% de lo que pagaste por el piloto.

Implementación en 3–4 semanas

Esencial

Un asistente con los documentos de tu empresa en tu sitio web.

Setup

COP 9.900.000

USD 2.990

Mensualidad

COP 1.490.000 /mes

USD 450 /mes

Más IVA si aplica

Qué incluye

  • Una fuente (Drive, SharePoint o carga manual)
  • Hasta 1.000 documentos
  • Widget web
  • Respuestas con cita de la fuente

La mensualidad incluye

  • Hosting
  • IA hasta 3.000 preguntas al mes
  • Actualización de documentos
  • Soporte Lun–Vie
Implementación en 6–8 semanas

Profesional

Varias fuentes, web y WhatsApp, con permisos por rol y métricas.

Setup

COP 24.900.000

USD 7.490

Mensualidad

COP 2.990.000 /mes

USD 890 /mes

Más IVA si aplica

Qué incluye

  • Hasta 3 fuentes
  • Hasta 10.000 documentos
  • Web y WhatsApp
  • Permisos por rol
  • Panel de métricas

La mensualidad incluye

  • Hasta 15.000 preguntas al mes
  • Soporte prioritario
  • Revisión mensual de calidad
Implementación en 10–14 semanas

Empresarial

Para operar en tu propia infraestructura, con SSO y auditoría.

Setup desde

COP 59.900.000

USD 17.900

Mensualidad

Según SLA

Más IVA si aplica

Qué incluye

  • Fuentes ilimitadas
  • Despliegue en tu nube u on-premise
  • SSO
  • Auditoría
  • Código fuente incluido

Ten en cuenta

  • Los precios en COP y en USD no incluyen IVA: se suma si aplica.
  • Cada pregunta adicional sobre el tope mensual de tu plan cuesta COP 250 / USD 0,08.
  • Las tarifas de Meta por mensajes de WhatsApp se cobran aparte, al costo.

Preguntas frecuentes sobre sistemas RAG

¿Qué es RAG?

RAG (retrieval augmented generation) es una técnica que combina un buscador con un modelo de lenguaje: primero encuentra en tus documentos los fragmentos que responden la pregunta y después la IA redacta la respuesta con esa información, citando la fuente. Funciona como una base de conocimiento con IA a la que le preguntas en lenguaje natural.

¿En qué se diferencia de ChatGPT?

ChatGPT responde con lo que aprendió durante su entrenamiento y no conoce los documentos internos de tu empresa. Un sistema RAG busca primero en tus documentos, responde con lo que encuentra ahí y te muestra la fuente; además, tú decides qué documentos consulta. Para redactar las respuestas usamos modelos de OpenAI, la empresa que creó ChatGPT, a través de su API.

¿Mis documentos se usan para entrenar la IA?

No. Nosotros no entrenamos ningún modelo con tus documentos: el sistema los consulta en cada pregunta y a OpenAI solo le envía la pregunta, los fragmentos relevantes y los últimos mensajes de la conversación. Según la política vigente de la API de OpenAI, por defecto los datos enviados por API no se usan para entrenar sus modelos; OpenAI puede conservarlos hasta 30 días para detectar abusos, o más tiempo si la ley lo exige.

¿Qué pasa si la respuesta no está en mis documentos?

El asistente te dice «no encontré esa información» en lugar de inventar una respuesta. Esas preguntas sirven para detectar qué documentos faltan: cuando los cargas, el asistente ya puede responderlas.

¿Qué formatos acepta?

PDF con texto, Word (DOCX), TXT y páginas web. También podemos conectar documentos de Google Drive o SharePoint y datos de bases de datos o APIs, según el plan. Si tus PDF son escaneos (imágenes sin texto), lo revisamos contigo en el piloto.

¿Funciona en WhatsApp?

Sí. Desde el plan Profesional, el asistente responde en tu sitio web y en WhatsApp, a través de la API oficial de WhatsApp Business. Las tarifas de Meta por mensajes de WhatsApp se cobran aparte, al costo.

¿Cuánto cuesta?

El piloto de 2 semanas cuesta COP 3.900.000 (USD 1.200). El plan Esencial cuesta COP 9.900.000 (USD 2.990) de setup más COP 1.490.000 (USD 450) al mes; el Profesional, COP 24.900.000 (USD 7.490) de setup más COP 2.990.000 (USD 890) al mes, y el Empresarial, desde COP 59.900.000 (USD 17.900), con mensualidad según SLA. Todos los precios son más IVA si aplica.

¿Cuánto tarda?

El piloto con tus documentos toma 2 semanas. La implementación toma 3–4 semanas en el plan Esencial, 6–8 semanas en el Profesional y 10–14 semanas en el Empresarial.

Prueba RAG con tu propio documento

Haz preguntas en la demo y mira cómo responde con la fuente citada. Cuando quieras probarlo con los documentos de tu empresa, agenda un piloto de 2 semanas.