Sistemas RAG para empresas en Colombia
Un sistema RAG es una IA que, antes de responder, busca en los documentos de tu empresa —manuales, contratos, políticas— y te contesta con lo que encontró, citando la fuente.
Piloto con tus documentos en 2 semanas.
¿Qué es RAG? Una base de conocimiento con IA, en palabras simples
RAG viene del inglés «retrieval augmented generation»: respuestas generadas a partir de una búsqueda en tus documentos. En la práctica, es un chatbot con los documentos de la empresa que no responde de memoria, sino consultando tus archivos.
Preguntas como le preguntarías a un colega
«¿Cuántos días de vacaciones me corresponden?» o «¿Qué dice el contrato con este proveedor sobre penalidades?». Sin buscar carpeta por carpeta.
La IA busca en tus documentos, no en internet
Solo consulta los documentos que tu empresa decide cargar. Así, las respuestas siguen tus políticas y no lo que dice una página cualquiera.
Responde y te muestra de dónde lo sacó
Cada respuesta trae la cita del documento para que la verifiques. Si la información no está en tus documentos, te lo dice.
Piénsalo como un empleado nuevo que se leyó todos los manuales de la empresa y que, cada vez que responde, te muestra el párrafo de donde lo sacó.
Casos de uso por sector
Un chatbot con los documentos de la empresa sirve donde la gente pierde tiempo buscando información en manuales, contratos o normativa.
Salud
Protocolos clínicos, normativa del sector y auditoría de cuentas médicas, con la fuente citada.
- Protocolos clínicos
- Normativa del sector
- Auditoría de cuentas médicas
Legal
Buscar en contratos con IA, conceptos jurídicos internos y normativa, con la cláusula citada.
- Contratos
- Conceptos jurídicos internos
- Normativa
Soporte
Un asistente IA para manuales internos, políticas y la base de conocimiento de tus agentes.
- Manuales
- Políticas
- Base de conocimiento para agentes
Cómo funciona la retrieval augmented generation (RAG)
Cuatro pasos entre tus documentos y una respuesta con cita.
- 1
Documentos
Extraemos el texto de tus PDF, Word, TXT o páginas web y lo dividimos en fragmentos por párrafos. Cada fragmento recuerda de qué documento viene.
- 2
Índice
Los fragmentos se guardan en un índice de búsqueda en el servidor. El modelo de IA no se reentrena: tus documentos quedan en el índice, no dentro del modelo.
- 3
Búsqueda
Con cada pregunta, el sistema recupera los fragmentos más relevantes (el «retrieval»). En la demo, la búsqueda es léxica, tipo BM25, y toma los 5 mejores.
- 4
Respuesta con cita
Un modelo de lenguaje (por defecto, GPT-4o mini de OpenAI) redacta la respuesta con esos fragmentos y marca cada dato con [1], [2]… para que abras la fuente.
- Pregunta
- ¿Con cuánta anticipación debo pedir vacaciones?
- Respuesta
- Debes pedirlas con mínimo 15 días hábiles de anticipación, por escrito a tu jefe inmediato [1].
- Fuente
[1] Reglamento interno.pdf
«Las vacaciones se solicitan por escrito al jefe inmediato con mínimo 15 días hábiles de anticipación…»
Seguridad y privacidad de tus documentos
Esto es lo que hace hoy el sistema con tus documentos y tus preguntas.
Dónde se guardan tus documentos
En el servidor de KopTup. Allí extraemos el texto, lo dividimos en fragmentos y construimos el índice de búsqueda. Las preguntas y respuestas también quedan registradas en ese servidor.
Qué proveedor de IA usamos
OpenAI, a través de su API. El modelo por defecto es GPT-4o mini. La clave de acceso a OpenAI se queda en nuestro servidor: nunca llega al navegador.
Qué se envía a OpenAI
Solo lo necesario para redactar cada respuesta: tu pregunta, los fragmentos más relevantes (no el documento completo), las instrucciones del asistente y los últimos mensajes de la conversación.
Tus documentos no entrenan la IA
Según la política vigente de la API de OpenAI, por defecto los datos enviados por API no se usan para entrenar sus modelos. OpenAI puede conservarlos hasta 30 días para detectar abusos.
Si necesitas más control
El plan Profesional agrega permisos por rol, y el Empresarial se despliega en tu nube o en tus servidores (on-premise), con SSO y auditoría.
En la demo pública
En «Prueba con tu documento», el archivo se procesa solo en la memoria del servidor (no se guarda en disco ni en una base de datos) y el documento, su índice y la conversación se borran 1 hora después de subirlo. Solo guardamos tu email, con tu autorización, y el tipo y la extensión del documento, no su contenido. Aun así, no subas información confidencial.
Cómo evitamos respuestas inventadas
Una IA que inventa respuestas es peor que no tener IA. Por eso el sistema sigue tres reglas.
Responde solo con lo que está en tus documentos
El modelo recibe los fragmentos encontrados en tus documentos y la instrucción de basarse en ellos, no en lo que «sabe» de internet.
Cita la fuente
Cada respuesta indica de qué documento y fragmento sale, para que la verifiques antes de usarla.
Dice «no encontré esa información»
Cuando la respuesta no está en tus documentos, lo dice en lugar de adivinar. Esas preguntas te muestran qué documento hace falta cargar.
Y lo medimos: el piloto incluye un informe de precisión con 50 preguntas de prueba sobre tus propios documentos.
Integraciones: Google Drive, SharePoint, WhatsApp, bases de datos y APIs
Conectamos el asistente a donde ya están tus documentos y a los canales que ya usa tu gente.
Google Drive
Usa carpetas de Google Drive como fuente de documentos del asistente.
SharePoint
Conecta las bibliotecas de documentos de SharePoint de tu empresa.
Tus clientes o tu equipo preguntan por WhatsApp y reciben la respuesta con su fuente. Las tarifas de Meta por mensajes se cobran aparte, al costo.
Bases de datos
Además de documentos, el asistente puede consultar información de tus bases de datos.
APIs
Lleva las respuestas a tu intranet, tu CRM o tus aplicaciones a través de una API.
La cantidad de fuentes depende del plan: una en Esencial, hasta tres en Profesional e ilimitadas en Empresarial. WhatsApp está incluido desde el plan Profesional.
Planes y precios
Empieza con un piloto de 2 semanas con tus propios documentos y escala cuando veas los resultados.
Precios en COP y USD, más IVA si aplica.
Piloto RAG
Valida la IA con tus propios documentos antes de implementarla.
Pago único
COP 3.900.000
USD 1.200
Más IVA si aplica
Qué incluye
- Una fuente de documentos
- Hasta 100 documentos
- Interfaz web con respuestas citadas
- Informe de precisión con 50 preguntas de prueba
Si contratas un plan en los siguientes 30 días, te descontamos del setup el 100% de lo que pagaste por el piloto.
Esencial
Un asistente con los documentos de tu empresa en tu sitio web.
Setup
COP 9.900.000
USD 2.990
Mensualidad
COP 1.490.000 /mes
USD 450 /mes
Más IVA si aplica
Qué incluye
- Una fuente (Drive, SharePoint o carga manual)
- Hasta 1.000 documentos
- Widget web
- Respuestas con cita de la fuente
La mensualidad incluye
- Hosting
- IA hasta 3.000 preguntas al mes
- Actualización de documentos
- Soporte Lun–Vie
Profesional
Varias fuentes, web y WhatsApp, con permisos por rol y métricas.
Setup
COP 24.900.000
USD 7.490
Mensualidad
COP 2.990.000 /mes
USD 890 /mes
Más IVA si aplica
Qué incluye
- Hasta 3 fuentes
- Hasta 10.000 documentos
- Web y WhatsApp
- Permisos por rol
- Panel de métricas
La mensualidad incluye
- Hasta 15.000 preguntas al mes
- Soporte prioritario
- Revisión mensual de calidad
Empresarial
Para operar en tu propia infraestructura, con SSO y auditoría.
Setup desde
COP 59.900.000
USD 17.900
Mensualidad
Según SLA
Más IVA si aplica
Qué incluye
- Fuentes ilimitadas
- Despliegue en tu nube u on-premise
- SSO
- Auditoría
- Código fuente incluido
Ten en cuenta
- Los precios en COP y en USD no incluyen IVA: se suma si aplica.
- Cada pregunta adicional sobre el tope mensual de tu plan cuesta COP 250 / USD 0,08.
- Las tarifas de Meta por mensajes de WhatsApp se cobran aparte, al costo.
Preguntas frecuentes sobre sistemas RAG
¿Qué es RAG?
RAG (retrieval augmented generation) es una técnica que combina un buscador con un modelo de lenguaje: primero encuentra en tus documentos los fragmentos que responden la pregunta y después la IA redacta la respuesta con esa información, citando la fuente. Funciona como una base de conocimiento con IA a la que le preguntas en lenguaje natural.
¿En qué se diferencia de ChatGPT?
ChatGPT responde con lo que aprendió durante su entrenamiento y no conoce los documentos internos de tu empresa. Un sistema RAG busca primero en tus documentos, responde con lo que encuentra ahí y te muestra la fuente; además, tú decides qué documentos consulta. Para redactar las respuestas usamos modelos de OpenAI, la empresa que creó ChatGPT, a través de su API.
¿Mis documentos se usan para entrenar la IA?
No. Nosotros no entrenamos ningún modelo con tus documentos: el sistema los consulta en cada pregunta y a OpenAI solo le envía la pregunta, los fragmentos relevantes y los últimos mensajes de la conversación. Según la política vigente de la API de OpenAI, por defecto los datos enviados por API no se usan para entrenar sus modelos; OpenAI puede conservarlos hasta 30 días para detectar abusos, o más tiempo si la ley lo exige.
¿Qué pasa si la respuesta no está en mis documentos?
El asistente te dice «no encontré esa información» en lugar de inventar una respuesta. Esas preguntas sirven para detectar qué documentos faltan: cuando los cargas, el asistente ya puede responderlas.
¿Qué formatos acepta?
PDF con texto, Word (DOCX), TXT y páginas web. También podemos conectar documentos de Google Drive o SharePoint y datos de bases de datos o APIs, según el plan. Si tus PDF son escaneos (imágenes sin texto), lo revisamos contigo en el piloto.
¿Funciona en WhatsApp?
Sí. Desde el plan Profesional, el asistente responde en tu sitio web y en WhatsApp, a través de la API oficial de WhatsApp Business. Las tarifas de Meta por mensajes de WhatsApp se cobran aparte, al costo.
¿Cuánto cuesta?
El piloto de 2 semanas cuesta COP 3.900.000 (USD 1.200). El plan Esencial cuesta COP 9.900.000 (USD 2.990) de setup más COP 1.490.000 (USD 450) al mes; el Profesional, COP 24.900.000 (USD 7.490) de setup más COP 2.990.000 (USD 890) al mes, y el Empresarial, desde COP 59.900.000 (USD 17.900), con mensualidad según SLA. Todos los precios son más IVA si aplica.
¿Cuánto tarda?
El piloto con tus documentos toma 2 semanas. La implementación toma 3–4 semanas en el plan Esencial, 6–8 semanas en el Profesional y 10–14 semanas en el Empresarial.
Prueba RAG con tu propio documento
Haz preguntas en la demo y mira cómo responde con la fuente citada. Cuando quieras probarlo con los documentos de tu empresa, agenda un piloto de 2 semanas.