Preparar los documentos para un asistente de IA: qué ordenar antes
Crear una base de información utilizable, actualizada y accesible a los roles correctos.
Equipo editorial de SqualiOnline · 2026-09-07
Un asistente de IA no sabe nada de vuestra empresa que no le hayáis dado. Si en la carpeta de documentos conviven tres versiones del mismo procedimiento, el asistente elegirá una: no la más reciente, sino la mejor escrita para la pregunta recibida. Un cliente se oirá responder con las condiciones del año pasado, y la respuesta tendrá el mismo aire seguro que todas las demás.
Por eso el trabajo real empieza antes del sistema: poner en orden qué existe, qué versión vale, quién puede verlo y qué ocurre cuando la respuesta no está. Es un trabajo que sirve de todas formas, aunque al final el asistente no se haga: son las mismas cosas que ralentizan a los empleados nuevos.
Inventario: qué existe, quién responde de ello, qué versión vale
El primer paso es una lista. No de las carpetas, sino de los documentos que contienen respuestas: manuales, procedimientos, condiciones de venta, fichas técnicas, respuestas ya dadas por soporte. Para cada uno hacen falta cuatro datos.
| Documento | Quién responde de él | Última actualización | Quién puede verlo | Estado |
|---|---|---|---|---|
| Condiciones de venta | Administración | Actualizado este año | Público | Válido, versión única |
| Manual de instalación, modelo A | Oficina técnica | Actualizado este año | Público | Válido |
| Manual de instalación, modelo A (antiguo) | Oficina técnica | Sin tocar desde hace años | Nadie | Por archivar fuera de las fuentes |
| Tarifa de distribuidores | Comercial | Actualizado cada trimestre | Interno | Válido, no debe salir |
| Procedimiento de devoluciones | Soporte | Fecha no conocida | Público | Por reescribir antes de usarla |
| Apuntes del curso interno | Nadie | Fecha no conocida | Interno | Excluido: nadie lo mantiene |
Las filas más útiles son las dos últimas. Un documento del que nadie responde no es una fuente: es material de archivo. Y un documento sin fecha no se puede juzgar, así que no se puede usar para responder a un cliente.
Público, interno, confidencial: la separación va antes
La clasificación no es un trámite burocrático: es lo que impide que un asistente dirigido a los clientes cite la tarifa de los distribuidores. Tres niveles bastan casi siempre.
- Público: se le puede decir a cualquiera que escriba. Si un contenido no se lo diríais a un cliente desconocido por teléfono, no es público.
- Interno: sirve a los empleados, no a los clientes. Márgenes, condiciones particulares, procedimientos que revelan la organización interna.
- Confidencial: datos personales, contratos individuales, información sobre clientes terceros. Por norma no entra en las fuentes del asistente, y si entra necesita controles de acceso propios.
La regla práctica es que la separación está en los permisos, no en las instrucciones. Un asistente al que se le pide que no revele la tarifa, pero que tiene la tarifa entre las fuentes disponibles, tarde o temprano la usará: basta una pregunta formulada de forma indirecta. El documento confidencial no debe ser accesible, no basta con desaconsejarlo.
Documentos escritos para leerse por partes
Un asistente no lee un manual de principio a fin: recupera los pasajes que parecen responder a la pregunta. Un documento pensado para una lectura continua se comporta mal, porque sus partes no se sostienen por sí solas.
- Títulos reales y específicos. Una sección llamada «Generalidades» no dice de qué trata; «Garantía sobre las piezas sustituidas» sí.
- Cada sección debe tener sentido por sí sola. Las remisiones implícitas —«como se ha dicho antes», «en este caso»— se vuelven incomprensibles en cuanto se extrae el fragmento.
- La información que importa no debe estar dentro de una imagen. Una tarifa fotografiada, un esquema escaneado o un documento hecho de páginas capturadas por escáner son, para el sistema, páginas vacías.
- Las tablas hay que mantenerlas como tablas, con los encabezados repetidos si son largas.
- Las condiciones hay que escribirlas enteras donde hacen falta: si la regla sobre las devoluciones depende de un anexo que no está entre las fuentes, la respuesta será incompleta y nadie se dará cuenta.
- Mejor un documento breve y verdadero que uno largo y genérico: la longitud no ayuda a la recuperación, la precisión sí.
Qué debe ocurrir cuando la fuente no está
Es la decisión que distingue un sistema fiable de uno peligroso, y debéis tomarla vosotros, no dejarla en manos de los ajustes predeterminados. Las posibilidades son pocas: responder que la información no está disponible, proponer el contacto con una persona, o abrir una solicitud interna.
Quién actualiza, y con qué ritmo
Una base de conocimiento se estropea quedándose quieta. Las condiciones cambian, un producto deja de fabricarse, un procedimiento se sustituye, y el asistente sigue respondiendo como antes con perfecta seguridad.
- Cada documento tiene un responsable con nombre y apellidos, no una oficina.
- Cada documento tiene una fecha de revisión: cuándo hay que volver a mirarlo aunque nadie señale nada.
- Existe un único punto en el que se actualiza. Si el documento vive en dos sitios, uno de los dos estará desactualizado y no sabréis cuál.
- Cuando un documento se sustituye, el anterior sale de las fuentes en el mismo momento. No basta con cambiarle el nombre: mientras sea accesible, se usará.
- Las preguntas a las que el asistente no ha sabido responder se vuelven a leer a intervalos regulares: son la lista de los documentos que faltan, escrita por los clientes.
Si este trabajo no es sostenible —nadie puede ocuparse de él, nadie puede decir qué versión vale— es un buen motivo para posponer el proyecto o para reducir su alcance a una sola área, aquella donde los documentos están en orden. Un asistente construido sobre fuentes que nadie mantiene empeora la situación: da respuestas erróneas más deprisa que antes.
Lo que esta guía no cubre
Aquí se prepara el conocimiento: qué entra entre las fuentes, en qué forma y con qué permisos. Cómo se verifica después el comportamiento del asistente —las pruebas que hacer antes de ponerlo en marcha, el control de las respuestas, la gestión de los errores— es un trabajo distinto y posterior, tratado en otro lugar. Vale la pena recordar una distinción: poner documentos a disposición de un sistema que los recupera no es lo mismo que entrenar un modelo con vuestros datos, y las dos cosas tienen implicaciones distintas.
Preguntas frecuentes
¿Cuántos documentos hacen falta para empezar?
Menos de los que imagináis. Es mejor partir de un área acotada con documentos actualizados y con un responsable —por ejemplo las condiciones de venta y las preguntas frecuentes de soporte— que cargar todo el archivo. El alcance se amplía cuando el primero funciona.
¿Está bien cargar los documentos tal cual están?
Depende de cómo estén hechos. Los textos con títulos claros y secciones autónomas funcionan enseguida. Los documentos capturados por escáner, los que contienen la información dentro de las imágenes y los llenos de remisiones internas hay que rehacerlos, si no el sistema no encuentra lo que buscáis.
¿Qué hago con los documentos antiguos?
Se trasladan fuera de las fuentes consultables, a un archivo aparte. Conservarlos suele ser necesario, hacerlos accesibles al asistente no: mientras estén en el recorrido, se usarán para responder, y ninguna instrucción lo impide de forma fiable.
Evaluamos si tus documentos están listos para un asistente de IA.
Si quieres hablarlo, el servicio que se ocupa de esto es Inteligencia artificial.

