IdiomaENES
GuidesSep 9, 2026 · 8 min de lectura

Cómo construir una base de conocimiento con IA para tu empresa

La mayoría de las bases de conocimiento empeoran al crecer. Empieza por las veinte preguntas que de verdad te hacen, indexa en el orden correcto y pruébala antes que tus clientes.

Hernan MoyaCo-Founder
A source list where two policies are indexed, a slide deck is skipped, and one question has nothing written behind it
A source list where two policies are indexed, a slide deck is skipped, and one question has nothing written behind it

La mayoría de las bases de conocimiento empeoran a medida que crecen. Los primeros diez documentos responden bien, y el número cien vuelve al asistente más vago en lugar de más listo.

Eso no es un problema de escala. Es lo que pasa cuando indexas todo lo que tienes en vez de lo que la gente realmente pregunta.

Empieza por las preguntas, no por los documentos

El impulso es apuntar un crawler al centro de ayuda y dejarlo correr. Es el primer movimiento equivocado, porque decide qué sabe el asistente antes de que alguien haya decidido qué necesita saber.

Empieza por las veinte preguntas que tu equipo responde más seguido. Las bandejas de soporte, los registros del buscador del sitio y los primeros cinco minutos de una llamada de ventas te dan las veinte en una tarde.

Al lado de cada pregunta, escribe el documento que la responde. Van a aparecer tres tipos de fila: una pregunta con un buen documento detrás, una pregunta con un documento que la responde a medias, y una pregunta que nadie escribió nunca.

Ese tercer tipo es lo más valioso que vas a producir esta semana.

InteractiveEl método, paso a paso
El hueco es el punto

Una base de conocimiento no puede responder desde un documento que no existe. Escribir cuatro páginas cortas para cerrar cuatro huecos vale más que indexar cuatrocientas que nunca trataron sobre la pregunta.

Qué indexar primero y qué dejar para después

Para un sistema de recuperación, los documentos no valen lo mismo. Algunos ya están escritos como respuestas. Otros se escribieron para persuadir, o para leerse con una persona hablando encima.

Fuente
Cuándo
Por qué
Centro de ayuda y FAQs
Primero
Ya tienen forma de pregunta y respuesta
Documentación de producto
Primero
Los encabezados dan contexto a cada fragmento
Políticas: envíos, devoluciones, privacidad
Temprano
Mucho volumen de preguntas y casi no cambian
One-pagers de ventas
Después
Escritos para persuadir: la promesa supera al detalle
Wikis internos y actas de reunión
Después
Se contradicen entre sí y nadie lo nota
Exportaciones de diapositivas
Casi nunca
Fragmentos sin oraciones recuperan mal

Seis documentos buenos van a responder más preguntas que cuatrocientos mediocres. Empieza con un alcance lo bastante chico como para poder leer cada respuesta que da el asistente.

El mismo equipo, el mismo contenido. La diferencia es lo que quedó afuera.

Lee tu cobertura antes de indexar nada

La lista de preguntas y fuentes es un mapa. Léela antes de subir nada, porque te dice dónde está el trabajo.

InteractiveVeinte preguntas, y qué las responde

Las filas verdes están listas para indexar. Las ámbar necesitan que se extienda el documento antes de que valga la pena. Las rojas son trabajo de escritura, y ningún ajuste de recuperación las va a sustituir.

Qué se rompe, y cómo se ve cuando pasa

Cuatro fallas cubren casi todo lo que sale mal en el primer mes.

Lo que ves
Qué está mal en realidad
Qué hacer
Se contradice entre dos conversaciones
Dos documentos no coinciden y ambos están indexados
Fusiónalos, o borra el más viejo
Una respuesta segura que era cierta el trimestre pasado
Nada marca un documento como vencido
Dale a cada fuente un dueño y una fecha de revisión
Cita una tabla y se equivoca en los números
La tabla perdió sus encabezados al importarse
Re-expórtala como texto, o reescribe las filas como oraciones
Un archivo entero no devuelve nada
El PDF es un escaneo, así que no hay texto que leer
Pásale OCR antes de subirlo

La primera fila es sobre la que discuten los equipos. El asistente no está siendo inconsistente: tu documentación lo es, y hasta ahora nadie tenía una herramienta que la leyera toda junta.

Decide qué no entra

Un asistente responde desde lo que le des, a quien pueda llegar al widget. Ese es todo el valor, y también todo el riesgo.

Un widget público vuelve público al documento

Lo que esté indexado detrás de un widget en tu sitio está, en la práctica, publicado. Si no sobreviviría en una página sin login, no va en esa base de conocimiento.

Bandas salariales, roadmap, nombres de clientes y post-mortems se le parecen a cualquier documento común cuando los lee un crawler. La respuesta habitual son dos bases de conocimiento: una para el sitio y otra para el equipo, con widgets y accesos distintos.

Pruébala antes que tus clientes

Tus veinte preguntas ahora son un set de prueba, que es para lo que servía escribirlas.

Haz las veinte y marca cada respuesta como correcta, incorrecta o parcial. Un primer puntaje honesto suele rondar 14 / 20, y las seis fallas sirven más que los catorce aciertos porque cada una nombra una causa concreta.

Lee los fragmentos detrás de las respuestas malas, no solo las respuestas. Una respuesta mala construida sobre un buen fragmento significa que el documento está mal; una construida sobre un fragmento débil significa que falló la recuperación.

welcomeai.devCómo mejorar recuperación cambiando tamaño de chunks

Evita que se pudra

Una base de conocimiento no es un proyecto que termina. Los documentos detrás cambian, y un índice que no los sigue empieza a responder desde el trimestre pasado.

  1. Conecta las fuentes que cambian seguido, para que las ediciones lleguen sin subir nada
  2. Vuelve a correr las veinte preguntas después de cualquier cambio grande de contenido
  3. Lee cada mes las preguntas que no obtuvieron una buena respuesta
  4. Dale un dueño a cada fuente: un documento sin dueño es un documento que nadie actualiza

El cuarto es el menos técnico y el que más peso carga.

Preguntas frecuentes

Escribe tus veinte preguntas primero, marca las que no responde nada, e indexa solo lo que queda. Los huecos que encuentres en esa hora van a hacer más por el asistente que cualquier ajuste de la página.

Etiquetadoknowledge-baseragretrievaldocumentationgetting-started
Escrito porHernan Moya

Sigue leyendo