Documentos
Sube documentos a tu base de conocimiento para que los agentes respondan con tu contenido (RAG).
Objetivo
Construye y gestiona tu base de conocimiento de IA. Sube documentos para que tus agentes respondan preguntas con tu propio contenido usando RAG (Retrieval Augmented Generation). Cada documento se indexa en tu base de conocimiento de Google File Search, puede enriquecerse con un AI overview y puede asignarse a uno o varios agentes.
Acceso
Sidebar -> Documents Ruta: /app/{tenant}/documents
Roles
- owner, admin, agent — abren el módulo, suben documentos, reintentan subidas fallidas y generan AI overviews.
- owner, admin — eliminan documentos y asignan o quitan documentos a los agentes. Los agents ven las asignaciones en modo solo lectura y no ven la acción de eliminar.
- viewer — sin acceso a este módulo.
Requisitos previos
- Una Google AI API key conectada en Integrations (requerida). Hasta conectarla, aparece un aviso y Upload Document abre un diálogo que enlaza a Integrations.
- Un email verificado. La subida se bloquea hasta verificar tu email en los planes que lo requieren.
- Una suscripción activa. La subida se bloquea mientras la suscripción esté restringida o suspendida.
- Cupos de documentos disponibles en tu plan (ver Planes y límites).
Planes y límites
| Límite | Cómo funciona |
|---|---|
| Cantidad de documentos | Tu plan define el número máximo de documentos. Al alcanzarlo, Upload Document muestra un aviso para hacer upgrade. |
| Tamaño de archivo | Tu plan define el límite de tamaño por archivo; el diálogo de subida lo muestra y lo aplica. El máximo absoluto de la plataforma es 100MB por archivo. |
| Ritmo de subida | Hasta 20 subidas por cada 10 minutos por workspace. Reintentar un documento fallido consume el mismo cupo. |
Subir un documento
Pasos:
- Pulsa Upload Document.
- Arrastra un archivo al área de subida, o haz clic para buscarlo.
- Completa los campos.
- (Opcional) Abre Advanced settings para ajustar el chunking.
- Pulsa Upload Document.
Campos:
| Campo | Obligatorio | Notas |
|---|---|---|
| Document File | Sí | El archivo a indexar. Tipos soportados abajo, hasta el límite de tamaño de tu plan. |
| Display Name | No | Por defecto toma el nombre del archivo. Se muestra en la lista y es buscable. |
| Description | No | Indica al agente cuándo apoyarse en este documento. El botón Suggest rellena una plantilla inicial. |
| Document Type | Sí | Selecciona el preset de chunking (ver Tipos de documento). Por defecto General. |
Tipos de archivo soportados:
- PDF, DOCX, XLSX, PPTX, TXT, MD, CSV, JSON, HTML, PNG, JPEG, DOC, XLS, RTF, ODT
Algunos formatos reconocibles no están soportados y se rechazan con un mensaje específico que nombra el formato y sugiere a qué convertirlo: imágenes HEIC/HEIF, WEBP y TIFF (convertir a JPEG o PNG), PowerPoint antiguo PPT (convertir a PPTX), OpenDocument Spreadsheet ODS (convertir a XLSX o CSV) y exportaciones de email EML (convertir a PDF o texto plano).
El contenido del archivo se valida contra su tipo real al subir, no solo por la extensión. Un archivo renombrado o corrupto se rechaza aunque declare un tipo soportado.
Tras subirlo, el documento aparece como Processing y se indexa en segundo plano. El enriquecimiento con IA es automático: se extrae un resumen breve para todos los documentos y, para los de tipo Legal, también se construye un índice por artículo.
Tipos de documento (presets de chunking)
El Document Type controla cómo se divide el archivo en chunks para la búsqueda. Elige el que mejor se ajuste al contenido.
| Tipo | Tamaño de chunk | Overlap | Ideal para |
|---|---|---|---|
| General | 600 tokens | 100 | La mayoría de documentos en lenguaje natural (por defecto). |
| Legal / Regulatory | 800 tokens | 150 | Leyes, contratos y regulaciones. Mantiene juntos los artículos numerados completos y habilita la búsqueda verbatim por artículo. |
| Technical / Code | 1024 tokens | 200 | Código, tablas, procedimientos, hojas de cálculo, CSV y JSON. |
| FAQ / Q&A | 400 tokens | 50 | Contenido de preguntas y respuestas. |
Si dejas el Document Type en su valor por defecto General, Helios elige automáticamente un preset mejor para algunos archivos: hojas de cálculo, CSV y JSON se trocean con el preset Technical para que una fila o registro completo nunca quede partido a la mitad. Una elección explícita de cualquier tipo siempre se respeta y nunca se sobrescribe.
Ajustes avanzados de chunking
Abre Advanced settings en el diálogo de subida para sobrescribir el preset en casos técnicos. Con Advanced activado, se usan sus valores en lugar del preset del Document Type.
| Ajuste | Rango | Notas |
|---|---|---|
| Chunk size | 200 a 2000 tokens | Los chunks más grandes conservan más contexto pero coinciden con menos precisión. La mayoría de documentos funcionan bien entre 400 y 1000 tokens. |
| Overlap | 0 a 400 tokens | Tokens compartidos entre chunks consecutivos. Limitado al 25% del tamaño del chunk. |
Los valores personalizados se ajustan a límites seguros antes de procesar.
Procesamiento y estados
Cada documento muestra un estado:
| Estado | Significado |
|---|---|
| Processing | Se está indexando en tu base de conocimiento. La lista se actualiza automáticamente. |
| Ready | Indexado y disponible para los agentes asignados. |
| Failed | La indexación no se completó. Usa reintentar o eliminar. |
Cada documento también muestra el estado en el store de la base de conocimiento: Ready, Processing, Failed, o No File in Store.
Un documento atascado en Processing por más de 2 minutos sin indexarse se marca automáticamente como Failed para que puedas actuar.
Para un documento Failed (o atascado en Processing), la acción de reintentar te permite volver a seleccionar el archivo y ejecutar la indexación de nuevo. Reaplica las mismas comprobaciones que una subida nueva (Google AI key, verificación de email, tipo, tamaño y el límite de ritmo de subida).
AI overview (enriquecimiento)
Un AI overview es un resumen breve que tu agente usa para describir de qué trata un documento. Para los documentos de tipo Legal, también se guarda un índice por artículo para que el agente pueda citar cualquier artículo verbatim por su número.
- El enriquecimiento corre automáticamente tras cada subida. También puedes generar o regenerar el overview desde la fila del documento (Generate AI overview) o desde la vista de detalle; el control aparece cuando el documento está Ready.
- Los documentos dejados en el tipo General se clasifican automáticamente durante el enriquecimiento: si la extracción detecta que el contenido es en realidad material legal, técnico o de FAQ, el Document Type se actualiza — y un documento detectado como Legal recibe su índice por artículo aunque nunca hayas elegido Legal. Una elección explícita de tipo nunca se sobrescribe.
- Para los PDF legales, el índice de artículos se extrae directamente del texto del documento siempre que es posible, con la extracción por IA como respaldo. Al regenerar se reutiliza el texto guardado cuando existe, lo que lo hace rápido y casi gratis.
- El trabajo corre en segundo plano. Recibes una notificación cuando termina, aunque salgas de la página.
- Costo en tu Google AI key: alrededor de $0.005 por el resumen en documentos cortos, hasta alrededor de $0.10 cuando corren tanto el resumen como el índice de artículos legales en códigos legales largos.
- Regenera tras cambiar el contenido del documento, o si una extracción anterior omitió algo.
Detalle del documento
Haz clic en el nombre de un documento para abrir su vista de detalle. Muestra:
- Información del archivo: tamaño, tipo de archivo, fecha de subida y estado en el store de la base de conocimiento.
- AI overview: título, tipo de documento, total de artículos, total de capítulos, autoridad firmante, fecha de firma, jurisdicción y resumen (cuando se extraen).
- Agentes asignados.
Los archivos originales no se pueden descargar. Helios indexa los documentos en tu base de conocimiento para su recuperación y no guarda una copia separada del archivo original, y Google File Search no ofrece una forma de descargarlo una vez indexado.
Asignar documentos a agentes
Cada fila de documento y la vista de detalle incluyen un control Assign agents.
- Activa un agente para agregar o quitar el documento de su base de conocimiento.
- Asignar el primer documento a un agente activa su base de conocimiento (RAG); quitar el último la desactiva.
- Solo owner y admin pueden cambiar las asignaciones; los agents las ven en modo solo lectura.
- También puedes gestionar las mismas asignaciones por agente desde la sección de base de conocimiento del editor de Agents.
Búsqueda y filtros
- Caja de búsqueda: coincide por nombre de archivo, display name, description y tipo de documento.
- Pills de estado: All statuses, Ready, Processing y Failed, cada uno con su conteo.
- Filtro de tipo: All types, General, Legal / Regulatory, Technical / Code y FAQ / Q&A.
- Los chips de estadística sobre la lista muestran Total Documents y Ready, y también Processing y Failed cuando existen.
Eliminar un documento
Pulsa el icono de eliminar en la fila del documento y confirma. Solo owner y admin ven esta acción. Elimina el documento de forma permanente de tu base de conocimiento y de los agentes a los que estaba asignado, y no se puede deshacer. Si el documento no puede quitarse del store de la base de conocimiento, la eliminación se aborta para que nada quede a medio borrar — inténtalo de nuevo.
Buenas prácticas
- Dale a cada documento un Display Name claro.
- Escribe una Description para que el agente sepa cuándo usar el documento.
- Elige el Document Type correcto. Usa Legal para leyes y contratos y habilitar la búsqueda verbatim por artículo.
- Divide los documentos muy largos por tema.
- Genera el AI overview para que los agentes puedan describir los documentos de un vistazo.
Errores comunes
| Mensaje o situación | Causa | Solución |
|---|---|---|
| Google AI key not connected | No hay Google AI API key configurada | Conéctala en Integrations |
| Please verify your email | Email sin verificar | Verifica tu email y reintenta |
| Invalid file type | Tipo fuera de la lista soportada | Reexporta a un formato soportado |
| ... files aren't supported yet. Convert to ... first | Archivo HEIC/HEIF, WEBP, TIFF, PPT antiguo, ODS o EML | Convierte al formato sugerido y vuelve a subir |
| The file is empty | Archivo de cero bytes | Reexporta el archivo e inténtalo de nuevo |
| This file's content doesn't match its type | Extensión cambiada, o archivo corrupto | Revisa el archivo, reexporta e inténtalo de nuevo |
| We couldn't read this file's content | Archivo corrupto, o un formato que Helios no reconoce | Reexporta a un formato soportado |
| File size exceeds the limit for your plan | Supera el límite de tamaño por archivo de tu plan | Usa un archivo más pequeño o haz upgrade |
| Document Limit Reached | Se alcanzó el límite de documentos del plan | Haz upgrade de tu plan |
| You're uploading too quickly | Más de 20 subidas en 10 minutos | Espera los segundos indicados y reintenta |
| Estado Failed | La indexación falló o expiró | Usa reintentar para volver a subir, o elimina |
| AI overview could not be generated | El modelo no devolvió una respuesta usable (documento muy corto o mal formado, o aún no indexado) | Espera a Ready e inténtalo de nuevo |
Captura

Relacionado
- Agentes de IA (RAG)
- Integraciones (Google AI API key)