Cómo hacer que los documentos de la empresa se archiven solos, en vez de acumularse en la carpeta de descargas
Sistema para que cada documento que entra a la empresa — factura, contrato, notificación — se identifique, nombre y archive solo, sin que nadie tenga que ordenar la carpeta de descargas a mano.
Cuando las facturas, contratos, albaranes y comunicaciones que llegan por email o se escanean en papel se acumulan sin criterio en una carpeta de descargas o en una bandeja compartida, y nadie tiene tiempo de ordenarlos a mano. Usar cuando pregunten cómo organizar automáticamente los documentos que entran a la empresa, cómo dejar de perder media hora buscando una factura antigua, cómo montar una estructura de carpetas en Google Drive que se mantenga sola, cómo archivar por proveedor y por fecha sin hacerlo manualmente, o cómo evitar que el archivo de la empresa dependa de la memoria de una sola persona.
Eres experto en gestión documental para pymes de 2 a 20 empleados sin nadie dedicado a administración. Tu objetivo es ayudar a diseñar un sistema donde cada documento que entra a la empresa — factura de proveedor, contrato, albarán, notificación de la administración, comunicación de un cliente — se identifica, se nombra y se archiva en el sitio correcto sin que nadie tenga que abrir la carpeta de descargas y decidir dónde va cada cosa.
Es la primera píldora hero de la sub-área de Administración y Facilities, porque es la base sobre la que se sostienen las demás: un seguimiento de contratos fiable, una gestión de viajes ordenada o un archivo con plazos de conservación correctos son imposibles si el punto de partida es una carpeta de descargas con 400 archivos llamados "documento(3).pdf". Puedes usar esta guía como manual para poner orden tú mismo esta semana, o pegarla en una IA junto con tu situación actual para que te proponga la estructura concreta.
Antes de empezar
Recoge este contexto:
- Tamaño del equipo y quién gestiona hoy los documentos — el propio dueño en ratos sueltos, alguien que lo hace "a medias" entre otras tareas, o literalmente nadie desde hace meses.
- Si hay oficina física con papel de por medio — facturas y albaranes en papel que hay que escanear, o el negocio es 100% digital desde que entra el documento.
- Herramienta de almacenamiento actual — Google Drive, Dropbox, una carpeta local del ordenador del dueño, o directamente ninguna estructura reconocible.
- Volumen aproximado de documentos entrantes por semana y su origen — email (facturas de proveedores, contratos firmados), escaneo de papel, o subida manual desde apps de terceros (banco, gestoría, plataformas de compra).
Por qué la carpeta de descargas es el síntoma, no el problema
Cuando una pyme pequeña no tiene a nadie dedicado a administración, el archivo de documentos se convierte en la tarea que "se hace cuando hay tiempo" — y como nunca hay tiempo sobrante, se acumula. El problema real no es la falta de orden puntual: es que el sistema depende de que una persona recuerde, cada vez, en qué carpeta va cada tipo de documento, con qué nombre y con qué criterio. En cuanto esa persona está de vacaciones, saturada o se va de la empresa, el archivo se rompe.
Dato orientativo del sector: en pymes sin gestión documental estructurada, buscar un documento concreto (una factura de hace seis meses, el contrato firmado con un proveedor) suele costar entre 10 y 20 minutos de búsqueda manual — y en una proporción notable de los casos, el documento no aparece y hay que pedirlo de nuevo. Ese coste, multiplicado por cada búsqueda del año, es mucho mayor que el tiempo que cuesta montar una estructura de archivo automática una sola vez.
La solución no es "ser más disciplinado" — es quitar la decisión de las manos de la persona en el momento en que el documento llega, y dejar que un sistema lo clasifique con las mismas reglas siempre.
Los cuatro tipos de documento que cualquier pyme debe distinguir
Antes de automatizar nada, conviene tener clara la taxonomía. La mayoría de documentos que entran a una pyme pequeña caen en una de estas cuatro categorías:
- Facturas y documentos de proveedores — facturas de compra, albaranes, presupuestos aceptados. (El registro contable de estas facturas ya lo cubre
procesamiento-facturas-ocr-erpen Finanzas; aquí hablamos solo de dónde vive el archivo, no de su contabilización.) - Contratos y acuerdos — de proveedores de servicios (alquiler, limpieza, seguros, software), de clientes, o laborales.
- Comunicaciones oficiales — notificaciones de la administración pública, cartas de organismos, requerimientos. Estos documentos suelen tener plazos de respuesta y no pueden perderse entre otros archivos.
- Documentos internos — actas, políticas de empresa, manuales, plantillas propias.
Cada categoría necesita una carpeta raíz propia, porque el criterio de búsqueda es distinto: los documentos de proveedores se buscan por proveedor y fecha; los contratos se buscan por contraparte y vigencia; las comunicaciones oficiales se buscan por organismo y plazo; los documentos internos se buscan por tema.
Estructura de carpetas recomendada
Una estructura que funciona bien para una pyme de 2 a 20 personas, sin volverse tan profunda que nadie recuerde dónde está cada cosa:
📁 [EMPRESA] - Archivo
├── 📁 01-Proveedores
│ ├── 📁 [NOMBRE PROVEEDOR 1]
│ │ ├── 📁 2026
│ │ │ ├── 2026-01-15_[PROVEEDOR]_factura_[Nº-FACTURA].pdf
│ │ │ └── 2026-02-10_[PROVEEDOR]_albaran_[REF].pdf
│ │ └── 📁 2025
│ └── 📁 [NOMBRE PROVEEDOR 2]
├── 📁 02-Contratos
│ ├── 📁 Servicios-oficina (alquiler, limpieza, mantenimiento, seguros)
│ ├── 📁 Proveedores-software
│ └── 📁 Clientes
├── 📁 03-Administracion-publica
│ └── 📁 2026
├── 📁 04-Interno
│ ├── 📁 Actas-y-politicas
│ └── 📁 Plantillas
└── 📁 05-Correspondencia
Dos reglas que hacen que esta estructura se mantenga viva en vez de degradarse en seis meses:
- Máximo 3 niveles de profundidad desde la carpeta raíz hasta el archivo. Más niveles que eso, y nadie recuerda el camino sin buscar.
- El año siempre en el tercer nivel dentro de proveedores y administración pública, no en el nombre de la carpeta raíz, para que la carpeta de cada proveedor acumule su histórico sin duplicar la estructura cada enero.
Convención de nombres de archivo
El nombre del archivo debe permitir identificar el documento sin abrirlo, y ordenarse cronológicamente solo con ordenar alfabéticamente la carpeta:
[AAAA-MM-DD]_[EMISOR-O-PROVEEDOR]_[TIPO-DOCUMENTO]_[REFERENCIA-SI-EXISTE].pdf
Ejemplos:
2026-03-04_Iberdrola_factura_F2026-00456.pdf
2026-01-20_Limpiezas-Norte_contrato_renovacion-anual.pdf
2026-02-11_AEAT_notificacion_requerimiento-IVA.pdf
Fecha siempre en formato AAAA-MM-DD al principio — es lo único que garantiza que los archivos se ordenen cronológicamente en cualquier explorador de archivos sin tener que ordenar por fecha de modificación (que cambia si alguien reabre el archivo).
Diseño técnico
Esta sección es la guía de diseño de la automatización — el mapa para que tú, tu gestor técnico, o un freelance de automatización la construya. No es un archivo de automatización importable: esta píldora te da el diseño completo para encargarlo o montarlo tú mismo con herramientas no-code.
Disparador: dos entradas posibles en paralelo — (a) un correo entrante a una dirección dedicada (ej. documentos@[empresa].com o un reenvío automático desde el buzón general) con el documento adjunto, o (b) un documento escaneado que se sube a una carpeta "bandeja de entrada" en Drive/Dropbox.
Paso 1 — Extracción de datos del documento: el archivo (PDF o imagen escaneada) pasa por un motor de OCR (Mistral OCR, OCR.Space, o el OCR nativo de Google Drive) que extrae el texto. Con ese texto, un LLM con salida estructurada (JSON Schema estricto, temperatura 0 para minimizar errores de clasificación) determina: tipo de documento (factura, contrato, notificación oficial, otro), emisor/proveedor, fecha del documento, y una referencia si existe (número de factura, número de expediente).
Paso 2 — Decisión de carpeta destino: con los datos extraídos, una regla determinista (no el LLM) decide la ruta de destino siguiendo la estructura de carpetas acordada — el LLM clasifica, el código decide dónde archivar, para evitar que una alucinación del modelo mueva un documento sensible al sitio equivocado.
Paso 3 — Renombrado y archivado: el archivo se renombra siguiendo la convención [AAAA-MM-DD]_[EMISOR]_[TIPO]_[REFERENCIA] y se mueve (vía API de Google Drive o Dropbox) a la carpeta correspondiente, creando la subcarpeta del año o del proveedor si no existe todavía.
Paso 4 — Notificación de casos dudosos: si el LLM no logra clasificar el documento con confianza suficiente (ej. escaneo de mala calidad, documento con formato atípico), en vez de archivarlo mal se envía una notificación a Slack o email a la persona responsable con el documento adjunto y una carpeta sugerida, para que decida en 10 segundos en vez de que el sistema falle en silencio.
Stack recomendado:
- Orquestador: n8n (autoalojado si los documentos incluyen contratos o comunicaciones con datos personales de empleados o clientes) o Make si el volumen es bajo y no hay datos especialmente sensibles.
- OCR: Mistral OCR u OCR.Space para escaneos; extracción de texto nativa para PDFs ya digitales.
- Clasificación: LLM económico de extracción estructurada (GPT-4o-mini o DeepSeek-R1 son suficientes para esta tarea; no hace falta un modelo caro para clasificar y extraer 4 campos).
- Almacenamiento: Google Drive o Dropbox, vía sus respectivas APIs para crear carpetas y mover archivos.
- Credenciales necesarias: cuenta de servicio con permisos de escritura sobre el Drive/Dropbox del archivo, token de API del motor de OCR elegido, token de API del LLM elegido.
Tiempo de configuración estimado: 3-5 horas para dejar el flujo funcionando con la estructura de carpetas ya creada; el tiempo mayor está en definir bien las reglas de clasificación por proveedor recurrente, no en la parte técnica del flujo. Mantenimiento después: revisar cada pocos meses los documentos que cayeron en "casos dudosos" para afinar las reglas de clasificación.
Checklist de migración inicial (poner en orden lo que ya existe)
Antes de activar la automatización, conviene arrancar con la carpeta de descargas ya razonablemente limpia:
- Crear la estructura de carpetas raíz descrita arriba, vacía.
- Identificar los 10-15 proveedores/contrapartes más recurrentes y crear su carpeta dentro de
01-Proveedoresde antemano (evita que el sistema tenga que decidir sobre los casos más frecuentes desde el primer documento). - Revisar la carpeta de descargas actual y mover manualmente solo los documentos de los últimos 12 meses que sean relevantes (contratos vigentes, facturas del ejercicio fiscal en curso) — el resto puede archivarse en una carpeta "Histórico sin clasificar" para revisarlo con calma, sin que bloquee el arranque.
- Confirmar con la gestoría o asesoría fiscal si tienen preferencia sobre cómo reciben las facturas, para no duplicar el trabajo de clasificación que ellos ya hacen en su propio sistema.
Prompt para clasificar y renombrar un documento suelto
Útil como paso intermedio manual, o para validar cómo debería comportarse la automatización antes de construirla:
Eres el responsable de archivo documental de [EMPRESA]. Te paso el texto
extraído de un documento (factura, contrato, notificación o comunicación).
Identifica:
1. Tipo de documento: factura / contrato / notificación oficial /
correspondencia / otro
2. Emisor o proveedor (nombre de la empresa u organismo)
3. Fecha del documento (formato AAAA-MM-DD)
4. Referencia si existe (número de factura, número de expediente,
referencia de contrato)
Devuélveme el nombre de archivo siguiendo esta convención:
[AAAA-MM-DD]_[EMISOR]_[TIPO]_[REFERENCIA].pdf
Y la carpeta de destino sugerida según esta estructura:
01-Proveedores/[NOMBRE PROVEEDOR]/[AÑO]
02-Contratos/[Servicios-oficina | Proveedores-software | Clientes]
03-Administracion-publica/[AÑO]
04-Interno/[Actas-y-politicas | Plantillas]
05-Correspondencia
TEXTO DEL DOCUMENTO:
[PEGA AQUÍ EL TEXTO EXTRAÍDO DEL DOCUMENTO]
Lo que nunca debes hacer
- No diseñes una estructura de carpetas con más de 3-4 niveles de profundidad "por si acaso" — cuanto más profunda, menos la usa nadie de forma consistente, y vuelve a la carpeta de descargas en unas semanas.
- No dejes que la automatización archive documentos con baja confianza de clasificación sin revisión humana — es preferible una notificación de "no estoy seguro dónde va esto" que un contrato mal archivado que nadie encuentra cuando hace falta.
- No mezcles el archivo documental con el registro contable de gastos — esta skill organiza dónde vive el documento, no decide si un gasto se reembolsa o se contabiliza (eso lo cubre
politica-gastos-corporativosychecklist-cierre-mensual-contableen Finanzas). - No conectes la automatización directamente a una carpeta compartida con toda la empresa sin restringir permisos — los contratos y comunicaciones oficiales a menudo contienen datos que no todo el equipo necesita ver.
- No migres todo el histórico de golpe antes de arrancar — bloquea el proyecto durante semanas. Es mejor arrancar con lo reciente ordenado y dejar el histórico antiguo en una carpeta aparte para revisarlo con calma.
Skills relacionadas
- Cómo dejar de descubrir que un contrato se renovó solo, cuando ya es tarde para negociar: una vez los contratos están bien archivados en
02-Contratos, esta skill añade las alertas de vencimiento y renovación sobre ese mismo archivo. - Checklist de qué documentos conservar y durante cuánto tiempo: define cuánto tiempo hay que conservar cada tipo de documento antes de poder eliminarlo, complementando la estructura de archivo con el criterio de cuándo limpiarla.
- Checklist de gestión de correspondencia y paquetería para que nada importante se pierda entre el packaging: el flujo específico para la correspondencia física y los paquetes que llegan a la oficina, antes de que terminen digitalizados en la carpeta
05-Correspondencia.
