← Guardar adjuntos en la nube

Por qué los filtros no ven lo que hay dentro del adjunto

Este no es un argumento teórico. Es un fallo que tuvimos en producción, con nombre de fichero y carpeta equivocada.

¿Por qué los filtros de correo no pueden ordenar los adjuntos?

Porque un filtro lee el sobre, no el contenido: sabe quién manda el mensaje, qué pone el asunto y si trae adjunto, pero nunca abre el PDF. Puede decirte que llegó un documento; no si es una factura, un albarán o un contrato firmado, que es justo la decisión que querías delegar.

El fallo que archivó una factura de software en la carpeta de la luz

La primera versión del motor de Findest emparejaba por palabra clave. Cada regla llevaba una lista de tipos de documento y se comparaba por subcadena: si el nombre de la regla contenía la etiqueta, o la etiqueta contenía el nombre de la regla, se daba por buena.

Con eso, una regla llamada «facturas electricidad» capturaba cualquier documento que la IA etiquetara como «Factura», porque la cadena «facturas electricidad» contiene «factura». Una factura de Make.com acabó archivada en la carpeta de las facturas de la luz. No fue un caso límite raro: era exactamente lo que hacía el algoritmo por diseño, y lo hacía con toda la corrección del mundo.

Un fallo silencioso cuesta más que uno ruidoso

Cuando una automatización peta, te enteras. Cuando acierta el 90 % de las veces y coloca mal el 10 % restante sin decir nada, no te enteras hasta el cierre del trimestre, y para entonces el error lleva meses repitiéndose y ya no sabes cuáles están bien.

Eso convierte el emparejamiento por palabra clave en algo peor que hacerlo a mano: a mano te equivocas de vez en cuando y lo notas al buscar. Una regla mal escrita se equivoca siempre igual, sin cansarse, y encima te da la sensación de que el problema está resuelto.

Lo que solo se puede saber abriendo el fichero

La diferencia entre las dos reglas de abajo no es lo específicas que son. Es que la primera describe cómo se llama la regla y la segunda describe qué pone dentro del documento.

Demasiado vaga

«facturas electricidad»

Es el fallo literal: al comparar por subcadena, esta regla se queda con todo lo que lleve la palabra «factura», que es casi todo lo que entra por administración.

Funciona

«Facturas de la compañía eléctrica del local, con el consumo en kWh del periodo. No la del gas, no la del agua, no facturas de otros proveedores.»

El detalle que de verdad distingue una factura de la luz de las demás está dentro del PDF —el consumo en kWh—, y solo puede usarlo algo que abra el fichero.

Qué cambia en el fichero archivado

Al leer el documento en vez del asunto, el emisor y la fecha salen del propio PDF, así que el nombre es igual de predecible venga de quien venga:

Factura_Iberdrola_2026-04-02.pdf

Se escribe en Gastos Suministros Luz. Que el nombre lo genere la máquina es lo que hace que ordenar la carpeta por nombre de fichero la ordene por emisor y fecha, sin que nadie haya tenido que ser disciplinado.

Conviene saberlo antes

El arreglo no fue afinar las palabras clave, fue quitarlas: las migraciones 0018 y 0019 borraron los filtros por remitente, asunto y nombre de fichero, y los sustituyeron por una descripción en lenguaje natural que evalúa el modelo. Un motor de subcadenas no se arregla con más subcadenas — falla en silencio, que es la peor forma de fallar: nada da error, el documento simplemente aparece donde no toca.

Preguntas sobre el emparejamiento por palabra clave

¿No sería más barato preguntarle a la IA regla por regla?

Sería más caro y además peor. Más caro porque son hasta quince llamadas en lugar de una. Y peor porque preguntando «¿encaja en esta?» de una en una el modelo no tiene con qué comparar y dice que sí a la primera que se le parece; viendo todas tus reglas a la vez puede discriminar entre ellas.

¿Qué pasa si un documento no encaja en ninguna regla?

Se queda sin archivar y aparece en el Historial como «ninguna regla coincide», con el motivo que dio el modelo. Preferimos no archivar a archivar donde no toca, precisamente por el fallo de arriba.

¿Los filtros de Gmail y Outlook tienen este mismo problema?

Tienen uno parecido por otra vía: no comparan por subcadena, pero solo pueden mirar el sobre. Pueden decirte que el mensaje trae un PDF adjunto; no pueden decirte de qué es ese PDF.

Preguntas relacionadas

Guardar los adjuntos de Gmail en Drive, automáticamente

Gmail encamina sobres. Nunca ha sabido encaminar lo que va dentro del adjunto, que es justo lo que quieres archivar. Leerlo →

Cuándo Zapier deja de compensar para archivar adjuntos

Zapier es mejor que Findest en casi todo. Este texto va de la única cosa concreta en la que no lo es. Leerlo →

Llevar los adjuntos de Outlook a OneDrive sin montar un flujo

Microsoft ya incluye una herramienta de automatización para esto. Merece la pena ser preciso sobre dónde deja de ser la opción barata. Leerlo →

Escribe la regla que se te rompió con los filtros.

Si tienes un filtro de correo que captura de más, esa es la primera que merece la pena reescribir como frase.