⚙️ Indexación más robusta: worker de respaldo, tablas sin partir y auto-indexado de adjuntos
Tres mejoras internas del análisis de documentos. (1) Un worker en segundo plano (cada 5 min) completa la indexación de archivos que se quedaron a medias (p. ej. si cerraste la pestaña). (2) Al trocear documentos para la IA, las tablas no se parten: las filas de una tabla se mantienen juntas para no separar una cifra de su concepto. (3) Cuando la IA lee un adjunto que aún no estaba indexado, lo deja en cola para indexarlo de fondo, así la próxima consulta es más rápida.
Nuevo
- ⚙️ Worker de ingesta cada 5 min: termina lo que quedó a medias (sin perder indexaciones)
- 📊 Las tablas no se parten al trocear el documento (cifras junto a su concepto)
Mejorado
- ⚡ Los adjuntos leídos al vuelo se indexan en segundo plano para la próxima vez
Worker de ingesta (#17)
- Nuevo endpoint /api/files/ingest-worker (protegido por CRON_SECRET) que procesa archivos atascados en estado "en cola".
- Cron en el NAS cada 5 minutos; cierra el hueco de la ingesta dirigida por el cliente si el navegador se cierra.
Chunking consciente de tablas (#19)
- Detección de bloques de tabla (filas con columnas y números); si caben, se indexan como un bloque entero en vez de partirse.
Auto-indexado de adjuntos (#16)
- Si la IA extrae un adjunto no indexado al vuelo, lo marca para que el worker lo indexe en segundo plano.
