ACTAMotor de ingesta documental

Facturas, remitos y recibos que hoy se tipean a mano pasan a ser datos estructurados y verificados, con revisión humana solo donde hace falta.

⬆ Subiste una factura → Resultado en tiempo real
EmisorELECTRÓNICA DEL URUGUAY S.A.
RUT21.123.456/00234
N° DocumentoF-00012345
Total$ 234.567,00
IVA$ 49.259,07
Confianza✅ 100% — Parseo directo CFE XML

🧬 Pipeline de extracción

1

¿Adjunto .xml del CFE?

El comprobante fiscal electrónico uruguayo ya viene estructurado. Parseo directo del XML de DGI.

100% exacto · Costo cero
2

¿PDF con capa de texto?

Extracción con pdfplumber + LLM para resolver ambigüedades.

≥ 95% · Costo bajo
3

¿Imagen o PDF escaneado?

OCR con Tesseract + LLM. Local, gratuito, suficiente.

≥ 80% · Costo bajo
4

Revisión humana solo si hace falta

Extracciones con baja confianza se derivan a revisión manual. Interfaz server-rendered con HTMX. Editable desde el celular por SSH.

Por qué ACTA

🎯

Precisión a costo cero

Un alto porcentaje de facturas de proveedor caen en la primera rama: XML del CFE → parseo directo. 100% exacto. Sin LLM, sin API, sin costo.

🔒

Confianza en el dato

Cada extracción produce un score de confianza. Por debajo del umbral → revisión humana obligatoria. Sabés qué datos son fiables y cuáles no.

📱

Debug desde el celular

HTMX + server-rendered. Cero build, cero bundler, cero node_modules. Editas un .html con nano por SSH y ya funciona.

🧩

Trazabilidad completa

Quién digitó, qué leyó la máquina, qué corrigió el humano. Feedback loop: cada revisión entrena el modelo.

n8n orquesta

n8n hace triggers, ruteo, reintentos y llamadas HTTP. Toda la lógica de negocio vive en un servicio Python propio (acta-core).

🛡️

Sin vendor lock-in

LLM externo para arrancar, self-hosted después. Tesseract + pdfplumber son locales, gratis y suficientes.

🔀 Arquitectura

Documento entrante
│
├─ ¿XML del CFE?        → acta-core parsea directo     → score ≥ 95%  → OK
├─ ¿PDF con texto?      → pdfplumber + LLM             → score ≥ 70%  → OK
└─ ¿Escaneado/imagen?   → Tesseract OCR + LLM          → score < 70% → Revisión humana
                                                              │
                                                              ▼
                                                   Interfaz HTMX
                                                   Corregí desde el celular

vs. Competencia

OtrosACTA
Precisión CFEDepende del LLM100% — parseo directo XML
Costo por documentoUSD 0.01-0.10 (LLM)$0 — sin LLM en rama 1
Sabés cuándo fallaNoSí — score de confianza
Debug desde celularNo (React/build)Sí (HTMX, SSH + nano)
Versionable en gitNo (workflows 60 nodos)Sí (código Python + HTML)
TesteableNoSí (pytest sobre acta-core)

¿Tenés facturas que alguien tipea a mano?

En una hora tenés el primer documento procesado. Sin instalación, sin contratos, sin tarjeta.

🚀 Probar ahora ⬇ Descargar workflow n8n ✉️ Contactar