The Kateeb engine, multi-record extraction, zero-hallucination rules, and resume.
6 · Ejecutando una extracción
Con archivos verificados en la cola y un esquema guardado, está listo para el evento principal.
Comenzando un trabajo
En la pestaña Archivos, haga clic en Proceso (N) verificado (o Iniciar extracción de IA de 3 pasos en el muelle flotante). Qué pasa:
- 1 crédito por artículo se cobra por adelantado.
- Se crea un trabajo que contiene sus documentos y una instantánea permanente de su esquema.
- Recibes un correo electrónico de confirmación ("Sci-database Trabajo enviado"), aparece el brindis "Trabajo enviado: ahora se están procesando N documentos". aparece y la aplicación te cambia a la pestaña Base de datos automáticamente.

Puede cerrar el navegador; el procesamiento continúa en el servidor y los resultados se le enviarán por correo electrónico.
Qué sucede con cada documento
Los documentos se procesan uno a la vez, en el siguiente orden:
- Se descarga el PDF y se extrae el texto completo (hasta ~950 000 caracteres: artículos completos, no solo resúmenes).
- El motor Kateeb lee el texto de su esquema siguiendo instrucciones estrictas, las claves, palabra por palabra del mensaje de extracción:
- "Buscar todos los registros distintos que coincidan con el esquema": un documento puede producir varias filas (por ejemplo, varios materiales o brazos de estudio).
- "Si un artículo es irrelevante para el esquema, devuelva una matriz vacía": los artículos irrelevantes no producen nada, ni ruido.
- "Para cualquier campo, si falta el valor, no está presente o no está 99% seguro, DEBE devolver la cadena exacta 'N/A'. No utilice nulo ni conjetura."
- "Para valores numéricos, extraiga el valor exacto del papel. No redondee."
- Los registros extraídos y el uso de tokens se guardan en el trabajo.
Observando el progreso
La pestaña Base de datos se actualiza automáticamente cada pocos segundos mientras se ejecuta un trabajo. Cada periódico lleva una insignia de estatus:
| Insignia | Significado |
|---|---|
| En cola | Esperando su turno |
| Procesando (spinner) | Siendo leído ahora mismo |
| Completado | Extracción terminada |
| Error | Este documento falló (por ejemplo, PDF ilegible/escaneado): el mensaje de error se almacena en el documento |
Estados a nivel de trabajo: Procesando → Completado (todos los trabajos fueron exitosos), "X/Y completado" (éxito parcial: algunos trabajos fallaron) o Error (ninguno fue exitoso).

Detener y reanudar
- Detener (ícono ⏹ en la fila del trabajo) detiene al trabajador después del trabajo actual: "Trabajo detenido: el procesamiento se detendrá en breve". Los trabajos ya completados conservan sus datos.
- Reanudar (icono ↻) reinicia un trabajo detenido o parcial. Solo los inconclusos se vuelven a poner en cola y se recargan (1 crédito cada uno); los trabajos completos nunca se reprocesan ni se recargan.
Cuando termina el trabajo
- Recibirás un correo electrónico - "Sci-database Trabajo finalizado" - con los resultados CSV adjuntos, por lo que tu base de datos estará en tu bandeja de entrada incluso antes de que regreses a la aplicación.
- La tarjeta de "siguiente paso" del Panel pasa a "Explore su nueva base de datos".
Una nota sobre la escala: un solo documento atascado no puede bloquear su trabajo; si un documento falla, el trabajador registra el error y continúa, y el trabajo finaliza como un éxito parcial que puede reanudar o exportar tal cual.
Siguiente: Validación y juez de IA →