제6장4 분 분량·공식 매뉴얼 · 2026년 버전

The Kateeb engine, multi-record extraction, zero-hallucination rules, and resume.

6 · 추출 실행

대기열에 확인된 파일과 저장된 스키마가 있으면 메인 이벤트에 참여할 준비가 된 것입니다.

취업 시작

Files 탭에서 Process (N) Verified (또는 플로팅 도크에서 Start 3-Pass AI Extraction)를 클릭하세요. 무슨 일이 일어나는지:

  1. 논문당 1크레딧이 선불로 청구됩니다.
  2. A job은 귀하의 서류와 스키마의 영구 스냅샷을 포함하여 생성됩니다.
  3. 확인 이메일("Sci-database 작업 제출됨")을 받고 토스트 **"작업 제출됨 — N 개의 논문이 현재 처리 중입니다."**가 나타나고 앱이 자동으로 Database 탭으로 전환합니다.

작업 제출됨 - 처리 시작

브라우저를 닫아도 됩니다. 서버에서 처리가 계속되고 결과가 이메일로 전송됩니다.

각 논문은 어떻게 되나요?

서류는 한 번에 하나씩 다음 순서로 처리됩니다.

  1. PDF가 다운로드되고 전체 텍스트가 추출됩니다(최대 950,000자 - 초록뿐만 아니라 전체 논문).
  2. Kateeb 엔진은 엄격한 지침에 따라 스키마에 대해 텍스트를 읽습니다. 핵심 지침은 추출 프롬프트에서 그대로 읽습니다.
  • "스키마와 일치하는 모든 개별 기록 찾기" — 하나의 논문이 여러 행을 생성할 수 있습니다(예: 여러 자료 또는 연구 부문).
  • "논문이 스키마와 관련이 없는 경우 빈 배열을 반환합니다." — 관련 없는 문서는 노이즈가 아닌 아무것도 생성하지 않습니다.
  • "모든 필드에 대해 값이 없거나 존재하지 않거나 99% 확신할 수 없는 경우 정확한 문자열 'N/A'을 반환해야 합니다. null 또는 추측을 사용하지 마십시오."
  • "숫자값은 종이에서 정확한 값을 추출하세요. 반올림하지 마세요."
  1. 추출된 기록과 토큰 사용량이 작업에 저장됩니다.

진행 상황 보기

Database 탭은 작업이 실행되는 동안 몇 초마다 자동으로 새로 고쳐집니다. 각 논문에는 상태 배지가 있습니다.

배지 의미
대기 중 차례를 기다리는 중
처리 중 (스피너) 지금 읽는 중
완료 추출완료
Error 이 문서가 실패했습니다(예: 읽을 수 없거나 스캔한 PDF) — 오류 메시지가 문서에 저장되었습니다.

직무 수준 상태: 처리 중 → 완료(모든 보고서 성공), "X/Y 완료"(부분 성공 - 일부 보고서 실패) 또는 오류(성공 없음).

데이터베이스 탭의 작업 목록

중지하고 다시 시작

  • Stop(작업 행의 ⏹ 아이콘)은 현재 보고서 이후 작업자를 중지합니다. "작업 중지됨 - 처리가 곧 중지됩니다." 이미 완료된 보고서는 데이터를 유지합니다.
  • Resume (↻ 아이콘)은 중지되었거나 부분적인 작업을 다시 시작합니다. 미완성 논문만 다시 대기열에 추가되고 재충전됩니다(각각 1크레딧). 완료된 논문은 결코 다시 처리되거나 재충전되지 않습니다.

작업이 끝나면

  • 이메일을 받습니다 — "Sci-database 작업 완료" — 결과가 CSV 첨부 포함되어 있으므로 앱으로 돌아오기 전에도 데이터베이스가 받은 편지함에 있습니다.
  • 대시보드의 '다음 단계' 카드는 *'새 데이터베이스 탐색'*으로 이동합니다.

규모에 대한 참고 사항: 중단된 단일 용지는 작업을 차단할 수 없습니다. 용지에 오류가 있는 경우 작업자는 오류를 기록하고 계속 진행하며 작업은 부분적인 성공으로 종료되어 그대로 재개하거나 내보낼 수 있습니다.


다음: 검증 및 AI 심사 →

도움이 필요하신가요? FAQ를 확인하세요.
    6 · Running an Extraction | Sci-database Documentation