Documentation Sci-database
Transformez vos articles de recherche en bases de données structurées et vérifiées avec une traçabilité intégrale. Découvrez comment chercher parmi 200M+ d'articles et extraire vos données.
Table des Matières
12 Chapitres · 45 min au totalPremiers Pas
2 chaptersFlux de Travail
4 chapters3 · Searching Papers
4 min de lectureSearch 200M+ papers across OpenAlex, CORE, and Semantic Scholar with focused keywords.
4 · Files & Uploads
4 min de lectureAutomatic PDF download verification, drag-and-drop uploads, and fixing unverified files.
5 · Building Your Schema
5 min de lectureAI-assisted parameter generation, controlled vocabularies, and unit pairing.
6 · Running Extractions
4 min de lectureThe Kateeb engine, multi-record extraction, zero-hallucination rules, and resume.
Qualité et Confiance
3 chapters7 · Validation & AI Judge
6 min de lectureCross-model validation, investigating disagreements, and converging above 90% agreement.
8 · Database & Exports
3 min de lectureExplore extracted records, inspect individual papers, and export to CSV, JSON, or Excel.
9 · Sharing & Marketplace
3 min de lecturePublic schema gallery, community data sharing, and listing golden databases.
Référence
3 chapters10 · Credits & Pricing
3 min de lecture1 credit = 1 paper. Transparent pricing, earning free credits, and subscription plans.
11 · FAQ
4 min de lectureAnswers to questions researchers, peer reviewers, and institutional boards ask.
12 · Troubleshooting
5 min de lectureEvery error message, why it happens, and step-by-step resolution guides.
Sci-database Documentation
Transformez les documents de recherche en bases de données vérifiées et structurées, avec chaque valeur traçable jusqu'à sa source.
Sci-database est une plateforme d'IA destinée aux chercheurs qui ont besoin de données structurées issues de la littérature scientifique : revues systématiques, méta-analyses, articles de synthèse et ensembles de données d'apprentissage automatique. Vous recherchez plus de 200 millions d'articles (ou téléchargez vos propres PDF), décrivez les données dont vous avez besoin dans un anglais simple, et le moteur d'extraction Kateeb (كاتب, "scribe") lit chaque article et remplit votre base de données - puis un deuxième modèle d'IA indépendant vérifie les résultats afin que vous puissiez voir exactement où les modèles sont d'accord et où ils ne le sont pas.

Le workflow en un coup d'œil
┌─────────────┐ ┌──────────────┐ ┌─────────────┐ ┌──────────────┐ ┌─────────────┐
│ 1. SEARCH │ → │ 2. VERIFY │ → │ 3. SCHEMA │ → │ 4. EXTRACT │ → │ 5. VALIDATE │
│ 200M+ papers│ │ PDFs fetched │ │ AI suggests │ │ Kateeb reads │ │ AI Judge │
│ or upload │ │ & checked │ │ you edit │ │ every paper │ │ cross-checks│
└─────────────┘ └──────────────┘ └─────────────┘ └──────────────┘ └─────────────┘
│
┌────────────────────────────────────┘
▼
┌─────────────────────┐
│ 6. EXPORT & SHARE │
│ Excel · CSV · JSON │
│ or publish/sell it │
└─────────────────────┘
Documents entrants. Une feuille de calcul vérifiée sortie. Zéro donnée synthétique — si une valeur ne figure pas dans le document, la cellule indique N/A.
Contenu de la documentation
- Introduction — qu'est-ce que Sci-database, à qui il s'adresse et les principes de conception qui rendent sa sortie digne de confiance.
- Mise en route — connectez-vous, obtenez vos crédits gratuits, complétez votre profil.
- Recherche d'articles — OpenAlex, CORE et Semantic Scholar ; les filtres, les clés API et la file d'attente.
- Fichiers et téléchargements — vérification automatique des PDF, téléchargement de vos propres PDF, correction des documents qui ne peuvent pas être récupérés.
- Construire votre schéma — décrivez votre base de données en anglais simple, laissez l'IA rédiger les champs, puis modifiez et enregistrez.
- Exécuter une extraction — traitement des tâches, des statuts, des arrêts et des reprises, des e-mails de résultats.
- Validation et juge de l'IA — vérification inter-modèles, enquête sur les désaccords et convergence au-dessus de 90 % d'accord.
- Votre base de données et exportations — affichage des résultats et exportation vers CSV / JSON / Excel.
- Partage et marché — schémas publics, partage gratuit et mise en vente d'une base de données « en or ».
- Crédits et tarification — chaque coût de crédit dans un seul tableau.
- FAQ — les questions que les chercheurs posent réellement.
- Dépannage — chaque message d'erreur et comment le corriger.
Développé par le Dr El Tayeb Bentria de l'Université Hamad Bin Khalifa (HBKU), Doha, Qatar · Brevet QF Réf : 2024-066.