AI-assisted parameter generation, controlled vocabularies, and unit pairing.
5 · Construire votre schéma
Votre schéma est la structure de votre future base de données : les colonnes (champs), leurs types et, surtout, les descriptions qui indiquent à l'IA exactement ce qu'elle doit extraire. Vous le construisez dans l'onglet DB Content.
Laissez l'IA le rédiger : génération de schémas alimentée par l'IA
Décrivez votre base de données en anglais simple dans la carte du haut et cliquez sur Suggérer des paramètres :

Exemples de bonnes invites :
- "Une base de données sur l'efficacité et la stabilité des cellules solaires à pérovskite"
- "Une base de données d'essais contrôlés randomisés sur l'hypertension : taille de l'échantillon, intervention, résultats en matière de tension artérielle"
- "Une base de données de mesures de super-réseaux thermoélectriques : coefficient Seebeck, conductivité thermique, ZT"
L'IA (coût 2 crédits) renvoie un projet de schéma complet suivant des conventions strictes qui rendent les extractions cohérentes et analysables :
- Noms de champs en
snake_case(chemical_formula,sample_size). - Types limités à Texte, Nombre, Date, Booléen.
- Chaque champ numérique est associé à un
…_unitchamp de texte (seebeck_coefficient+seebeck_coefficient_unit) afin que les unités ne soient jamais perdues ou mélangées. - Les champs catégoriels comportent un vocabulaire contrôlé dans la description — par ex. "Doit être l'un des suivants : Cubique, Tétragonal, Orthorhombique, Hexagonal, Trigonal, Monoclinique, Triclinique" — ce qui impose des valeurs cohérentes sur des centaines d'articles.
- Un champ
doi/ référence est toujours le dernier, de sorte que chaque ligne de votre base de données peut être retracée jusqu'à son article source.
Le commutateur Analysis Ready indique à l'IA de préférer les champs catégoriels numériques, booléens et à un seul mot (et d'éviter les longs champs de texte libre) — utilisez-le lorsque la base de données est destinée à une analyse statistique ou à une formation ML plutôt qu'à une révision narrative.
Si votre invite n'est pas reconnaissable comme une demande de base de données scientifique, l'IA refuse plutôt que d'inventer quelque chose : "L'IA n'a pas pu identifier les paramètres pertinents pour cette demande. Veuillez essayer une description scientifique plus spécifique."
Tout modifier : l'éditeur de schéma de base de données personnalisé
Le brouillon de l'IA est un point de départ : vous avez un contrôle total dans l'éditeur ci-dessous :

- Schema Name — nommez votre base de données.
- Par champ : Nom du champ, Type de données (Texte / Numéro / Date / Booléen) et Description.
- Faites glisser les lignes pour réorganiser, icône de la corbeille pour supprimer un champ, Ajouter un champ pour en ajouter un.
- Le commutateur Adapté à l'analyse des données marque le schéma comme prêt pour l'analyse.
Rédiger des descriptions qui s'extraient bien
La description est l'instruction que le modèle d'extraction suit réellement : investissez-y :
| Description faible | Description forte |
|---|---|
| « L'efficacité » | « L'efficacité de conversion de puissance (PCE) championne de l'appareil sous forme de nombre à virgule flottante. Extrayez la valeur exacte, n'arrondissez pas. |
| "La méthode" | "La méthode de dépôt. Doit être l'une des suivantes : Revêtement par centrifugation, Dépôt en phase vapeur, Revêtement à la lame, Revêtement par pulvérisation, Impression à jet d'encre." |
| "Température" | "La température à laquelle les propriétés ont été mesurées, sous forme de nombre. Son unité va dans Measurement_temperature_unit (K ou °C)." |
Incluez un exemple de valeur lorsque cela est utile ("Exemple : 'Bi2Te3'"). Si une validation ultérieure montre des désaccords systématiques sur un champ, la fonctionnalité Améliorer le schéma réécrira ces descriptions pour vous (chapitre 7).
Enregistrement
Cliquez sur Enregistrer le schéma — vous verrez "Schéma enregistré — Votre schéma a été enregistré sur votre compte." L'enregistrement est requis avant de traiter les fichiers.
Deux choses à savoir sur la sauvegarde :
- Les schémas sont publics par conception. Les définitions de champ (jamais vos données) sont publiées dans la galerie de schémas publique afin que d'autres chercheurs puissent réutiliser des modèles bien conçus. Vos papiers et valeurs extraites restent privés.
- L'enregistrement met à jour le schéma en place. Si vous modifiez et ré-enregistrez un schéma existant, vous mettez à jour ce même enregistrement de schéma — les définitions de champ précédentes sont remplacées. Cependant, chaque tâche stocke un instantané permanent du schéma avec lequel elle a été exécutée, de sorte que les résultats passés conservent toujours leur structure d'origine.
Historique du schéma
La carte Schema History du tableau de bord renvoie à une page répertoriant chaque schéma unique que vous avez réellement utilisé dans une tâche, le plus récent en premier, avec la table de champs complète pour chacun. Utilisez-le pour récupérer un schéma que vous avez modifié depuis.

À partir d'un schéma public
Vous avez trouvé un modèle dans la galerie publique ? Cliquez sur "Créer cette base de données gratuitement" sur n'importe quelle page de schéma — après la connexion, elle est clonée dans votre éditeur ("Schéma chargé"*), prête à être utilisée ou adaptée.
Suivant : Lancer une extraction →