第 5 章5 分钟阅读·官方手册 · 2026 版本

AI-assisted parameter generation, controlled vocabularies, and unit pairing.

5 · 构建你的模式

您的 schema 是未来数据库的结构:列(字段)、它们的类型,以及最重要的是告诉人工智能要提取什么内容的描述。您可以在 DB Content 选项卡中构建它。

让 AI 起草它:AI 驱动的架构生成

在顶部卡片中用简单的英语描述您的数据库,然后单击 建议参数:

人工智能驱动的模式生成

好的提示示例:

  • “钙钛矿太阳能电池效率和稳定性数据库”
  • “高血压随机对照试验数据库:样本量、干预、血压结果”
  • “热电超晶格测量数据库:塞贝克系数、热导率、ZT”

AI(成本 2 学分)按照严格的约定返回完整的草稿模式,使提取一致且可分析:

  • snake_case (chemical_formula, sample_size) 中的字段名称。
  • 类型仅限于文本、数字、日期、布尔值。
  • 每个数字字段都与…_unit文本字段 (seebeck_coefficient + seebeck_coefficient_unit) 配对,因此单位永远不会丢失或混合。
  • 分类字段在描述中带有受控词汇 — 例如*“必须是以下之一:立方晶系、四方晶系、正交晶系、六方晶系、三方晶系、单斜晶系、三斜晶系”*——这迫使数百篇论文的值保持一致。
  • A doi / 参考字段始终位于最后,因此数据库中的每一行都可以追溯到其源论文。

分析就绪开关告诉 AI 更喜欢数字、布尔值和单字分类字段(并避免长自由文本字段)——当数据库用于统计分析或 ML 训练而不是叙述性审查时使用它。

如果您的提示无法识别为科学数据库请求,则 AI 会拒绝而不是发明某些内容:“AI 无法识别此请求的相关参数。请尝试更具体的科学描述。”

编辑所有内容:自定义数据库架构编辑器

AI 的草稿是一个起点 - 您可以完全控制下面的编辑器:

架构编辑器

  • 架构名称 — 为您的数据库命名。
  • 每个字段:字段名称、数据类型(文本/数字/日期/布尔)和描述。
  • 拖动行以重新排序,垃圾桶图标以删除字段,添加字段以追加字段。
  • 适合数据分析开关将模式标记为分析就绪。

撰写提取良好的描述

描述是提取模型实际遵循的指令 - 对其进行投资:

弱描述 强描述
“效率” “设备的冠军电源转换效率 (PCE),以浮点数表示。提取精确值,不要舍入。”
“方法” “沉积方法。必须是以下之一:旋涂、气相沉积、刮涂、喷涂、喷墨印刷。”
“温度” “测量属性时的温度,以数字形式表示。其单位为测量温度单位(K 或 °C)。”

包括有用的示例值(“示例:'Bi2Te3'”)。如果稍后的验证显示某个字段存在系统性分歧,改进架构功能将为您重写这些描述(第 7 章)。

保存

单击 保存架构 — 您将看到 “架构已保存 — 您的架构已保存到您的帐户。” 处理文件之前需要保存。

关于保存需要了解的两件事:

  1. 模式在设计上是公开的。 字段定义(绝不是您的数据)会发布到 公共模式库,以便其他研究人员可以重复使用精心设计的模板。您的论文和提取的值保持私密。
  2. **保存会就地更新架构。**如果编辑并重新保存现有架构,您将更新相同的架构记录 - 先前的字段定义将被替换。然而,每个作业都会存储其运行的模式的永久快照,因此过去的结果始终保持其原始结构。

架构历史

仪表板的模式历史卡链接到一个页面,该页面列出了您在作业中实际使用的每个唯一模式,最近的在前,每个模式都有完整的字段表。使用它来恢复您修改后的架构。

架构历史

从公共模式开始

在公共图库 中找到模板?在任何架构页面上单击**“免费构建此数据库”** - 登录后,它会克隆到您的编辑器中(“架构已加载”),可供使用或调整。


下一个: 运行提取 →

需要帮助?请查看常见问题或故障排除指南。
    5 · Building Your Schema | Sci-database Documentation