Sci-database 文档与用户指南
将海量科研论文转化为经过交叉验证、具备完整溯源能力的结构化数据库。学习如何检索超过2亿篇论文、设计数据抽取模式、运行 Kateeb 引擎并利用 AI 法官进行双模型验证。
目录
共 12 章 · 约 45 分钟快速入门
2 chapters核心工作流
4 chapters3 · Searching Papers
4 分钟阅读Search 200M+ papers across OpenAlex, CORE, and Semantic Scholar with focused keywords.
4 · Files & Uploads
4 分钟阅读Automatic PDF download verification, drag-and-drop uploads, and fixing unverified files.
5 · Building Your Schema
5 分钟阅读AI-assisted parameter generation, controlled vocabularies, and unit pairing.
6 · Running Extractions
4 分钟阅读The Kateeb engine, multi-record extraction, zero-hallucination rules, and resume.
质量与可信度
3 chapters7 · Validation & AI Judge
6 分钟阅读Cross-model validation, investigating disagreements, and converging above 90% agreement.
8 · Database & Exports
3 分钟阅读Explore extracted records, inspect individual papers, and export to CSV, JSON, or Excel.
9 · Sharing & Marketplace
3 分钟阅读Public schema gallery, community data sharing, and listing golden databases.
参考与支持
3 chapters10 · Credits & Pricing
3 分钟阅读1 credit = 1 paper. Transparent pricing, earning free credits, and subscription plans.
11 · FAQ
4 分钟阅读Answers to questions researchers, peer reviewers, and institutional boards ask.
12 · Troubleshooting
5 分钟阅读Every error message, why it happens, and step-by-step resolution guides.
Sci-database 文档
将研究论文转化为经过验证的结构化数据库 - 每个值都可追溯到其来源。
Sci-database 是一个 AI 平台,为需要科学文献中的结构化数据的研究人员提供:系统评价、荟萃分析、评论论文和机器学习数据集。您搜索 2 亿多篇论文(或上传您自己的 PDF),用简单的英语描述您需要的数据,然后 Kateeb 提取引擎(كчаты,“抄写员”)读取每篇论文并填充您的数据库 - 然后第二个独立的 AI 模型交叉检查结果,以便您可以准确地看到模型一致的地方和不一致的地方。

工作流程一览
┌─────────────┐ ┌──────────────┐ ┌─────────────┐ ┌──────────────┐ ┌─────────────┐
│ 1. SEARCH │ → │ 2. VERIFY │ → │ 3. SCHEMA │ → │ 4. EXTRACT │ → │ 5. VALIDATE │
│ 200M+ papers│ │ PDFs fetched │ │ AI suggests │ │ Kateeb reads │ │ AI Judge │
│ or upload │ │ & checked │ │ you edit │ │ every paper │ │ cross-checks│
└─────────────┘ └──────────────┘ └─────────────┘ └──────────────┘ └─────────────┘
│
┌────────────────────────────────────┘
▼
┌─────────────────────┐
│ 6. EXPORT & SHARE │
│ Excel · CSV · JSON │
│ or publish/sell it │
└─────────────────────┘
论文输入。一份经过验证的电子表格输出。 零合成数据 — 如果某个值不在论文中,则单元格显示 N/A。
文档内容
- 简介 — Sci-database 是什么、它的用途以及使其输出值得信赖的设计原则。
- 入门 — 登录,获取免费积分,完成您的个人资料。
- 搜索论文 — OpenAlex、CORE、Semantic Scholar;过滤器、API 密钥和队列。
- 文件和上传 — 自动 PDF 验证,上传您自己的 PDF,修复无法获取的论文。
- 构建您的架构 — 用简单的英语描述您的数据库,让 AI 起草字段,然后编辑并保存。
- 运行提取 — 处理作业、状态、停止和恢复、结果电子邮件。
- 验证与人工智能法官 — 跨模型检查,调查分歧,并收敛到 90% 以上的一致性。
- 您的数据库和导出 — 查看结果并导出到 CSV / JSON / Excel。
- 共享和市场 — 公共模式,免费共享,并列出待售的“黄金”数据库。
- 积分和定价 — 一张表中的每个积分成本。
- 常见问题解答 — 研究人员实际提出的问题。
- 故障排除 — 每个错误消息以及如何修复它。
由卡塔尔多哈 Hamad Bin Khalifa 大学 (HBKU) 的 El Tayeb Bentria 博士开发·专利 QF 参考号:2024-066。