Глава 14 мин чтения·Официальное руководство · Версия 2026

What Sci-database is, who it's for, and the 4 academic trust principles.

1 · Введение

Что такое Sci-database?

Sci-database превращает стопки исследовательских PDF-файлов в одну структурированную, проверенную базу данных. Вместо того, чтобы тратить месяцы вручную на копирование значений из сотен документов в электронную таблицу, вы:

  1. Выполняйте поиск более чем в 200 миллионах научных статей в общедоступных репозиториях (OpenAlex, CORE, Semantic Scholar) или загружайте свои собственные PDF-файлы.
  2. Опишите нужные вам данные простым языком — ИИ предлагает структурированную схему (столбцы вашей будущей базы данных), которую вы можете редактировать поле за полем.
  3. Extract — механизм Kateeb считывает каждую полную статью и заполняет вашу схему. Одна статья может содержать несколько записей (например, по одной строке на материал или на условия эксперимента).
  4. Validate — вторая независимая модель искусственного интеллекта повторно извлекает образцы ваших документов, и платформа показывает сравнение полей по полям. Разногласия отмечаются, но никогда не решаются молча.
  5. Экспортируйте свою базу данных в Excel-готовую CSV или JSON — или поделитесь ею публично, чтобы внести свой вклад в открытую науку.

Как это работает — три шага

Для кого это?

Вы… Вы используете Sci-database, чтобы…
Систематический рецензент/мета-аналитик Извлекает результаты, размеры выборки, размеры эффекта и характеристики исследований из сотен исследований, а затем передает R (meta), Stata или RevMan
Материаловед/физик/химик Создание баз данных свойств (например, коэффициенты Зеебека, значения ZT, запрещенная зона, методы синтеза) для обзорных статей
Исследователь ОД Превратить литературу в маркированные обучающие данные в большом масштабе
Любой исследователь, пишущий обзор Замените месяцы ручного ввода данных полуднем контролируемого извлечения данных

Если в вашей области публикуются статьи, вы можете создать на их основе базу данных — платформа не зависит от предметной области. Публичные схемы уже существуют для термоэлектриков, стоматологических композитов, РКИ по гипертонии, безопасности Интернета вещей, наблюдений сверхновых, прогнозов климата и многого другого.

Работает для любой науки

Принципы доверия

Sci-database создан для академического использования, когда неправильное число в метаанализе хуже, чем пропущенное. В основе всего продукта лежат четыре принципа:

1. Ноль синтетических данных

Модель извлечения действует согласно строгой инструкции: если в документе отсутствует значение или модель не очень достоверна, она должна возвращать ровно N/A — ни в коем случае не догадку, ни правдоподобно звучащую выдумку.

2. Ничто не решается молча

Если модель валидатора не согласуется с исходным извлечением, это несогласие отображается вам в строке сравнения, выделенной красным. Вы (при необходимости с помощью третьего арбитра ИИ) решаете, в чем правда.

Цикл доверия

3. Сходитесь, не надейтесь

Экстракция – это не один выстрел. Предполагаемый цикл: извлечение → проверка на соответствие второй модели → исследование разногласий → позволить ИИ улучшить описания полей вашей схемы → повторный запуск. Каждый проход поднимает соглашение между моделями; порог доверия платформы составляет 90%+ соглашение, прежде чем база данных будет считаться «доверенной».

4. Ваши данные остаются вашими

  • Ваши документы и извлеченные данные по умолчанию являются конфиденциальными вашей учетной записи.
  • Ваша схема (только определения полей — без данных) может быть опубликована в общедоступной галерее, чтобы помочь другим исследователям; это указано в Условиях, которые вы принимаете при регистрации.
  • Загрузки никогда не используются для обучения моделей.
  • Вы можете удалить свои файлы, задания и базы данных в любое время.

Двигатель Kateeb

Механизм извлечения имеет маркировку Kateeb (كاتب, по-арабски "писец"). В представлениях проверки исходный столбец извлечения всегда помечен как ** «Исходное (Kateeb)»**, чтобы можно было сразу определить, какая модель какое значение выдала. Sci-database был разработан в Университете Хамада Бин Халифа (Доха, Катар) и зарегистрирован патент (QF Ref: 2024-066).


Далее: Начало работы →

Нужна помощь? Проверьте FAQ или руководство.
    1 · Introduction to Sci-database | Sci-database Documentation