第4章4 分で読める·公式マニュアル · 2026年版

オープンアクセスPDFの自動取得検証、ドラッグ&ドロップによる独自PDFのアップロード。

4 · ファイルとアップロード

ファイル タブ (タイトル: ファイルと処理) は紙のキューです。検索または直接アップロードによって追加したものはすべてここに到達し、検証されて抽出を待ちます。

ファイルタブ

独自の PDF のアップロード

すでに論文をお持ちの場合は、検索を完全にスキップしてください: PDF ファイル をドロップゾーンにドラッグ アンド ドロップします (または 参照 をクリックします)。

  • 形式: PDF のみ、ファイルあたり最大 20 MB。
  • 各ファイルにはアップロードの進行状況バーが表示されます。アップロードされると、他の検索された論文と同様にキューに表示されます (ソースは「アップロードされた PDF」として表示されます)。
  • アップロードされたファイルはアカウントのクラウド ストレージに非公開で保存され、キューから削除するとストレージから削除されます。

これは、PDF を自動的に取得できなかった論文のリカバリ パスでもあります (下記を参照)。

PDF の自動検証

キューに追加されたすべての論文は自動的に検証されます。サーバーは PDF のダウンロードを試行し、それが実際の読み取り可能なファイル (少なくとも 15 KB) であることを確認します。最大 10 件の論文が並行して検証され、ステータス アイコンがライブで更新されるのを確認できます。

アイコン ステータス 意味
❔ グレー 保留中 未チェック
⏳ スピナー 確認中 ダウンロード中
✅ 緑 確認済み ファイルにアクセス可能で読み取り可能 — 抽出の準備ができています
❌ 赤 失敗 PDF を取得できませんでした (下記の理由を参照)

検証ステータス

認証に失敗した場合

ブラウザーで Download リンクが機能しても、一部の PDF はサーバーによって取得できません。よくある理由:

  • 出版社は自動ダウンロードをブロックします (Science、Nature、Elsevier ジャーナルのペイウォール版によくあることです)。
  • リンクは PDF ファイルではなくランディング ページを指します。
  • リポジトリが一時的にダウンしているか、ファイルが 15 KB 未満です (通常はスタブまたはエラー ページ)。

これが発生すると、青いヒントが表示されます。

一部のファイルは検証されていません! 一部の論文はサーバーからオープンにアクセスできない可能性があります。 👁 ボタンをクリックして PDF ファイルを開いてダウンロードし、再アップロードしてみてください。

修正は簡単です:、失敗した行の目のボタン (👁) をクリックしてブラウザで PDF を開き、手動でダウンロードし、同じ [ファイル] タブの上部にあるドロップゾーンにドラッグします。アップロードされたコピーは即座に検証され、失敗した行 (ゴミ箱アイコン) を削除できます。

このハイブリッド モデルは意図的です。プラットフォームは、論文が読まれていないときに、論文が読まれたふりをすることはありません。 検証済み ファイルのみを処理できます。

キューの管理

  • Eye (👁) — 論文の PDF を新しいタブで開きます。
  • ゴミ箱 — キューから 1 枚の用紙を削除します (アップロードしたコピーもストレージから削除されます)。
  • すべてのファイルをクリア — 確認後にキュー全体を空にします (「これにより、ファイルリストからすべての書類が削除されます。このアクションは元に戻すことができません。」)。
  • キューに入れられたファイルは、処理によって消費されません****。ジョブの開始後、ファイルは削除されるまでキュー内に残るため、後で改善されたスキーマに対して再実行できます。

抽出開始

少なくとも 1 つのファイルが検証され、スキーマが保存されると (次の章)、ヘッダーの プロセス (N) 検証済み ボタンとフローティング 「N 検証済みの論文の準備完了 → 3 パス AI 抽出の開始」 ドックがアクティブになります。処理については、抽出の実行で説明します。

「ファイルを処理する前にスキーマを保存してください。」 でボタンが無効になっている場合は、まず、DB コンテンツ に移動し、スキーマの保存 をクリックします。


次: スキーマの構築 →

お困りですか?FAQまたはトラブルシューティングをご確認ください。
    4 · ファイル検証とPDFアップロード | Sci-database Documentation