download-fulltext-pdf

Solid

当用户明确要求"下载文献全文"或"获取论文PDF"时使用。通过 DOI 号下载学术论文全文 PDF,支持 arXiv、Sci-Hub、Unpaywall、期刊官网等多源策略。⚠️ 不适用:用户只是想解析或处理已有的 PDF 文件(应使用 pdf skill)、只是想搜索论文信息而无需下载全文、没有提供 DOI/标题/BibTeX 任何标识符。

Data & Documents 48 stars 7 forks Updated today MIT

Install

View on GitHub

Quality Score: 86/100

Stars 20%
56
Recency 20%
100
Frontmatter 20%
70
Documentation 15%
100
Issue Health 10%
80
License 10%
100
Description 5%
100

Skill Content

# 下载文献全文 PDF ## 目标 当用户明确要求"下载文献全文"或"获取论文PDF"时使用。通过 DOI 号下载学术论文全文 PDF,支持 arXiv、Sci-Hub、Unpaywall、期刊官网等多源策略。⚠️ 不适用:用户只是想解析或处理已有的 PDF 文件(应使用 pdf skill)、只是想搜索论文信息而无需下载全文、没有提供 DOI/标题/BibTeX 任何标识符。 ## 流程 ### 输入 输入至少包含 DOI、标题或 BibTeX 之一,并指定输出目录/文件路径;可选输入包括来源开关、Unpaywall 邮箱、验证阈值和覆盖策略。输出路径必须存在或可创建且可写,触发边界以本 Skill 的 `## 目标` 为准。 ### 执行步骤 #### 核心工作流 ##### 1. 输入验证与��范化 **必需参数**: - `doi`: DOI 号(如 `10.1038/nature09492`) - `output_path`: 输出目录或完整 PDF 文件路径 **可选参数**: - `title`: 论文标题(作为 DOI 的备选) - `bibtex`: BibTeX 条目(包含 DOI 或标题信息) **验证逻辑**: ```python # 由 scripts/validate_input.py 处理 - DOI 格式规范化(移除多余空格、补全前缀) - 输出路径检查(目录存在性、写入权限) - 至少提供一种标识符(DOI/title/bibtex) ``` ##### 2. 多源下载策略 **优先级顺序**(按成功率和速度排序): | 优先级 | 数据源 | 优势 | 局限 | 触发条件 | |--------|--------|------|------|----------| | **1** | arXiv | 稳定可靠 | 仅限预印本论文 | 检测到 arXiv ID(如 `10.48550/arXiv.*`) | | **2** | Sci-Hub | 覆盖较广、速度快 | 可能有 CAPTCHA | 非 arXiv 或 arXiv 失败 | | **3** | Unpaywall | 合法开放获取(OA) | 取决于论文是否 OA | Sci-Hub 失败时兜底 | | **4** | 期刊官网 | 合法渠道 | 常需订阅/登录 | 最后兜底 | **策略执行**: ```python # 由 scripts/download_pdf.py 实现 1. 如 DOI 可解析出 arXiv ID → 优先 arXiv 2. 尝试 Sci-Hub(通过 scihub 库) 3. 尝试 Unpaywall(合法 OA 获取) 4. 尝试 DOI 落地页并猜测常见 PDF 路径(期刊官网兜底) ``` ##### 3. 下载后验证 **必需检查**(由 `scripts/verify_pdf.py` 处理): - [ ] 文件大小 > 0 且非 HTML 页面 - [ ] PDF 文件头正确(`%PDF-`) - [ ] 文件可被 PyPDF2 解析 **失败处理**: - 验证失败 → 记录错误 → 尝试下一个数据源 - 所有源失败 → 返回详细错误报告 ##### 4. 输出格式 **成功时**: ```markdown ✅ 成功下载论文全文 **来源**: Sci-Hub **DOI**: 10.1038/nature09492 **文件**: /path/to/paper.p...

Details

Author
huangwb8
Repository
huangwb8/skills
Created
8 months ago
Last Updated
today
Language
Python
License
MIT

Similar Skills

Semantically similar based on skill content — not just same category

Data & Documents Listed

lit-pdf-zotero

文献 PDF 获取 + Zotero 入库 + 可视化(乔淼PhD · AI学术训练营 · AI学术工作流)。对一份文献清单批量:确认 DOI/CNKI ID → 补全引用数 → 多渠道找 PDF 落盘(OA/preprint/sd-download/wos-download/cnki-download)→ 按金字塔结构建 Zotero Collection 逐条入库(含标签与 extra 元数据)→ 生成金字塔分布图 + PXYV 罗盘投影双图 HTML。Trigger on:"把这批文献下载 PDF 入库 Zotero"、"文献入库+可视化"、"batch download PDFs and import to Zotero"、"入 Zotero 并画文献金字塔"。

7 Updated 1 months ago
qiaomiaojoe
AI & Automation Solid

paper-analysis-assistant

其他高等院校教师与数据科学家在追踪前沿学术时,当需要深度解析arXiv论文,用此技能可一键下载PDF并自动生成词频分析、双人播客、交互式网页、PPT演示与总结图,将数小时的文献阅读转化为多媒体内容,效率提升十倍!

6,537 Updated today
anbeime
AI & Automation Listed

paper-analyzer

Read an academic paper (PDF, arXiv link, pasted text, or DOI/title) and produce a complete paper-study package — full paragraph-by-paragraph Chinese translation, plus structured Chinese & English summaries, plus extracted figures / tables / algorithms / listings saved into per-paper subfolders following the paper's own numbering (Figure 1, Table 1, Algorithm 1, etc.). Detects the paper's academic field, confirms a domain glossary with the user, and preserves field-appropriate English terminology in both the Chinese translation and summary. Use this skill whenever the user shares a paper, an arXiv URL, a DOI, a paper title, or pastes a chunk of academic text and asks to "read / summarize / translate / analyze / 解读 / 翻译 / 总结 / 精读" it — even if the user does not explicitly say "use paper-analyzer". Also trigger when the user wants to compare or do a literature review starting from a single paper.

3 Updated 1 months ago
JavaLyHn