paper-analysis-assistant

Solid

其他高等院校教师与数据科学家在追踪前沿学术时,当需要深度解析arXiv论文,用此技能可一键下载PDF并自动生成词频分析、双人播客、交互式网页、PPT演示与总结图,将数小时的文献阅读转化为多媒体内容,效率提升十倍!

AI & Automation 6,537 stars 625 forks Updated today

Install

View on GitHub

Quality Score: 86/100

Stars 20%
100
Recency 20%
100
Frontmatter 20%
70
Documentation 15%
100
Issue Health 10%
50
License 10%
0
Description 5%
100

Skill Content

# 论文分析助手 ## 任务目标 - 本 Skill 用于:根据 arXiv 论文网址自动进行多维度分析并生成多种格式的输出 - ���力包含:PDF 下载与文本提取、词频统计、语音合成、播客对话生成、交互式网页、PPT 生成、总结图生成、引用分析 - 触发条件:用户提供 arXiv 论文网址或论文 PDF 文件 ## 前置准备 - 依赖说明:所需 Python 包已在 dependency 中列出 - 停用词资源:需准备英文停用词列表,用于词频分析过滤 ## 操作步骤 - 标准流程: 1. **下载 PDF 文件** - 调用 `scripts/download_pdf.py` 下载 arXiv PDF - 参数:`--url` (arXiv 论文网址), `--output` (输出 PDF 文件路径) 2. **提取 PDF 文本** - 调用 `scripts/extract_text.py` 提取纯文本 - 参数:`--pdf` (PDF 文件路径), `--output` (输出 txt 文件路径) 3. **词频分析** - 调用 `scripts/analyze_word_frequency.py` 进行词频统计 - 参数:`--txt` (txt 文件路径), `--output` (输出 csv 文件路径) - 该脚本会自动过滤英文停用词(见 references/stopwords.txt) 4. **文本转语音** - 调用 `scripts/text_to_speech.py` 将文本转为语音 - 参数:`--txt` (txt 文件路径), `--output` (输出 wav 文件路径) 5. **生成播客对话** - **智能体步骤**:根据论文内容生成双人对话脚本(包含两个角色的对话内容) - **脚本步骤**:调用 `scripts/dialogue_to_podcast.py` 将对话脚本转换为语音 - 参数:`--dialogue` (对话脚本文件路径), `--output` (输出 wav 文件路径) 6. **生成交互式网页** - 调用 `scripts/generate_html.py` 生成交互式网页 - 参数:`--txt` (txt 文件路径), `--word_freq` (词频 csv 文件路径), `--output` (输出 html 文件路径) 7. **生成 PPT** - 调用 `scripts/generate_ppt.py` 生成演示文稿 - 参数:`--txt` (txt 文件路径), `--output` (输出 pptx 文件路径) 8. **生成总结图** - **智能体步骤**:根据论文内容直接生成"一图胜千言"的总结图(PNG 格式) 9. **分析引用链接** - 调用 `scripts/extract_references.py` 提取引用链接 - 参数:`--txt` (txt 文件路径), `--output` (输出 csv 文件路径) - 可选分支: - 当 用户直接提供 PDF 文件:跳过步骤 1,直接从步骤 2 开始 - 当 用户只需要部分分析:根据需求选择性执行对应步骤 ## 资源索引 - 下载脚本:见 ...

Details

Author
anbeime
Repository
anbeime/skill
Created
7 months ago
Last Updated
today
Language
Python
License
None

Similar Skills

Semantically similar based on skill content — not just same category

AI & Automation Listed

amlei-academic-ref-retrieval

学术论文参考文献检索与格式输出。根据论文主题拆解核心技术,编写脚从权威期刊/数据库(知网、维普、arXiv等)爬取或提取真实论文信息,按标准参考文献格式输出。触发:写论文 / 参考文献 / 查文献 / 检索论文 / 论文参考 / reference retrieval / academic reference。

0 Updated 1 weeks ago
amlei
AI & Automation Listed

paper-analyzer

Read an academic paper (PDF, arXiv link, pasted text, or DOI/title) and produce a complete paper-study package — full paragraph-by-paragraph Chinese translation, plus structured Chinese & English summaries, plus extracted figures / tables / algorithms / listings saved into per-paper subfolders following the paper's own numbering (Figure 1, Table 1, Algorithm 1, etc.). Detects the paper's academic field, confirms a domain glossary with the user, and preserves field-appropriate English terminology in both the Chinese translation and summary. Use this skill whenever the user shares a paper, an arXiv URL, a DOI, a paper title, or pastes a chunk of academic text and asks to "read / summarize / translate / analyze / 解读 / 翻译 / 总结 / 精读" it — even if the user does not explicitly say "use paper-analyzer". Also trigger when the user wants to compare or do a literature review starting from a single paper.

3 Updated 1 months ago
JavaLyHn
AI & Automation Featured

hv-analysis

横纵分析法(Horizontal-Vertical Analysis)深度研究Skill。由数字生命卡兹克提出,融合了索绪尔的历时-共时分析、社会科学的纵向-横截面研究设计、商学院案例研究法与竞争战略分析的核心思想。 当用户想要系统性研究一个产品、公司、概念、技术或人物时使用。核心是双轴分析:纵轴追踪从诞生到当下的完整生命历程(以叙事故事呈现),横轴在当下时间截面上与竞品/同类进行系统性横向对比,最后交叉两条轴产出独到洞察。最终产出一份排版精美的PDF研究报告。 触发词包括但不限于:横纵分析、研究一下、帮我分析、深度研究、做个研究、调研一下、竞品分析、帮我看看这个东西怎么样、这个产品/公司/概念是怎么回事、帮我摸清楚、帮我搞懂、帮我做个deep research。 即使用户只是说"帮我了解一下XX"或"XX是什么来头",只要上下文暗示需要系统性的深度研究(而非简单的概念解释),都应该触发。也适用于用户丢来一个产品名、公司名、技术名词说"帮我研究一下这个"的场景。 不要用于简单的名词解释(用户只是问"XX是什么")、不要用于公众号写作(那个用khazix-writer)、不要用于纯标题摘要生成(用wechat-title)。

20,589 Updated 3 days ago
KKKKhazix