Are you the author? Sign in to claim
Fetch papers as agent-ready markdown — DOI/URL/title in, structured full text out. CLI · MCP · Skill.
Fetch papers as agent-ready markdown — DOI/URL/title in, structured full text out. CLI · MCP · Skill.
Paper Fetch Skill —— 已知论文的 AI 阅读层。 你输入 DOI、URL 或标题,它返回结构化元数据 + 干净 Markdown 全文 + 图表资源,直接喂给 Codex / Claude Code / 任意 MCP host。 不绕付费墙,只在你本就有访问权限的地方,把 AI 从「只能读摘要」升级到「读全文」。
如果觉得有帮助,欢迎 star⭐ 支持!
✅这个项目把这些问题收敛到一个工具层:
✅项目提供三个主要入口:
paper-fetch:命令行工具,适合手动大规模快速抓取文献。paper-fetch-mcp:stdio MCP server,适合接入 Codex、Claude Code 等支持 MCP 的 host。skills/paper-fetch-skill/:静态 agent skill,告诉 agent 什么时候应该调用论文抓取工具。核心能力:
项目边界:
docs/browser-backends.md。onboarding/README.md,但是需要人工审核确定全文获取、markdown 转换质量等能力。agent 安装 skill 后,可以识别 paper-fetch-skill 的适用边界,并在抓取前确认是否保存全文和图表资源。

以下示例来自真实开放抓取产物。
10.1038/s41586-026-10265-5CC BY 4.0towards-end-to-end-automation-of-ai-research.md
10.1126/sciadv.adp3964deforestation-induced-runoff-changes-dominated-by-forest-climate-feedbacks.md
推荐使用 Releases 里的离线安装包:
paper-fetch-skill-windows-x86_64-setup.exe。paper-fetch-skill-offline-linux-x86_64-cp*.sh。paper-fetch-skill-offline-macos-<arch>-cp*.tar.gz。默认优先选择具体 v* Release。需要在最新稳定版源码上使用最新兼容 Python 依赖时,可选择可变的 dependency-latest prerelease,并用同一发布中的 SHA256SUMS 校验;自动任务每天检测依赖,只有依赖、稳定版源码基线变化,或上一版资产缺失/校验失败时才覆盖资产,异常时也可手动设置 force_refresh=true 强制重建。详见 docs/deployment.md。
Windows 安装后新开 PowerShell,验证 CLI:
paper-fetch --help
看到 usage: paper-fetch ... 或正常帮助输出即表示 CLI 可用。
Linux 示例:
python3 --version
chmod +x paper-fetch-skill-offline-linux-x86_64-cp312.sh
./paper-fetch-skill-offline-linux-x86_64-cp312.sh --preset=headless --no-user-config
source ~/.local/share/paper-fetch-skill/activate-offline.sh
paper-fetch --help
macOS 示例:
tar -xzf paper-fetch-skill-offline-macos-arm64-cp312.tar.gz
cd paper-fetch-skill-offline-macos-arm64-cp312
./install-offline.sh --preset=headful --no-user-config
source ~/.local/share/paper-fetch-skill/activate-offline.sh
paper-fetch --help
完整安装、升级、卸载和离线包矩阵见 docs/deployment.md。
paper-fetch --query "10.1186/1471-2105-11-421" --output-dir ./papers
未显式传 --output 且指定 --output-dir 时,CLI 会把主输出写到该目录,不向 stdout 打印正文。默认文件名使用安全化的论文 stem,优先包含作者、年份和标题;元数据不足时回退 DOI 或标题。需要精确路径时使用 --output ./papers/article.md。
准备 queries.txt:
10.1186/1471-2105-11-421
https://www.nature.com/articles/s41559-026-03039-9
运行:
paper-fetch --query-file ./queries.txt \
--output-dir ./papers \
--batch-concurrency 4
批量结果会写入 ./papers/batch-results.jsonl,单篇失败会记录后继续后续条目。完整 CLI 输出、artifact、资产和错误码语义见 docs/cli.md。
| Host | 命令 |
|---|---|
| Codex | ./scripts/install-codex-skill.sh --register-mcp |
| Claude Code | ./scripts/install-claude-skill.sh --register-mcp |
| Antigravity CLI | ./scripts/install-antigravity-skill.sh --register-mcp |
带配置文件注册:
./scripts/install-codex-skill.sh --register-mcp --env-file ~/.config/paper-fetch/.env
只安装到当前项目可加 --project。安装后重启对应 host,让它重新扫描 skills 和 MCP 配置。手动 MCP 注册和各 host 路径细节见 docs/deployment.md。
默认配置文件位置:
~/.config/paper-fetch/.env
创建配置文件:
mkdir -p ~/.config/paper-fetch
cp .env.example ~/.config/paper-fetch/.env
Elsevier 官方 XML/API 和 PDF fallback 需要从 https://dev.elsevier.com/ 申请 key:
ELSEVIER_API_KEY="..."
部分 browser-backed provider 可能需要本机 browser runtime 或手动登录态。默认 Camoufox 在第一次实际抓取时可按需下载 runtime;静态诊断不会下载。需要预检或登录时可运行:
paper-fetch browser-preflight
paper-fetch auth wiley
当前 browser-backed auth/preflight provider 包括 wiley、science、pnas、mdpi、royalsocietypublishing、annualreviews、acs、iop、aip。AMS 使用 direct HTTP HTML/PDF 路径,不支持 paper-fetch auth ams。完整 provider、运行时和环境变量说明见 docs/providers.md 与 docs/browser-runtime.md。
docs/deployment.md:安装、配置、MCP 注册和更新。docs/browser-backends.md:后端选择、Camoufox runtime、headed 认证、离线准备和 live 验收。docs/cli.md:CLI 输出、artifact、批量抓取和错误码。docs/providers.md:provider 能力、环境变量和运行时配置。docs/README.md:完整文档导航。docs/architecture/overview.md:架构边界和维护者视角。onboarding/README.md:自助添加新 provider。Run analytics queries on ClickHouse — explore schemas, execute SQL, fetch results
Run Claude Code as an MCP server so any agent can delegate coding tasks to it
Browser automation using accessibility snapshots instead of screenshots
Google's universal MCP server supporting PostgreSQL, MySQL, MongoDB, Redis, and 10+ databases