闲社服务运行正常AI智能体自动化平台
w

文献工具包

技能标识:wos-literature-toolkit

|

作者:admin | 来源记录:ClawHub
登记来源
ClawHub
版本
V 1.1.2
检测标记
后台标记通过
免费
免费获取
0
收藏
来源与检测标记为平台登记信息,并不代表已展示可复核的检测报告。使用前请核对版本、依赖和所需权限,建议先在隔离环境中运行。
概述
安装方式
版本历史

文献工具包

WOS 文献工具包

WOS 文献一站式解决方案:从 Web of Science 检索爬取到 PDF 批量下载,全部在同一个 Web 界面完成。

功能概览

阶段 1 - WOS 爬取:

  • - 自然语言检索词自动转换为 WOS 高级检索式
  • 支持关键词/作者/标题/DOI/期刊/年份/文献类型多维度检索
  • 期刊过滤:内置 40+ 预设期刊,支持精确/模糊匹配
  • 自动分页爬取、结果去重
  • 自动导出 Excel(标题、作者、期刊、DOI、被引频次、摘要等)

阶段 2 - PDF 下载:

  • - 自动使用阶段 1 爬取的 Excel,一键启动 PDF 下载
  • 也支持手动上传任意 Excel 文件
  • 6 个免费下载渠道按优先级依次尝试
  • 实时进度 + 下载统计 + 渠道分布 + 日志
  • 自定义输出目录

下载渠道优先级: Sci-Hub(CDN + 爬取)-> Semantic Scholar OA -> CORE -> Unpaywall -> OpenAlex -> 出版商直连

使用方式

bash
python {SKILLDIR}/scripts/webui.py

启动后自动打开 http://localhost:5678

工作流程

  1. 1. 打开 Web UI,在 WOS 爬取 标签页填写检索条件
  2. 点击 开始 WOS 爬取,浏览器自动打开 WOS 并开始爬取
  3. 爬取完成后自动导出 Excel,点击 下载 PDF 按钮切换到下载标签
  4. 在 PDF 下载 标签页确认设置,点击开始下载
  5. 下载完成后点击 打开 PDF 文件夹 查看所有 PDF 文件

也可以跳过爬取直接下载

如果已有 WOS 导出的 Excel 文件:

  1. 1. 切换到 PDF 下载 标签页
  2. 在 选项 B 区域上传 Excel 文件
  3. 选择输出目录,点击开始下载

前置条件

  • - Python 3.7+
  • 依赖:pip install selenium pandas openpyxl flask requests
  • Edge 浏览器(WOS 爬取需要)
  • WOS 机构订阅或登录账号

Agent 使用指南

当用户需要从 WOS 检索并下载文献 PDF 时:

  1. 1. 启动 Web UI:python {SKILLDIR}/scripts/webui.py
  2. 引导用户在浏览器中填写检索条件
  3. WOS 爬取需要用户登录机构账号(首次运行时浏览器会自动打开 WOS 页面)
  4. 爬取完成后引导用户点击 下载 PDF 按钮
  5. 下载完成后帮助用户打开输出文件夹查看结果

关键注意事项

  • - WOS 爬取需要机构订阅或已登录 WOS 账号
  • Sci-Hub 渠道需要网络能访问(部分网络环境可能不可用)
  • Cookie 持久化:首次登录 WOS 后会自动保存 Cookie,后续无需重复登录
  • 已下载的 PDF 会被自动跳过(断点续传)

标签

skill ai

通过对话安装

以下为平台配置的接入选项,并非逐项实测通过。能否安装取决于客户端支持、技能来源和运行环境:

OpenClaw WorkBuddy QClaw Kimi Claude

方式一:安装 SkillHub 和技能

帮我安装 SkillHub 和 wos-crawler-1775935824 技能

方式二:设置 SkillHub 为优先技能安装源

设置 SkillHub 为我的优先技能安装源,然后帮我安装 wos-crawler-1775935824 技能

通过命令行安装

skillhub install wos-crawler-1775935824

下载

⬇ 下载 wos-literature-toolkit v1.1.2(免费)

文件大小: 2.32 KB | 发布时间: 2026-4-12 11:59

v1.1.2 最新 2026-4-12 11:59
- Major update: removed the main crawling script, disabling core skill functionality.
- File removed: scripts/wos_crawler.py
- The skill cannot perform WOS literature crawling without this file.
返回顶部