闲社服务运行正常AI智能体自动化平台
w

网页文本提取

技能标识:web-extractor

使用 jina.ai 提取网页干净文本并让 Agent 总结。触发词:提取网页、总结新闻、提取文章、获取页面内容

作者:admin | 来源记录:ClawHub
登记来源
ClawHub
版本
V 1.0.0
检测标记
后台标记通过
免费
免费获取
1
收藏
来源与检测标记为平台登记信息,并不代表已展示可复核的检测报告。使用前请核对版本、依赖和所需权限,建议先在隔离环境中运行。
概述
安装方式
版本历史

网页文本提取

网页内容提取技能

使用 r.jina.ai 提取网页干净文本,过滤垃圾代码,提取干货内容。

工作流程

1. 提取网页内容

bash

提取网页并保存为 md 文件


curl -s https://r.jina.ai/ > /tmp/web-content.md

2. 读取并总结

让 Agent 读取生成的 md 文件,总结核心观点。

使用示例

用户说:帮我总结这个新闻 https://www.bbc.com/news/tech...

执行:
bash
curl -s https://r.jina.ai/https://www.bbc.com/news/technology-xxx > /tmp/news.md

然后读取 /tmp/news.md 文件内容,分析并总结。

注意事项

  • - r.jina.ai 会过滤掉 script、nav、广告 CSS 等垃圾代码
  • 提取后是极干净的纯文本,对 AI 零负担
  • 支持任何新闻网站、技术博客、文章页面
  • 文件默认保存到 /tmp/ 目录,可自定义路径

标签

skill ai

通过对话安装

以下为平台配置的接入选项,并非逐项实测通过。能否安装取决于客户端支持、技能来源和运行环境:

OpenClaw WorkBuddy QClaw Kimi Claude

方式一:安装 SkillHub 和技能

帮我安装 SkillHub 和 web-extractor-1776119341 技能

方式二:设置 SkillHub 为优先技能安装源

设置 SkillHub 为我的优先技能安装源,然后帮我安装 web-extractor-1776119341 技能

通过命令行安装

skillhub install web-extractor-1776119341

下载

⬇ 下载 web-extractor v1.0.0(免费)

文件大小: 1.25 KB | 发布时间: 2026-4-14 10:20

v1.0.0 最新 2026-4-14 10:20
- Initial release of web-extractor skill.
- Extracts clean text from web pages using r.jina.ai, removing scripts, navigation, ads, and unnecessary CSS.
- Allows easy summarization of core content by the Agent.
- Supports extracting from any news site, tech blog, or article page.
- Saved content is in pure text format for optimal AI processing.
- Default output path is /tmp/, with customizable file locations.
返回顶部