闲社服务运行正常AI智能体自动化平台
o

本地OCR识别

技能标识:ocr-local

Extract text from images using Tesseract.js OCR (100% local, no API key required). Supports Chinese (simplified/traditional) and English.

作者:admin | 来源记录:ClawHub
登记来源
ClawHub
版本
V 1.0.0
检测标记
后台标记通过
免费
免费获取
0
收藏
来源与检测标记为平台登记信息,并不代表已展示可复核的检测报告。使用前请核对版本、依赖和所需权限,建议先在隔离环境中运行。
概述
安装方式
版本历史

本地OCR识别

OCR - 图像文字识别(本地运行)

使用 Tesseract.js 从图像中提取文字。完全本地运行,无需 API 密钥。 支持中文和英文。

快速开始

bash
node {baseDir}/scripts/ocr.js /path/to/image.jpg
node {baseDir}/scripts/ocr.js /path/to/image.png --lang chi_sim
node {baseDir}/scripts/ocr.js /path/to/image.jpg --lang chi_tra+eng

选项

  • - --lang :语言代码(默认:chi_sim+eng)
- chi_sim - 简体中文 - chi_tra - 繁体中文 - eng - 英文 - 使用 + 组合:chi_sim+eng
  • - --json:以 JSON 格式输出,而非纯文本

示例

bash

识别中文截图


node {baseDir}/scripts/ocr.js screenshot.png

识别英文文档

node {baseDir}/scripts/ocr.js document.jpg --lang eng

中英文混合

node {baseDir}/scripts/ocr.js mixed.png --lang chi_sim+eng

注意事项

  • - 语言数据存储在 {baseDir}/scripts/tessdata/ 目录下
  • 首次运行时会下载语言数据(每种语言约 20MB)
  • 后续运行使用缓存数据
  • 对清晰、高对比度的图像效果最佳
  • 手写文字识别准确率可能有所差异

语言数据

语言模型文件(.traineddata.gz)会在首次使用时自动下载并存储在:

{baseDir}/scripts/tessdata/

  • - chi_sim.traineddata.gz(简体中文)
  • eng.traineddata.gz(英文)

如需手动下载或更新语言数据:
bash
cd {baseDir}/scripts/tessdata
curl -O https://cdn.jsdelivr.net/npm/@tesseract.js-data/chisim/4.0.0bestint/chisim.traineddata.gz
curl -O https://cdn.jsdelivr.net/npm/@tesseract.js-data/eng/4.0.0bestint/eng.traineddata.gz

标签

skill ai

通过对话安装

以下为平台配置的接入选项,并非逐项实测通过。能否安装取决于客户端支持、技能来源和运行环境:

OpenClaw WorkBuddy QClaw Kimi Claude

方式一:安装 SkillHub 和技能

帮我安装 SkillHub 和 ocr-local-rose-1776012968 技能

方式二:设置 SkillHub 为优先技能安装源

设置 SkillHub 为我的优先技能安装源,然后帮我安装 ocr-local-rose-1776012968 技能

通过命令行安装

skillhub install ocr-local-rose-1776012968

下载

⬇ 下载 ocr-local v1.0.0(免费)

文件大小: 7.18 KB | 发布时间: 2026-4-13 11:15

v1.0.0 最新 2026-4-13 11:15
- Initial release of local OCR skill using Tesseract.js.
- Extracts text from images in Chinese (simplified/traditional) and English.
- Runs fully locally; no API key required.
- CLI supports language selection, plain text or JSON output.
- Automated downloading and caching of language model files.
返回顶部