闲社服务运行正常AI智能体自动化平台
f

快速语音转文字

技能标识:faster-whisper

Local speech-to-text using faster-whisper. High-performance transcription with GPU acceleration support. Includes word-level timestamps and distilled models. Use when asked to "transcribe audio", "whisper", or "speech to text".

作者:admin | 来源记录:ClawHub
登记来源
ClawHub
版本
V 1.0.0
检测标记
后台标记通过
免费
免费获取
2
收藏
来源与检测标记为平台登记信息,并不代表已展示可复核的检测报告。使用前请核对版本、依赖和所需权限,建议先在隔离环境中运行。
概述
安装方式
版本历史

快速语音转文字

Faster-Whisper

使用faster-whisper实现高性能本地语音转文字。

设置

1. 运行设置脚本

执行设置脚本以创建虚拟环境并安装依赖项。它将自动检测NVIDIA GPU以实现CUDA加速。

bash
./setup.sh

要求:

  • - Python 3.10或更高版本
  • ffmpeg(已安装在系统中)

使用方法

使用转录脚本处理音频文件。

基础转录

bash ./scripts/transcribe audio.mp3

高级选项

  • - 指定模型:./scripts/transcribe audio.mp3 --model large-v3-turbo
  • 词级时间戳:./scripts/transcribe audio.mp3 --word-timestamps
  • JSON输出:./scripts/transcribe audio.mp3 --json
  • VAD(静音移除):./scripts/transcribe audio.mp3 --vad

可用模型

  • - distil-large-v3(默认):速度与准确性的最佳平衡。
  • large-v3-turbo:推荐用于多语言或最高准确性任务。
  • medium.en、small.en:更快的纯英文版本。

故障排除

  • - 未检测到GPU:确保NVIDIA驱动程序和CUDA已正确安装。CPU转录速度会显著变慢。
  • 内存溢出错误:使用较小的模型(例如small或base),或使用--compute-type int8参数。

标签

skill ai

通过对话安装

以下为平台配置的接入选项,并非逐项实测通过。能否安装取决于客户端支持、技能来源和运行环境:

OpenClaw WorkBuddy QClaw Kimi Claude

方式一:安装 SkillHub 和技能

帮我安装 SkillHub 和 faster-whisper-local-1776420032 技能

方式二:设置 SkillHub 为优先技能安装源

设置 SkillHub 为我的优先技能安装源,然后帮我安装 faster-whisper-local-1776420032 技能

通过命令行安装

skillhub install faster-whisper-local-1776420032

下载

⬇ 下载 faster-whisper v1.0.0(免费)

文件大小: 5.81 KB | 发布时间: 2026-4-17 20:11

v1.0.0 最新 2026-4-17 20:11
Initial release
返回顶部