闲社服务运行正常AI智能体自动化平台
g

双子语音助手

技能标识:gemini-voice-assistant

Voice-to-voice AI assistant using Gemini Live API. Speak to the AI and get spoken responses. Use when you want to have natural voice conversations with an AI assistant powered by Google's Gemini models.

作者:admin | 来源记录:ClawHub
登记来源
ClawHub
版本
V 1.0.0
检测标记
后台标记通过
免费
免费获取
1
收藏
来源与检测标记为平台登记信息,并不代表已展示可复核的检测报告。使用前请核对版本、依赖和所需权限,建议先在隔离环境中运行。
概述
安装方式
版本历史

双子语音助手

Gemini 语音助手

由 Google Gemini Live API 驱动的语音到语音 AI 助手。与 AI 对话,它会以自然语音回应。

使用方法

文本模式

bash
cd ~/.openclaw/agents/kashif/skills/gemini-assistant && python3 handler.py 你的问题或消息

语音模式

bash
cd ~/.openclaw/agents/kashif/skills/gemini-assistant && python3 handler.py --audio /path/to/audio.ogg 可选上下文

响应格式

处理器返回 JSON 响应:

json
{
message: [[audioasvoice]]\nMEDIA:/tmp/geminivoicexxx.ogg,
text: 来自 Gemini 的文本响应
}

配置

设置你的 Gemini API 密钥:

bash
export GEMINIAPIKEY=your-api-key-here

或者在技能目录中创建 .env 文件:

GEMINIAPIKEY=your-api-key-here

模型选项

默认模型为 gemini-2.5-flash-native-audio-preview-12-2025,支持音频。

要使用其他模型,编辑 handler.py:

python
MODEL = gemini-2.0-flash-exp # 仅文本模式

依赖要求

  • - google-genai>=1.0.0
  • numpy>=1.24.0
  • soundfile>=0.12.0
  • librosa>=0.10.0(用于音频输入)
  • FFmpeg(用于音频转换)

功能特性

  • - 🎙️ 语音输入/输出支持
  • 💬 文本对话
  • 🔧 可配置的系统指令
  • ⚡ Gemini Flash 快速响应

标签

skill ai

通过对话安装

以下为平台配置的接入选项,并非逐项实测通过。能否安装取决于客户端支持、技能来源和运行环境:

OpenClaw WorkBuddy QClaw Kimi Claude

方式一:安装 SkillHub 和技能

帮我安装 SkillHub 和 gemini-voice-assistant-1776420045 技能

方式二:设置 SkillHub 为优先技能安装源

设置 SkillHub 为我的优先技能安装源,然后帮我安装 gemini-voice-assistant-1776420045 技能

通过命令行安装

skillhub install gemini-voice-assistant-1776420045

下载

⬇ 下载 gemini-voice-assistant v1.0.0(免费)

文件大小: 4.68 KB | 发布时间: 2026-4-17 19:24

v1.0.0 最新 2026-4-17 19:24
Initial release - Voice-to-voice AI assistant using Gemini Live API
返回顶部