Openclaw Skills - SenseAudio 会议助手:AI转录与笔记生成
什么是 SenseAudio 会议助手?
SenseAudio 会议助手是一个专为开发者设计的技术框架,用于构建和调试复杂的会议工作流。通过利用先进的自动语音识别(ASR),该技能有助于创建实时字幕系统、可搜索的会议存档和自动摘要工具。它有效地弥合了原始音频数据与可操作商业智能之间的鸿沟。
利用 Openclaw Skills 构建您的会议基础设施可确保高保真转录,并支持说话人角色分离(Speaker Diarization)和实时翻译。无论您是在构建实时会议副驾驶还是会议后分析引擎,该技能都提供了必要的协议来处理基于 WebSocket 的实时流和基于 HTTP 的文件处理,并具有专业级的准确性。
下载入口:https://github.com/openclaw/skills/tree/main/skills/scikkk/meeting-assistant
安装与下载
1. ClawHub CLI
从源直接安装技能的最快方式。
npx clawhub@latest install meeting-assistant
2. 手动安装
将技能文件夹复制到以下位置之一
全局模式~/.openclaw/skills/
工作区
<project>/skills/
优先级:工作区 > 本地 > 内置
3. 提示词安装
将此提示词复制到 OpenClaw 即可自动安装。
请帮我使用 Clawhub 安装 meeting-assistant。如果尚未安装 Clawhub,请先安装(npm i -g clawhub)。
SenseAudio 会议助手 应用场景
- 提供实时会议字幕或实时转录文本,用于无障碍访问和文档记录。
- 生成按说话人分离的会议记录,以跟踪个人贡献。
- 为国际团队创建双语或翻译后的会议输出。
- 自动提取会议摘要、关键决策和结构化的行动项。
- 从历史会议音频和 ASR 历史记录中构建可搜索的档案。
- 确定会议模式:选择 WebSocket 用于实时流媒体,或选择 HTTP 用于处理预录制的音频文件。
- 选择最佳识别模型:使用 sense-asr-pro 进行完整角色分离,或使用 sense-asr-deepthink 处理重翻译任务。
- 配置身份验证:使用安全的 API key 环境变量初始化连接。
- 处理音频流:发送 16kHz 单声道 PCM 数据用于实时任务,或上传文件进行离线处理。
- 归一化 ASR 输出:解析详细的 JSON 结果,以保留说话人标签、时间戳和片段边界。
- 生成产出物:通过 LLM 集成将归一化的转录文本转换为最终的摘要和行动项。
SenseAudio 会议助手 配置指南
要开始使用此技能进行构建,请确保您已准备好 API 凭据。按照以下步骤配置您的环境:
- 从 SenseAudio 平台获取您的 API key。
- 设置您的环境变量:
export SENSEAUDIO_API_KEY='your_api_key_here'
- 确保实时流的音频输入设置为 PCM, 16000Hz, Mono, 16-bit little-endian。
SenseAudio 会议助手 数据架构与分类体系
该技能将会议数据组织成结构化格式,以确保与下游 LLM 处理的兼容性:
| 特性 | 数据类型 | 描述 |
|---|---|---|
| Transcript | JSON / Markdown | 带有说话人标签的归一化文本段。 |
| Timestamps | word / segment | 用于精确导航的粒度时间数据。 |
| Metadata | Object | 包括情感分析和置信度得分。 |
| Action Items | List | 带有负责人和截止日期的结构化识别任务。 |
| Audio Specs | PCM/WAV | 强制执行 16kHz 单声道以实现实时兼容性。 |
name: senseaudio-meeting-assistant
description: 用于构建和排查 SenseAudio 会议助手,覆盖实时会议转写、说话人区分、实时翻译、会议纪要生成、行动项提取与转录导出。Build and troubleshoot SenseAudio meeting assistants for live meeting transcription, speaker-aware records, realtime translation, meeting note generation, action item extraction, and transcript export.
metadata:
openclaw:
requires:
env:
- SENSEAUDIO_API_KEY
primaryEnv: SENSEAUDIO_API_KEY
homepage: https://nightly.senseaudio.cn
compatibility:
required_credentials:
- name: SENSEAUDIO_API_KEY
description: API key from https://nightly.senseaudio.cn/platform/api-key
env_var: SENSEAUDIO_API_KEY
homepage: https://nightly.senseaudio.cn
SenseAudio 会议助手 / SenseAudio Meeting Assistant
使用这个 skill 来构建基于 SenseAudio ASR 的会议类工作流。 Use this skill to build meeting-focused workflows on top of SenseAudio ASR.
先读哪些文件 / Read First
references/realtime-workflow.md- 实时会议的 WebSocket 转写流程 / realtime WebSocket transcription flow for live meetingsreferences/offline-meeting-transcription.md- 录音文件的 HTTP 转写、说话人分离、时间戳与翻译 / HTTP transcription with diarization, timestamps, sentiment, and translationreferences/note-generation.md- 如何把转写结果整理成会议纪要、决策与行动项 / how to turn transcripts into structured meeting notes, decisions, and action itemsreferences/examples.md- 常见会议助手场景的最小实现示例 / minimal examples for common meeting assistant tasks
按用户需求只加载必要的参考文件,不要一次性全读。 Load only the reference file(s) needed for the user's request.
适用场景 / When To Use
当用户需要以下能力时,使用这个 skill: Use this skill when the user wants any of the following:
- 实时会议字幕或实时转写 / live meeting captions or realtime transcripts
- 带说话人区分的会议记录 / speaker-separated meeting records
- 双语会议输出或会中翻译 / bilingual or translated meeting output
- 会议摘要、决策提取、行动项整理 / meeting summaries, decisions, and action items
- 基于会议音频或识别历史构建可搜索归档 / searchable archives built from meeting audio or ASR history
- 将 SenseAudio ASR 与 LLM 摘要能力结合的会议助手 / a meeting copilot combining SenseAudio ASR with LLM summarization
能力路由 / Capability Routing
优先选择满足需求的最小实现。 Choose the smallest implementation that satisfies the request.
- 实时会议助手 / Live meeting assistant → 读取
references/realtime-workflow.md - 录音会议处理 / Recorded meeting processing → 读取
references/offline-meeting-transcription.md - 音质预检 / Audio quality triage → 先走音频质量分析接口
- 历史记录查询 / Historical transcript lookup → 使用识别记录查询接口
- 纪要与行动项整理 / Structured notes and actions → 再读取
references/note-generation.md
默认工作流 / Default Workflow
- 先判断会议模式 / Pick meeting mode:
- 直播中 / 开会中 → 使用 WebSocket 实时识别 / live meeting → WebSocket realtime ASR
- 已有录音文件 → 使用 HTTP 文件转写 / uploaded recording → HTTP transcription
- 再选择识别模型 / Choose recognition settings:
sense-asr-pro:默认首选,适合会议场景,支持说话人分离、时间戳、情感与翻译 / best default for meetings needing diarization, timestamps, sentiment, and translationsense-asr:适合需要翻译但对会议增强能力要求较轻的场景 / useful when translation is needed but meeting constraints are lightersense-asr-deepthink:适合实时 WebSocket 或更偏翻译理解的场景 / suitable for realtime WebSocket or translation-heavy semantic cleanup
- 先构造最小可用请求 / Build a minimal valid request first:
- 加上
Authorization: Bearer <SENSEAUDIO_API_KEY> - 先只保留必填参数 / keep only required fields initially
- 只有在确实需要时再开启说话人分离、时间戳、翻译、情感分析 / add diarization, timestamps, translation, or sentiment only when needed
- 统一转写结果结构 / Normalize transcript output:
- 保留说话人、时间戳、翻译文本、分段边界 / preserve speaker, timestamps, translation, and segment boundaries
- 先把 ASR 原始结果归一化,再进入纪要或行动项生成 / normalize ASR output before summarization
- 最后生成会议产物 / Generate meeting artifacts:
- 会议摘要 / summary
- 关键决策 / decisions
- 带负责人和时间定位的行动项 / action items with owner and timestamp when possible
- 可导出的 Markdown 或 JSON / export-ready Markdown or JSON
实现规则 / Implementation Rules
- 严禁硬编码密钥,统一从环境变量
SENSEAUDIO_API_KEY读取。Do not hardcode secrets; readSENSEAUDIO_API_KEYfrom environment variables. - 实时会议流式识别必须满足
pcm、16000Hz、单声道、16-bit little-endian。For realtime streaming, enforcepcm,16000Hz, mono, signed 16-bit little-endian. - 录音会议优先使用
response_format=verbose_json,保留会议所需元数据。For recorded meetings, preferresponse_format=verbose_json. - 说话人分离只在支持的模型上使用,
max_speakers仅适用于sense-asr-pro。Use diarization only with supported models;max_speakersis only forsense-asr-pro. - 使用
sense-asr-deepthink时不要传language,只使用target_language。Do not sendlanguagewithsense-asr-deepthink; usetarget_languageonly. - 会议纪要生成属于第二阶段,必须建立在结构化转写结果之上。Treat note generation as a second stage after transcript normalization.
- 如果用户要生产级代码,输出中要包含超时、重试、日志与失败处理。Include timeout, retry, logging, and failure handling for production code.
输出检查清单 / Output Checklist
当你给出实现方案时,至少包含: When producing implementation output, include:
- 选用的接口与模型 / chosen endpoint and model
- 最小可运行请求示例 / minimal request example
- 转写结果解析方式 / transcript parsing strategy
- 纪要 / 行动项生成方式(如用户需要) / note and action-item generation strategy if requested
- 会议场景下的限制说明,例如音频格式、说话人分离限制、翻译行为 / meeting-specific caveats such as audio format, diarization limits, or translation behavior
常见坑点 / Common Pitfalls
- 没有说话人字段 / Missing diarization fields:确认已开启
enable_speaker_diarization=true,并使用sense-asr或sense-asr-pro - 没有字级时间戳 / No word timestamps:确认设置了
timestamp_granularities[]=word - 实时识别报错 / Realtime failures:检查发送的是原始 PCM 数据,而不是
wav/mp3容器字节 - DeepThink 参数报错 / DeepThink errors:移除不支持的
language或其他不兼容参数 - 纪要质量差 / Weak meeting notes:优先基于结构化
segments总结,不要只对整段纯文本做摘要