mosi-transcribe-diarizeMOSS 多说话人转写技能。支持 URL / 本地文件 / Base64 音频输入, 输出带时间戳与 speaker 的结构化转写结果(JSON、逐段文本、按说话人汇总)。 用于会议纪要、访谈录音、多人对话整理。
Install via ClawdBot CLI:
clawdbot install mkkb473/mosi-transcribe-diarizeGrade Fair — based on market validation, documentation quality, package completeness, maintenance status, and authenticity signals.
Calls external URL not in known-safe list
https://studio.mosi.cnAudited Apr 18, 2026 · audit v1.0
Generated May 11, 2026
企业内部会议录音上传后,自动生成带说话人标签的逐字稿和按人汇总,方便快速整理纪要,追踪决策和任务分配。
记者或研究人员将访谈音频转写为结构化文本,区分采访者和受访者,支持逐段回看,提高内容分析效率。
呼叫中心将客服对话录音转写为文本,自动识别坐席与客户,通过关键词检索和话术分析提升服务质量。
教育机构处理多讲师课程视频,生成带时间轴的字幕文件和按讲师分开的讲稿,便于学员复习和内容二次编辑。
律师事务所上传听证会或证词音频,生成精确到发言人的笔录,支持快速定位关键陈述,节省手动整理时间。
用户根据音频时长或调用次数付费,提供标准及加急服务。适合零散需求的小型客户,收入随使用量增长。
企业按月或年订阅,获得固定配额(如每月100小时转写)。适合高频使用的客户,带来稳定经常性收入。
开发者或平台企业通过API集成该技能,根据转写量或固定年费计费。适合将功能嵌入自有产品的客户。
💬 Integration Tip
可通过设置环境变量 MOSS_API_KEY 快速集成,只需一行命令即可处理 URL 或本地音频,返回 JSON 及分段文本,适合嵌入自动化工作流。
Scored May 11, 2026
Local speech-to-text with the Whisper CLI (no API key).
Transcribe audio files with speaker diarization (who speaks when). Supports 100+ languages, automatic language detection, and timestamps. Use for meetings, interviews, podcasts, or voice messages. Requires AssemblyAI API key.
Search and manage Spotify playlists, tracks, albums, artists, and playback state via the Spotify Web API. Use this skill when users want to search for music,...
使用 poocr 库识别发票并导出 Excel。当用户需要识别增值税发票、批量处理发票文件或提取发票信息到 Excel 时调用此技能。
Transcribe long audio files safely on 16GB RAM machines using auto-chunking with Whisper’s base model and seamless transcript merging.
Use when the user has audio or video and wants a timestamped transcript (SRT) in the source language. Routes by source language — Chinese defaults to Volcano...