shumianyu将分段 asr 文本流在结束时统一整理成流畅书面语,并在用户指定 target_language 时输出译文。适用于语音听写、会议转写、采访整理、播客或视频字幕后处理等场景,尤其适合不需要实时字幕、只需要在整段结束后得到最终书面结果的任务。保持接口抽象、可替换,不绑定任何特定厂商 api。
Install via ClawdBot CLI:
clawdbot install Hei-MaoM/shumianyuGrade Limited — based on market validation, documentation quality, package completeness, maintenance status, and authenticity signals.
Generated Mar 22, 2026
在会议或研讨会结束后,将ASR系统生成的原始口语转录文本统一整理为流畅的书面会议纪要。适用于企业会议、学术讨论等场景,无需实时字幕,只需在会议结束后获得正式、可读的文档。
记者或研究人员完成采访录音后,将分段ASR文本流统一处理为书面采访稿。自动删除口语重复、自我修正和语气词,保留原意和关键信息,生成可直接编辑或发布的文稿。
为播客节目或视频内容生成最终字幕或文字稿。在整段音频/视频处理完成后,将ASR原始输出统一改写为流畅书面语,提升可读性,适用于内容存档、多语言分发或无障碍访问。
用户通过语音输入长篇文档(如报告、邮件、创作内容)后,在输入结束时统一润色。将口语化表达转换为正式书面语,修正断句和重复,生成可直接使用的文本,提高语音输入效率。
向企业或个人提供基于API的按量或订阅制服务,用于会议纪要、采访整理等场景的文本后处理。可按处理时长、字符数或项目数收费,支持多语言翻译增值功能。
将技能集成到现有ASR系统、会议软件、内容管理平台或语音助手产品中,作为增值模块提供。通过技术授权或分成模式盈利,增强宿主产品的文本处理能力。
为媒体机构、法律、医疗等特定行业提供定制化文本整理服务,包括领域词库优化、工作流集成和合规处理。针对高价值场景提供端到端解决方案。
💬 Integration Tip
设计时保持接口抽象,避免绑定特定ASR厂商,使用语义等价字段接收输入以确保灵活替换上游系统。
Scored Apr 19, 2026
Local speech-to-text with the Whisper CLI (no API key).
Transcribe audio files with speaker diarization (who speaks when). Supports 100+ languages, automatic language detection, and timestamps. Use for meetings, interviews, podcasts, or voice messages. Requires AssemblyAI API key.
Search and manage Spotify playlists, tracks, albums, artists, and playback state via the Spotify Web API. Use this skill when users want to search for music,...
使用 poocr 库识别发票并导出 Excel。当用户需要识别增值税发票、批量处理发票文件或提取发票信息到 Excel 时调用此技能。
Transcribe long audio files safely on 16GB RAM machines using auto-chunking with Whisper’s base model and seamless transcript merging.
Use when the user has audio or video and wants a timestamped transcript (SRT) in the source language. Routes by source language — Chinese defaults to Volcano...