cosyvoice-speech-synthesizer让文字"开口说话"!用 AI 把任意文本变成自然流畅的语音,支持各种方言、情感和角色模仿。当你想把文章转成有声书、给视频配音、制作播客,或者只是好奇河南话/四川话怎么说时,用这个 skill。
Install via ClawdBot CLI:
clawdbot install songguocola/cosyvoice-speech-synthesizerGrade Fair — based on market validation, documentation quality, package completeness, maintenance status, and authenticity signals.
Calls external URL not in known-safe list
https://help.aliyun.com/zh/model-studio/cosyvoice-voice-listAudited Apr 18, 2026 · audit v1.0
Generated May 7, 2026
将文章、小说、教材等长文本转换为自然流畅的语音,支持多种方言和情感语气,适用于有声书制作、内容消费场景。用户可以指定方言(如四川话、广东话)或情感(如温柔、严肃)来增强听觉体验。
为宣传视频、广告片、短视频等快速生成配音,支持热情活泼或正式庄重的语气,并可选不同音色(如男声、女声、童声)。可调节语速和音量以适应画面节奏,提升制作效率。
制作语言学习材料或方言教学音频,例如慢速朗读诗歌、新闻等文本,支持多种方言(河南话、东北话等)和角色模仿(如老师、小孩),帮助学习者跟读练习。
为播客节目、语音通知、新闻播报等场景生成高质量语音内容,可模仿新闻主播或轻松对话风格,支持参数调节(语速、音量)以适应不同节目基调。
为游戏、虚拟助手、教学演示等场景生成角色化语音,如模仿老师、播音员、小孩等,增强交互趣味性和沉浸感。适用于教育游戏、客服机器人等。
通过API提供语音合成服务,用户根据生成的字符数或音频时长付费。可结合免费试用额度吸引开发者,后续按梯度定价,适合高频调用场景。
面向播客创作者、视频博主等提供月度/年度订阅,包含一定量合成时长和高级功能(如多音色、方言),支持批量转换。
为教育机构、出版社等提供定制化服务,包括私有化部署、专属音色克隆、方言库扩展等,按项目或年费收取。
💬 Integration Tip
使用前需设置DASHSCOPE_API_KEY环境变量,调用synthesize.py脚本时通过--text参数输入文本,--voice选择音色,即可快速生成WAV文件。
Scored Jun 29, 2026
Local speech-to-text with the Whisper CLI (no API key).
Transcribe audio files with speaker diarization (who speaks when). Supports 100+ languages, automatic language detection, and timestamps. Use for meetings, interviews, podcasts, or voice messages. Requires AssemblyAI API key.
Search and manage Spotify playlists, tracks, albums, artists, and playback state via the Spotify Web API. Use this skill when users want to search for music,...
使用 poocr 库识别发票并导出 Excel。当用户需要识别增值税发票、批量处理发票文件或提取发票信息到 Excel 时调用此技能。
Transcribe long audio files safely on 16GB RAM machines using auto-chunking with Whisper’s base model and seamless transcript merging.
Use when the user has audio or video and wants a timestamped transcript (SRT) in the source language. Routes by source language — Chinese defaults to Volcano...