
mimo-tts-wavMiMo V2.5 TTS 语音合成。使用小米 MiMo V2.5 TTS 系列模型生成语音。当需要将文字转为语音、发送语音消息、朗读内容、或用户要求「说出来」「语音回复」时激活此 skill。支持预置音色、音色设计、音色克隆三种模式,支持自然语言控制、导演模式,支持语气、情绪、方言的风格标签控制,预置音色支持唱歌。
mimo-omni使用小米 MiMo 的多模态模型分析和理解图片、视频和音频。当用户发送图片/视频/音频附件,询问视觉内容,请求图片描述、OCR、物体检测、场景理解、视频分析或音频转录/理解时使用。
mimo-asr小米 MiMo-V2.5-ASR 语音识别技能。通过 Gradio API 调用,将音频转录为文字,支持中英文自动检测和显式指定。无需本地模型,无需 API Key。当用户请求语音转文字、音频转录、提取对话内容时使用。
mijia-py-api米家智能家居设备控制技能包。通过 mijiaAPI 驱动,支持查询设备状态、控制设备属性、运行场景等。当用户请求控制智能家居设备、查询温湿度/电量/开关状态时使用。 ·本技能是从Github但未发布到clawhub的项目转载而来的,如果你是那位开发者,如果不同意我发布,请及时联系我。