核心功能
从克隆你的声音,到一键生成任意音频,再到把录音转成文字。
录音或上传 20 秒音频,即可复刻出专属音色角色,并支持分类管理、按需复用。
输入文案,选择音色(预置或克隆),一键生成自然流畅的语音,支持 12 种情感风格。
录制语音自动转文字,支持中文、英文及自动语言检测,结果一键复制。
温柔、活泼、播音、磁性等 12 种预设风格,还可自定义标签并保存复用。
开场白标签与内嵌标签,覆盖常见配音场景,支持分类管理与自定义。
自动保存每次生成记录,右侧边栏随时回放、复制、加载到编辑器复用。
使用流程
从克隆音色到生成成品,全程可视化,无需任何技术门槛。
录制或上传 20 秒内的语音样本,选择你的声音素材。
试听复刻效果,命名并分类保存,形成你的专属音色库。
在文生音中选择音色与风格,输入文案,一键生成语音。
预置音色
中英双语 8 种预置音色,配合克隆音色,覆盖绝大部分配音场景。
常见问题
工具本身完全免费,仅需在设置中填入你自己的 MiMo API Key。MiMo TTS 大模型限时免费,按照软件设置中填写邀请码,还可额外获得 10 元体验金。
提供 Windows 桌面应用,MacOS 版和 Android 版,近期即将发布。
录音 20 秒内的样本提交后,数秒即可完成复刻并生成预览,保存后即可在文生音中使用。
所有数据仅存于本地,音色、风格与历史记录都保存在你的文档目录中,不上传到任何第三方服务器。