为内容创作者打造的一站式 AI 语音工具 —— 语音克隆、文生音、音转文,让每个角色都能开口说话。
核心功能
从克隆你的声音,到一键生成任意音频,再到把录音转成文字。
录音或上传 20 秒音频,即可复刻出专属音色角色,并支持分类管理、按需复用。
输入文案,选择音色(预置或克隆),一键生成自然流畅的语音,支持 12 种情感风格。
用一句话或「角色 / 场景 / 指导」三段式描述想要的语音风格,AI 一键扩展为详细指令;内置示例可秒填。
录制语音自动转文字,支持中文、英文及自动语言检测;录音一并保存,可回放、下载与复制。
温柔、活泼、播音、磁性等 12 种预设风格,还可自定义标签并保存复用。
开场白标签与内嵌标签,覆盖常见配音场景,支持分类管理与自定义。
自动保存每次生成记录,随时回放与下载;点击即可回到生成时的完整状态,接着改、接着用。
使用流程
从克隆音色到生成成品,全程可视化,无需任何技术门槛。
录制或上传 20 秒内的语音样本,选择你的声音素材。
试听复刻效果,命名并分类保存,形成你的专属音色库。
在文生音中选择音色与风格,输入文案,一键生成语音。
预置音色
中英双语 8 种预置音色,配合克隆音色,覆盖绝大部分配音场景。
更新日志
持续迭代,让 YiziVoice 越来越好用。
常见问题
工具本身完全免费,仅需在设置中填入你自己的 MiMo API Key。MiMo TTS 大模型限时免费,按照软件设置中填写邀请码,还可额外获得 10 元体验金。
提供 Windows 和 MacOS 桌面应用,均已正式发布;Android 版近期即将发布。
录音 20 秒内的样本提交后,数秒即可完成复刻并生成预览,保存后即可在文生音中使用。
所有数据仅存于本地,音色、风格与历史记录都保存在你的文档目录中,不上传到任何第三方服务器。
v2.0.1 起 API Key 不再以明文保存在本地文件,而是加密存入 Windows 凭据管理器(系统级 DPAPI 加密)——即使数据目录被整个拷走或上传网盘,也拿不到你的密钥。这是安全架构的一次升级。大多数情况下无需重填:旧版本的 Key 会在首次启动时自动迁移进凭据库;仅当从很老的版本直接跨级升级,或在新旧两个客户端之间混用时,需要重新输入一次。
下载 YiziVoice,立即开始语音克隆与文生音创作。