温暖故事
“用温暖、亲密的语气朗读:每一段美好的旅程,都始于迈出熟悉世界的那一个小决定。”
通过对话生成、转写并持续调整语音作品。
由领先的语音模型驱动
语音智能体能做什么
文稿、音色、语速、发音和返工,全部在同一个对话里完成。不用时间线,不用插件,也不用重录。
中文发音校准
ElevenLabs v3 支持词组级拼音或 IPA 规则。VocAny 会在合成时采用指定读音,同时完整保留中文原稿。
直接说出你想听到的效果,比如轻一点、慢一点,或在最后一句前停顿。智能体会生成新版本,不必再去找参数。
OpenAI 与 ElevenLabs 共 15 个现成音色;如果都不合适,描述一个还不存在的声音,它会替你设计出来。
也能处理你的素材
上传访谈、语音备忘录或视频,它会转写内容、提炼要点,也能把其中任意一段重新配音。
00:02关于发布,没人会提前告诉你的是:第一周基本都在听反馈。
00:09新手引导我们重写了三遍,才有人真正走完。
每次修改都保存在上一版旁边,两轮之前更喜欢的那条读法,随时能找回来。
使用方式
01
粘贴文稿或上传音频,再说明它该是什么感觉。
02
智能体挑好音色与语速,生成音频,并直接在对话里播放。
03
用日常语言提修改意见,满意后导出 MP3 或 WAV。
从这里开始
旁白、营销和播客范例都能一键填入输入框,改几句话,就能开始制作自己的版本。
“用温暖、亲密的语气朗读:每一段美好的旅程,都始于迈出熟悉世界的那一个小决定。”
“制作一段沉稳的纪录片旁白:在城市街道之下,一张看不见的网络支撑着数百万人的日常运转。”
“用自信、现代的语气朗读:认识一个把想法直接变成成品的工作空间,把繁琐留在身后。”
“用轻快、有活力的语气朗读,第一句后短暂停顿:你下一个喜爱的工作流已经到来。今天就开始创作。”
“制作一段亲切的播客开场:欢迎回来。今天,我们来聊聊那些悄然塑造优秀产品的决定。”
“用清晰、自然的讲解语气朗读:语音模型会学习节奏、音色和发音模式,再利用这些模式合成新的语音。”
常见问题
一个用对话完成配音的工作台。说清楚要读的文字、语气和节奏,它就会生成音频,并陪你一轮轮改到满意。
语音合成使用 OpenAI gpt-4o-mini-tts、ElevenLabs Multilingual v2 与 ElevenLabs v3,两家服务商共提供 15 个现成音色;转写使用 gpt-4o-mini-transcribe。
可以。描述年龄、口音、质感和情绪,它会用 ElevenLabs Voice Design 设计出来,之后的配音也能继续使用这把嗓音。
可以。上传音频或视频后,它会转写内容、提炼要点,也能把其中任意一段重新配音。
语音模型均支持多语种:用哪种语言写文稿,它就用哪种语言朗读;也可以让它先翻译再朗读。中文使用 ElevenLabs v3 时,还能用词组级拼音或 IPA 修正多音字,同时保留原始文稿。
按积分计费。每 500 字符,OpenAI Speech 消耗 8 积分,ElevenLabs 消耗 12 积分,设计一个新音色 24 积分。套餐从每月 $9.9 起。
MP3 或 WAV,可以在对话里直接下载,也可以到作品库里取。每条音频都会和对应文稿存放在一起。
需要。账号用来保存你的作品库、音色和积分余额,注册只要几秒钟。