返回 Blog
产品动态最新

秒级样本生成专属 AI 声音主播

仅需录制秒级音频,即可快速拥有专属 AI 定制音色。可应用于视频创作、数字人驱动、语音助手与有声阅读等多种场景;情感表达能力提升 60%,支持细粒度情绪控制。

Donald

Donald

2024 年 3 月 18 日·6 分钟

秒级样本生成专属 AI 声音主播

使用PodifyAI,仅需录制秒级音频,即可快速拥有专属 AI 定制音色——生成可用于播客、视频号与品牌内容的专属主播声线。

相较上一代,新引擎在音色还原之外,显著增强了情感表达与语气控制能力(情感表达能力提升约 60%)。同样一段文案,可以读得更克制、更兴奋,或更适合深度访谈的节奏。它也可广泛应用于视频创作、数字人驱动、语音助手等多种场景。

为什么需要「更短样本、更稳音色」

创作者最常遇到的问题不是「能不能生成声音」,而是「听起来像不像自己、能不能长期复用」。样本越长,采集成本越高;样本越短,又容易丢失细节。

2.0 版本通过更细粒度的说话人表征与噪声鲁棒训练,把可用样本门槛压到约 3 秒,同时在长文朗读中保持音色一致性,减少中后段「跑味」的情况。

情感控制从「有没有」到「可控」

新版本支持更细的情绪与节奏调节,适合口播带货、知识分享、访谈旁白等不同场景。你可以先生成中性版本,再针对重点段落加强情绪,而不必整段重录。

我们也优化了与脚本工作流的衔接:在工作室中选好声线后,可直接进入双人对谈排版与封面生成,减少工具之间的来回切换。

应用场景

视频配音:复刻特色声音,如 IP、搞怪等特色化声音,为创作带来更多元、更高效的方式,激发创作灵感。

数字人驱动:支持输出音素级时间戳,配合数字人实现个性化形象定制能力。

语音助手:复刻独具特色的品牌人机交互音色,例如家人、朋友等,作为手机助手、导航语音、游戏趣味语音等,为用户提供独特的交互体验。

有声阅读:快速复刻家人、朋友的声音,用声音来实现「分身术」,随时随地给予用户亲切、温暖的阅读陪伴,为用户打造定制化的听书体验。

如何开始体验

登录创作工作室,在声音相关步骤上传短样本并试听;满意后即可用于整集生成。若你已有旧版克隆声线,可在设置中按提示迁移或重新采样。

我们会持续迭代口音覆盖、多人对话自然度与企业级声线管理能力。欢迎把试听反馈发给我们,帮助下一版做得更好。

想把文字变成可发布的播客视频?

在创作工作室里一站完成脚本、配音、封面与竖版导出。

立即开始