科技 > 人工智能 > 正文

微软解锁AI配音新技能：最长90秒多角色叙述，语音更像真人

IT之家

下载客户端
独家抢先看

2025年08月30日 15:14:04 来自山东

IT之家 8 月 30 日消息，科技媒体 Windows Latest 昨日（8 月 29 日）发布博文，报道称微软在 Copilot Labs 推出全新 AI 语音生成工具 Copilot Audio Expressions，可通过 Emotive 和 Story 两种模式生成更具情感的英文语音。

IT之家注：Copilot Audio Expressions 是一款 AI 语音生成工具，功能是让输出的音频更接近真人，并可根据需求加入创意润色。用户无需注册即可直接体验，并可下载 MP3 格式音频，方便在任何设备播放。

该工具目前提供 Emotive（情感表达）和 Story（故事创作）两种模式。

该媒体在测试 Emotive 模式后，选用“Oak”音色和“narration”叙述风格，将模拟火车站的脚本输入系统。

生成的音频不仅朗读了文字，还自动增添细节、调整措辞，让表达更生动。单段音频最长 59 秒，支持十余种声音与风格组合。

在 Story 模式下，系统自动选择音色和风格，用户仅需提供主题提示。

例如输入“讲一个猫在暗处潜行觅食的故事”，AI 就生成了一个长达 90 秒的多角色叙述：旁白用美式口音，猫的对白则为英式口音，并巧妙穿插互动，形成自然流畅的对话效果。

测试结果表明，Story 模式在情节构建、角色区分及声音融合度方面表现出色，输出的成品不像单调的机器朗读，更像是一次配音合作，让该工具不仅适用于简单朗诵，也可胜任有多角色的创意作品制作。

该工具目前仅支持英文，中文及其他语言用户暂无法直接生成母语音频，微软尚未透露后续是否会增加多语言支持。

“特别声明：以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布，本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

微软解锁AI配音新技能：最长90秒多角色叙述，语音更像真人

亲爱的凤凰网用户:

第三方浏览器推荐: