Voice Engine
已预览一年,OpenAI 语音克隆服务 Voice Engine 仍未正式推出
去年三月底,OpenAI 宣布了一项名为 Voice Engine(声音引擎)的人工智能服务的“小规模预览”,声称该技术能够在仅需 15 秒语音的情况下克隆一个人的声音。然而,近一年过去,这项工具仍未正式推出,OpenAI 也未透露其是否会全面上线,以及何时上线。
3/7/2025 5:00:17 PM
远洋
OpenAI首次官宣语音项目,配音演员警报拉响
文本输入和一个 15 秒的音频样本就能生成与原始说话者非常相似的自然声音。今天,OpenAI 在语音领域又带给我们一点点震撼,通过文本输入以及一段 15 秒的音频示例,可以生成既自然又与原声极为接近的语音。值得注意的是,即使是小模型,只需一个 15 秒的样本,也能创造出富有情感且逼真的声音。OpenAI 将这个语音引擎命名为 Voice Engine,首次开发时间是 2022 年末,今天是 Voice Engine 预览版的首次亮相。下面为该语音引擎的一些早期示例,例如可以帮助用户翻译视频和播客等内容,输入一段原始
4/1/2024 11:18:00 AM
机器之心
- 1
资讯热榜
国内首个,MiniMax 大模型通过人机辩论图灵测试
逆天!旧Mac上能run千亿参数SOTA!效果惊人:一次生成游戏,0修改!本地大模型拐点来了!网友:别被大模型叙事带偏了(附指南)
阶跃星辰新一代基础大模型 Step 3 正式开源:拥有强大视觉感知和复杂推理能力
CAPTCHA 拦不住 AI 了:ChatGPT 可绕过 Cloudflare 人机验证系统
多项力压 Grok 4、OpenAI o3,谷歌推出 Gemini 2.5 Deep Think 模型
刚刚,OpenAI推出学习模式,AI教师真来了,系统提示词已泄露
ChatGPT大更新推出学习模式!“一夜之间1000个套壳应用又死了”
小学都看得懂!帮你快速了解 Tool、MCP 和 Agent 的基础科普
标签云
AI
人工智能
OpenAI
AIGC
模型
ChatGPT
DeepSeek
AI绘画
谷歌
机器人
数据
大模型
Midjourney
开源
智能
用户
Meta
微软
GPT
学习
技术
图像
Gemini
AI创作
马斯克
论文
智能体
英伟达
Anthropic
代码
算法
训练
Stable Diffusion
芯片
开发者
蛋白质
腾讯
生成式
LLM
苹果
Claude
神经网络
AI新词
3D
Agent
机器学习
研究
生成
AI for Science
xAI
计算
人形机器人
AI视频
Sora
GPU
AI设计
百度
华为
搜索
大语言模型
工具
场景
RAG
字节跳动
具身智能
大型语言模型
预测
深度学习
伟达
视觉
Transformer
AGI
视频生成
神器推荐
亚马逊
Copilot
DeepMind
架构
模态
安全