@ClaraChappaz: 来自Kyutai实验室的声音瑰宝,@GradiumAI正加速前进!
摘要
Gradium AI发布了Voice Design,允许从描述口音、年龄、性别和语速的文本提示创建自定义AI语音,可通过其API和Studio使用。
来自Kyutai实验室的声音瑰宝,@GradiumAI正加速前进!
查看缓存全文
缓存时间: 2026/09/10 22:30
Kyutai实验室的一颗声音明珠,@GradiumAI 正在加速起飞!
Gradium (@GradiumAI): 今日,我们推出「语音设计」功能。
输入提示词,即可生成语音。
描述所需口音、年龄、性别及语速,数秒内即可获得全新语音,随时可用。
现已通过 Gradium API 和 Studio 免费开放使用。
相似文章
@GradiumAI: 今天,我们推出 Voice Design。编写提示,创建声音。描述口音、年龄、性别和节奏,您的使用场景需要。
Gradium AI 发布 Voice Design,这是一款免费工具,用户可通过其 API 和 Studio 从文本提示生成自定义语音,在口音和提示遵循上性能出色。
@RemiCadene: 我喜欢这个功能。听到这个真酷 :)
Gradium 已推出 Voice Design,这是一个功能,可从文本提示创建自定义AI语音,现已在其API和Studio中免费上线。
@googlegemma: 无需等待的语音AI!感谢Hugging Face和Cerebras,开发者现在可以用Gemma 4 31B模型作为……
Google Gemma宣布,借助Hugging Face和Cerebras实现超快推理,开发者现在可以将Gemma 4 31B模型用作语音AI的大脑,这是开源级联语音到语音堆栈的一部分。
jamiepine/voicebox
Voicebox 是一个开源的、本地优先的 AI 语音工作室,支持语音克隆、语音生成、听写和 AI 代理集成,提供隐私保护和多引擎 TTS 支持。
使用 Gemini 2.5 进行高级音频对话和生成
Google 宣布 Gemini 2.5 具备先进的原生音频功能,可实现实时对话型 AI,支持自然语音生成、风格控制和 24 种以上语言的多模态理解。