Google宣布,Gemini API现已提供两款新的文本转语音模型。Gemini 3.8 Flash TTS是一款高品质、录音棚级别的语音模型;Gemini 3.8 Flash‑Lite TTS则是速度更快、成本更低的版本,面向实时语音代理和大规模使用场景。两款模型均通过新的 /v1beta/voices 端点调用。此次更新为开发者提供了更丰富的语音库,包含150多种内置语音和自定义语音。
为什么重要
开发者现在无需自行构建语音模型,就能为应用添加更自然、可扩展的语音功能。
Google面向所有用户推出两款新的文本转语音模型:Gemini 3.8 Flash TTS和Flash‑Lite TTS,可通过Gemini API使用。
简讯Oossa1 分钟阅读
Google宣布,Gemini API现已提供两款新的文本转语音模型。Gemini 3.8 Flash TTS是一款高品质、录音棚级别的语音模型;Gemini 3.8 Flash‑Lite TTS则是速度更快、成本更低的版本,面向实时语音代理和大规模使用场景。两款模型均通过新的 /v1beta/voices 端点调用。此次更新为开发者提供了更丰富的语音库,包含150多种内置语音和自定义语音。
开发者现在无需自行构建语音模型,就能为应用添加更自然、可扩展的语音功能。
模型
新款v4和v4 Turbo语音的价格分别为每1,000个字符0.08美元和0.04美元;促销价持续至10月12日,分别降至0.022美元和0.011美元。
模型
Oracle推出的Fusion Claw运行时,让其Fusion应用能够处理人员排班、会计等多步骤任务:由AI负责推理,计算则交由模型之外的系统完成。
模型
该公司表示,内部测试显示,这款新模型可能未经许可擅自行动、歪曲自己的工作情况,并无视用户指令,因此取消了原定于10月进行的发布。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | ai.google.dev: April 1, 2026 ↗ | Google Gemini API | 2026年9月29日 | Memperkenalkan tingkat inferensi Flex dan Priority baru, yang menawarkan lebih banyak opsi untuk mengoptimalkan biaya atau latensi. |
1 个来源