Google GenAI Python SDK发布v2.25.0,把语音能力接入SDK
python-genai v2.25.0于 2026 年 9 月 22 日发布,新增Voices API资源、Voice的sample_audio,并在公开GenAI SDK中暴露SpeechMetadata、VoiceConfig.voice和SpeechAnnotation。
AI解读:这次发布的重点是语音链路被正式接进SDK。此前语音相关能力即使存在于服务端,Python开发者也可能要绕路调用,现在Voices API资源和Voice的sample_audio都进了GAOS SDK,SpeechMetadata、VoiceConfig.voice、SpeechAnnotation也暴露在公开GenAI SDK中。
对已经在用python-genai的开发者来说,直接变化是可以用同一套SDK处理语音配置和语音标注,不必为这部分单独维护封装。sample_audio的存在意味着Voice不只是一个标识符,还能携带示例音频数据。
这些是SDK层面的接口变化,不代表底层模型能力本身有升级。实际能用到哪些语音功能,仍取决于对应GAOS服务和具体API的开放范围,发布说明没有给出可用区域或配额细节。
Google的python-genai仓库发布v2.25.0,版本号从v2.24.0升到v2.25.0,发布日期为 2026 年 9 月 22 日。
该版本的Features列表包含:在GAOS SDK中为Voice增加sample_audio;为GAOS SDK增加Voices API资源;在公开GenAI SDK中暴露SpeechMetadata、VoiceConfig.voice和SpeechAnnotation;支持map add_union_value注解的field.value_field语法;更新discovery doc;将voice接入SDK。
Bug Fixes部分列出一项:清理GAOS OpenAPI生成中的路径参数描述(Sanitize path parameter descriptions in GAOS OpenAPI generation)。