AIREITER

Gemini 3.8 Live API 定价:目前有哪些官方信息(2026)

最后更新: 2026-09-15 18:54:10

模型已经正式上线,并不代表价格表也会同步公开。Gemini 3.8 Live 目前正是如此:Google 于 2026 年 9 月 15 日发布了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,但现有文档中尚未给出单独的 3.8 Live 美元定价。规划语音代理成本时,不能直接套用 Gemini 3.8 Flash 的 $0.75/$3.75 token 价格。

先说结论:Gemini 3.8 Live 已发布,API 价格尚未公布

Google 的发布公告称,这两款模型自 2026 年 9 月 15 日起开始通过 Gemini API 和 Google AI Studio 向开发者逐步推出。这只能说明产品可用,并不等于公开定价已经最终确定。公告将 Gemini 3.8 Live 称为高性价比方案,将 Extended Thinking 称为定价有竞争力,但没有披露按分钟或按音频 token 计算的费率。

问题答案
Gemini 3.8 Live 是否已正式发布?是,Google 于 2026 年 9 月 15 日宣布发布。
开发者现在能访问吗?Google 表示,已开始通过 Gemini API 和 AI Studio 逐步推出。
是否有官方的 3.8 Live 价目表?本文查阅的 Gemini API 定价页面中没有。
Gemini 3.8 Flash 的价格能否直接视为 Live 的价格?不能。gemini-3.8-flash 与 Live 系列是不同的模型标识符。
现在能精确计算一次 3.8 Live 调用的成本吗?不能,除非你拥有账号专属报价,或官方之后公布费率条目。

Google 在 2026 年 9 月 15 日发布了什么

Google 推出了两款面向实时语音对话的音频模型,侧重点并不相同。Gemini 3.8 Live 面向流畅、可扩展的对话体验;Gemini 3.8 Live Extended Thinking 则瞄准更复杂的多步骤任务,同时维持对话进行。

发布公告提到近实时视觉输入、可在 97 种语言间自动切换,以及模型在回应用户的同时持续执行后台工具或 API 调用。对于 Extended Thinking,Google 的描述是它能一边推理一边说话,并在较长任务中提供进度提示。这些能力会影响定价判断,因为后台任务、工具调用和更深层的推理都可能改变 token 消耗量。

API 采购方目前能通过哪些渠道接入?

Google 的推出并非一次性向所有人完全开放。根据官方公告,开发者实际可使用的渠道如下:

渠道Gemini 3.8 LiveGemini 3.8 Live Extended Thinking
Gemini API自 2026 年 9 月 15 日起开始逐步推出自 2026 年 9 月 15 日起开始逐步推出
Google AI Studio自 2026 年 9 月 15 日起开始逐步推出自 2026 年 9 月 15 日起开始逐步推出
Gemini Enterprise私密预览私密预览

这张表反映的是 Google 的推出说明,不代表每个账号都会立刻看到相同的模型 ID。实际接入时,仍应以 API 模型列表和项目权限为准。

没有 3.8 价目表时,Gemini Live API 如何计费?

Google 的Live API 最佳实践文档说明,Live API 按 token 计费,而不是按会话收取固定费用。音频会被转换为音频 token 用量;文字消息和生成的转录内容还可能带来额外的文本 token 消耗。随着活跃对话上下文不断累积,长时间会话的成本也可能继续上升。

做预算时,需要特别注意以下几点:

  1. 不要把连接时长当成官方计费单位。所谓按分钟价格,只是基于 token 化方式和说话时长推导出的估算值。
  2. 输入音频与输出音频要分开计算。模型可能听了十分钟,只说了四分钟;这是两条不同的用量流。
  3. 把上下文增长纳入成本。Google 提醒,累积的原生音频上下文可能会在后续轮次计入费用,具体取决于上下文处理方式。
  4. 启用转录后需单独核算。除音频用量外,转录内容还可能产生文本 token 费用。
  5. 跟踪工具调用和推理 token。后台任务可能比简单的一问一答机器人消耗更多输出 token 或上下文 token。

因此,“每分钟半美分”不能替代官方的 3.8 定价。它可能只是在某种 token 化假设下,对单向音频用量的描述。

现在可以怎样做预算

在 Google 公布 Gemini 3.8 Live 费率之前,可以用已有明确价格的 Live 模型作为规划基线,但不能把它当成新模型的实际报价。Gemini 官方定价文档目前列出了以下参考费率:

模型音频输入音频输出文本输入文本输出
Gemini 3.1 Flash Live Preview每 100 万音频 token $3.00(约 $0.005/分钟)每 100 万音频 token $12.00(约 $0.018/分钟)每 100 万 $0.75每 100 万 $4.50
Gemini 2.5 Flash Native Audio每 100 万音频 token $3.00每 100 万音频 token $12.00每 100 万 $0.50每 100 万 $2.00
Gemini 3.5 Live Translate每 100 万音频输入 token $3.50每 100 万音频输出 token $21.00未列出未列出

举例来说,按已公布的 Gemini 3.1 Flash Live 估算值,假设一次会话包含十分钟输入音频和四分钟模型语音输出:

  • 输入:10 × $0.005 = $0.05
  • 输出:4 × $0.018 = $0.072
  • 音频小计:$0.122

这只是参考计算,并非 Gemini 3.8 Live 的报价。其中未包含累积上下文、转录、工具调用以及任何新的 3.8 定价。按分钟换算本身也是估算,因此最终做预算时,应以你自己的账单响应中的 token 用量为准。

标准版 Gemini 3.8 Flash 不是 Live API 模型

Google 的标准版 gemini-3.8-flash 是支持多模态输入、以文本输出为主的模型。根据官方定价页面,其优惠价格截至 2026 年 12 月 31 日为:每 100 万输入 token $0.75每 100 万输出 token $3.75;从 2027 年 1 月 1 日起,计划价格为 $1.50/$7.50

这些价格适用于标准 Flash 模型,并不会自动适用于 gemini-3.8-livegemini-3.8-live-extended-thinking。模型文档也将标准 Flash 与 Live 能力分开描述。两者虽共享版本号,但 Live 还需要流式音频输出、轮次检测、打断处理和实时会话能力。

稳妥的实现方式是记录服务商实际返回的完整模型 ID。仅凭控制台里显示的“Gemini 3.8”,不足以进行准确的成本归因。

现在适合基于 Gemini 3.8 Live 开发吗?

如果你最想验证的是交互设计,现在就可以做原型:用户能否接受后台处理、语音进度反馈、视觉理解以及工作流中的打断?Google 已公布这些行为能力,而 API 和 AI Studio 的逐步推出也让开发者能够测试集成效果。

如果商业模式依赖固定的每分钟利润率,则应暂缓做生产环境的成本承诺。3.8 价目表缺失、上下文重复计费的影响未知,加上尚无独立测得的延迟和失败率数据,变量仍然太多,无法可靠预测单位经济模型。

在切换流量前,建议先建立一套成本测试框架:

  1. 记录精确的模型 ID 和 API 响应。
  2. 采集输入音频分钟数、输出音频分钟数、文本 token、可获取时的 thoughts token、转录和工具调用数据。
  3. 在相同任务集下分别运行短、中、长会话。
  4. 比较每个成功完成任务的成本,而不是每个连接分钟的成本。
  5. 在 Google 公布 3.8 价目表前,保留一个已有公开定价的 Live 模型作为备用方案。

Gemini 3.8 Live API 常见问题

Gemini 3.8 Live API 的官方价格是多少?

Google 的发布公告没有给出美元价格,本文查阅的定价文档也没有提供单独的 3.8 Live 价目表。

Gemini 3.8 Live 在 Google AI Studio 中免费吗?

Google 表示已开始在 AI Studio 中逐步推出,但访问权限、配额和免费层条款,与保证的生产 API 价格是不同问题。请查看账号级别的模型可用性和账单页面。

Gemini 3.8 Flash 和 Gemini 3.8 Live 是同一个模型吗?

不是。gemini-3.8-flash 是独立的标准模型。其 $0.75/$3.75 的优惠 token 价格,不应被当作 Live 音频会话的价格。

Gemini Live API 按分钟收费吗?

分钟并不是其基础计费规则。Google 文档说明其按 token 计费;按分钟计算的数字只是根据音频 token 费率和假设说话时长得出的估算。

长时间的 Live 对话会越聊越贵吗?

会。活跃对话上下文、音频 token、转录和工具活动都可能影响后续轮次的用量。与其把一次短调用的估算直接相乘,不如测量有代表性的完整会话。

Gemini 3.8 Live 与 Extended Thinking 有什么区别?

Google 将 Gemini 3.8 Live 定位为流畅、可扩展的对话和视觉理解方案。Extended Thinking 则面向更深入的多步骤推理,同时继续说话并报告进度。

Gemini 3.8 Live 在哪里可用?

Google 宣布将通过 Gemini API 和 AI Studio 逐步推出,企业访问最初则被描述为私密预览。不同账号和地区的可用性可能不同。

因此,目前唯一站得住脚的预算做法,是依据现有 Live token 费率和实测会话行为建立成本区间,而不是猜测 Gemini 3.8 Live 的每分钟价格。等 Google 添加该模型的官方费率条目后,再重新核算。