头版Folia Daily Briefing
← 返回头版
人工智能

Gemini最新模型弃用采样参数

Google发布了Gemini 3.6 Flash和Gemini 3.5 Flash-Lite两款新模型,现已正式可用 。

Google发布了Gemini 3.6 Flash和Gemini 3.5 Flash-Lite两款新模型,现已正式可用 [1]。

API变更

这两款模型已弃用temperature、top_p和top_k采样参数 [1]。API将忽略这些参数,并在未来版本中对包含这些参数的请求返回HTTP 400错误 [1]。此外,模型不再支持预填充模型回合,以模型角色回合结尾的API请求将返回400错误 [1]。

性能与规格

Gemini 3.6 Flash的输出token成本已降至$7.50/1M,相较Gemini 3.5 Flash的$9.00/1M有所下降,输入token成本保持在$1.50/1M [1]。Gemini 3.5 Flash-Lite在HLE推理任务上得分为18.0%(相比前版本的11.0%),在CharXIV多模态基准测试中得分74.5%(相比前版本的63.7%) [1]。

两款模型均支持1M token上下文窗口和64k最大输出token [1]。此外,Gemini 3.6 Flash已成为Gemini Managed Agents中Antigravity agent的新默认模型 [1]。


GeminiGoogleAPI更新大模型参数弃用