Google DeepMind 发布三款全新 Gemini Flash 模型,主打更廉价、更快速的 AI 智能体
Google DeepMind 推出了三款全新的 Gemini Flash 模型,它们均针对更廉价、更快速的 AI 智能体进行了优化。与此同时,开发者自二月份以来一直期待的旗舰级 Gemini 3.5 Pro 模型仍处于合作伙伴测试阶段。
新 Gemini Flash 模型有哪些?
谷歌发布了三款新模型,每款各有专攻。这三款新模型均属于“Flash”系列,意味着它们相较于最大、最强大的 AI 模型更为轻量且高效。
Gemini 3.6 Flash 是 Gemini 3.5 Flash 的继任者,是面向通用场景的主要“工作主力”模型。谷歌表示,其输出 token 数最高可减少 17%,效率更高,同时在编码和推理能力上也有所提升。定价为每百万输入 token 1.50 美元,每百万输出 token 7.50 美元。谷歌称,包括 Hebbia 和 Harvey 在内的客户认为 3.6 Flash 在文档解析、图表分析和报告起草方面表现出色。
Gemini 3.5 Flash-Lite 是一款用于高并发任务的模型,在速度和成本比极致性能更重要的场景下使用。它是最便宜的模型,每百万输入 token 0.30 美元,每百万输出 token 2.50 美元,每秒可输出 350 个 token。3.6 Flash 和 Flash-Lite 现已可在谷歌的开发者工具和应用程序中使用。
Gemini 3.5 Flash Cyber 是一款专注于网络安全的专业模型,用于发现和修复软件漏洞。它使用了 CodeMender 工具,谷歌在 2025 年曾展示过这一工具。CodeMender 多次调用 Flash Cyber 模型扫描大量代码,然后将结果汇总成一份报告。在对 V8 JavaScript 引擎的测试中,Flash Cyber 发现了 55 个已确认的漏洞。相比之下,Gemini 3.5 Flash 发现了 47 个,Anthropic 的 Claude Opus 4.6 则发现了 36 个。
Gemini 3.5 Flash Cyber 不会立即向公众开放。出于安全考虑,目前仅通过有限试点计划向政府和受信任的合作伙伴提供。谷歌希望“让前线防御者领先一步”,在漏洞被用于攻击之前修复它们,同时也在努力防止该技术的“更广泛滥用”。该模型直接对标 Anthropic 更昂贵的网络安全模型 Mythos。
为什么谷歌的 Gemini 3.5 Pro 模型仍在延迟?
谷歌早在五月就承诺 3.5 Pro 会在六月发布,但如今已至七月,产品仍未推出。有报道称该模型未能达到内部性能目标,尤其是在编码方面;另一些报道则称延迟是由于技术问题,产品不得不从头重建。与此同时,OpenAI 已推出了 GPT-5.5 以及 GPT-5.6 的部分功能。Anthropic 也发布了 Claude Opus 4.8、Claude Sonnet 5 和 Claude Fable 5。谷歌表示,Gemini 3.5 Pro 目前正在与合作伙伴进行测试,并将“很快”面世,但无人知晓具体时间。该公司还启动了其“迄今为止最雄心勃勃的预训练运行”,用于下一代模型 Gemini 4,但这仍然遥遥无期。
此前有报道指出,Grok 4.5 的定价策略与 Claude 形成对比,说明按任务计费的逻辑正在改变工程团队选择工具的方式。同样,在这一背景下,各公司不再专注于让 AI 模型变得更智能,而是打造更廉价、更符合自身需求的模型。

资金费率
资金费率热力图
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
账号安全
资讯收藏
自选币种