讲师中心 微信公众号
AI工具推荐 视频效率加速

Gemini 3.6 Flash来了,但网友笑得更大声:省下了token,却没保住智商

风晨吖_2847

风晨吖_2847

发布时间:2026-07-22 13:14:06

|

941人浏览过

|

来源于php中文网

原创

如果你从去年就开始使用gemini,最近最火的一句戏谑是:那种体验,仿佛眼睁睁看着自家兄弟逐渐患上阿尔茨海默症。按常理,一家科技公司发布新一代模型,本该是有力回击这类调侃的绝佳机会。可就在刚刚,google一口气推出三款新模型——结果非但没能平息质疑,反而让网友笑得更放肆了,活脱脱一副“所有人都不看好你,偏偏你最不争气”的既视感。这三款新作分别是3.6flash、3.5flash-lite,以及聚焦网络安全领域的3.5flash cyber。官方博客措辞依旧熟悉得令人恍惚:“更高效、更聪明、专为大规模ai agent而生”——一字未改,但真实使用体验却呈现出冰火两重天的割裂感。

先来看当家主力3.6Flash。它是今年5月I/O大会上亮相的3.5Flash的小幅升级版,官方将其定位为真正能扛事、跑得稳、干得久的实干型模型。这一代最核心的卖点在于“省token”:据Artificial Analysis Index数据显示,3.6Flash相较3.5Flash输出token减少17%,在DeepSWE等复杂场景下甚至能节省高达65%;多步任务中推理轮次与工具调用次数也显著下降。价格方面同样下调:输入端为1.5美元/百万token,输出端从上一代的9美元降至7.5美元/百万token,成本压缩明显,单个agent任务开销进一步降低。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Gemini 3.6 Flash来了,但网友笑得更大声:省下了token,却没保住智商

基准测试中,代码能力成为主攻方向。DeepSWE得分由37%跃升至49%,官方强调其生成代码冗余更少、执行循环更短、整体风格更贴近生产环境标准;机器学习研究类任务MLE Bench提升尤为亮眼,从49.7%飙升至63.9%;操作系统交互类OSWorld-Verified则从78.4%升至83%,且计算机操作能力已作为Gemini API与企业版的原生内置功能,主打即插即用;知识型工作GDPval-AA v2分数由1349涨至1421,Hebbia、Harvey等客户反馈其在文档解析、图表数据解读、报告撰写等多模态任务中表现突出,Figma与JetBrains亦公开为其背书。一个虽不起眼但意义实在的更新是:知识截止时间终于从2025年1月推进至2026年3月,“老黄历”总算翻篇。安全层面,3.6Flash搭载升级版Frontier Safety防护机制,重点防范化学、生物、放射性、核及网络攻击五大高危滥用方向,越狱抵抗能力增强,同时兼顾误拒率控制,避免对合理请求过度拦截。

Gemini 3.6 Flash来了,但网友笑得更大声:省下了token,却没保住智商

定位稍低一档的是3.5Flash-Lite,主打极致速度与极致性价比,专攻高吞吐、低延迟场景,如agent驱动的实时搜索与批量文档处理。它目前是3.5系列中响应最快的模型,Artificial Analysis实测可达每秒350 token输出,价格更是亲民——输入仅0.3美元、输出2.5美元/百万token,质量远超今年3月发布的3.1Flash-Lite。该模型支持动态推理档位调节:轻量任务启用最低档以求快与省;复杂子任务则可提升“思考档位”,实现多步拆解;计算机操作能力同样内置于工具链中。

性能提升颇为可观:代码与agent任务测试集Terminal-Bench2.1得分由31%跃至54%,长上下文理解GDM-MRCR v2从60.1%升至72.2%,真实业务场景GDPval-AA v2更是从642暴增至1140。更有意思的是,这款“小弟”在多项agent与编程任务中反超前辈3Flash——例如SWE-Bench Pro达54.2%(3Flash为49.6%)、OSWorld-Verified为74.0%(3Flash为65.1%),意味着原本需靠3Flash完成的任务,如今有了更快更强的平替方案。官方列举多个落地案例:从海量电商数据中自动提取产品特征、辅助3.6Flash一次性生成25套网页设计方案、批量翻译并摘要收据、边玩边迭代开发小游戏……Ashler、Palo Alto Networks、Ramp等客户也纷纷点赞其“速度、智能、成本”三位一体的优势。

Ask Gemini/ChatGPT
Ask Gemini/ChatGPT

用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。

下载

第三款3.5Flash Cyber画风突变,专精于代码安全漏洞的识别与修复。Google的思路颇具巧思:当前AI发现漏洞的速度已远超人类修复节奏,导致漏洞越积越多;与其被动追赶,不如用低成本、高效率的Flash模型批量“补锅”。该模型基于3.5Flash微调而来,配合自研CodeMender工具,内部可调度多个Flash Cyber agent协同作业,最终整合生成结构化安全报告。在业内权威CyberGym基准测试中已跻身第一梯队,且token消耗优于更大尺寸模型。不过该模型暂未开放公众使用——考虑到漏洞挖掘本身具有双刃剑属性,Google效仿Anthropic采取严格安全叙事策略,仅面向可信合作伙伴限量内测,目标是为一线防御团队争取黄金修复窗口,在漏洞被恶意利用前完成闭环处置,同时严防技术滥用。

看到这里,你或许会疑惑:说好的旗舰级3.5Pro去哪儿了?官方口径仍是“正与合作伙伴联合测试,成熟后即刻上线”。但这句话背后的故事未必体面。据彭博社等媒体报道,3.5Pro在代码生成能力上长期未能达到内部预期,Google甚至在今年6月下旬紧急更新训练数据以强化代码短板,结果仍无明显起色;更有传闻称其已彻底推翻原有训练路径,启动全新预训练流程。而Google AI布道师Logan Kilpatrick更是在舆论场中直接绕过3.5Pro,将焦点转向Gemini 4,宣称“史上最宏大的Gemini 4预训练已全面启动,进展令人振奋”。放在旗舰跳票的大背景下,此举难免被解读为转移视线、画饼续命。

单看今日发布的Flash系列,外界评价也并非一边倒叫好。第三方评测机构Artificial Analysis指出:两款新模型确实在单任务耗时与token效率上实现减半式优化,Flash-Lite智能指数上涨11分,但3.6Flash的综合智能水平相较3.5Flash几乎停滞不前。价格未低到足以掩盖能力落差,能力也未高到足以支撑其成本溢价。X平台上有用户直言,3.6Flash在Artificial Analysis榜单上与3.5Flash同分,甚至不及Meta Spark1.1、GLM-5.2、5.6Luna、Sonnet5、Grok4.5、5.6Terra等竞品,直呼“简直烂透”。

网友Angel则从性价比切入,指出3.6Flash单位成本高于GPT-5.6Sol medium,而智能表现反而更低,“又贵又笨”的组合确实尴尬——毕竟Flash系列立身之本正是极致性价比,如今却被对手当场戳破短板,无异于自砸招牌。作为对照,OpenAI近日亦宣布:因周活跃用户突破1000万,Codex与ChatGPT Work付费用户的配额迎来新一轮重置。这般对比、这般落差,还有人记得那个曾被寄予厚望的Google Gemini 3吗?

实测派也迅速补刀。网友Balder直接开团,称三款新模型整体性能均逊于旧版3.5Flash,问题涵盖基础解码异常、中文选词离谱、生成图像与视频质量极差、指令响应错位、额度限制严苛、记忆混乱频繁、工具调用严重失准等。他还抛出一则“阴谋论”:Google此举或意在腾出算力资源转售给Anthropic,并阴阳一句“这就是皮查伊想要的Cloud First”。X用户Conor Dart则用Google自家Antigravity平台跑了一轮AI游戏生成测试,结果木纹质感更糟、大理石纹理勉强接近但依然不可用,直言“又一次翻车”,并表示“还是继续等Gemini 3.5或3.6Pro吧”。

一边是官方描绘的“更高效、更便宜、更省token”的理想账本,一边是多数用户现场打出的差评,再叠加旗舰跳票、核心人才流失、市值持续承压等一系列连锁反应。这很难不让人怀疑:Google此番是否真在技术路线上走了偏锋——只顾压缩成本,却忘了同步拉升智力水位,只能靠几款Flash模型暂时稳住阵脚。反正Gemini 4的预训练早已启程,倘若这一把再翻车,那句关于“阿尔茨海默症”的玩笑,恐怕就要从调侃变成预言了。

热门AI工具

更多
Loomy
Loomy Hot

一款AI工具,主要用于科大讯飞发布的桌面级 AI 助理,比 OpenClaw 更易用、更安全!,适合需要提升相关任务效率的用户。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

二狗PPT
二狗PPT Hot

一款AI演示文稿工具,主要用于专为中式职场打造的AI PPT生成工具,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

VibeKnow
VibeKnow Hot

一款AI视频创作工具,主要用于全球首个AI知识视频创作平台,文档、文章、网页,一键生成视频,适合需要提升相关任务效率的用户。

Laper
Laper Hot

Laper是专为编剧、导演和制片人推出的 AI 原生剧本创作工具。

UpDream
UpDream Hot

一款AI视频创作工具,主要用于哔哩哔哩推出的自研AI视频创作工具,适合需要提升相关任务效率的用户。

相关专题

更多
Gemini网页版零基础入门:5分钟上手Gemini聊天指南
Gemini网页版零基础入门:5分钟上手Gemini聊天指南

本专题专为零基础用户打造,5分钟快速掌握Gemini网页版核心用法。从账号登录到界面布局,详解如何发起对话、优化提示词及利用多模态功能。通过实战案例,教你高效获取信息、创作内容与分析数据。无论学习还是工作,轻松开启AI辅助新时代,让Gemini成为你的得力智能助手。

15237

2026.03.18

如何写出高效Gemini提示:Chain of Thought实用教程
如何写出高效Gemini提示:Chain of Thought实用教程

本专题详解如何利用“思维链”(Chain of Thought)技巧激发 Gemini 模型的深度推理能力。通过引导模型将复杂问题拆解为逐步推导的逻辑链条,显著提升其在数学计算、代码生成及逻辑分析任务中的准确率。文章提供实用提示模板与对比案例,助您掌握结构化提问方法,从简单指令升级为高效交互,轻松获取更精准、可解释的智能回答。

37

2026.03.23

Gemini多模态实战:图片PDF视频输入完整处理指南
Gemini多模态实战:图片PDF视频输入完整处理指南

本指南全面解析 Gemini 多模态实战,涵盖图片、PDF 及视频的高效处理流程。从上传技巧到提示词设计,教您如何提取文档关键信息、分析图表数据及解读视频内容。通过真实案例演示,助您掌握跨模态交互核心技能,轻松构建智能文档分析与多媒体理解应用,释放 AI 潜能。

77

2026.03.23

Gemini提示工程进阶:Few-shot与角色扮演优化方法
Gemini提示工程进阶:Few-shot与角色扮演优化方法

本进阶指南深入解析 Few-shot 学习与角色扮演在 Gemini 提示工程中的核心应用。通过精选示例引导模型模仿特定风格,结合角色设定规范输出语气与逻辑,显著提升复杂任务的处理精度。文章提供实用模板与调优策略,助您打造个性化 AI 助手,实现从通用回答到专业级交互的质的飞跃。

76

2026.03.23

Google AI Studio使用教程:从模板到自定义Prompt实战
Google AI Studio使用教程:从模板到自定义Prompt实战

本教程手把手教您掌握 Google AI Studio,从快速调用官方模板到深度自定义 Prompt 实战。内容涵盖界面导航、参数调优及版本管理,助您灵活构建专属 AI 应用。通过真实案例演示,让您轻松实现从创意构思到原型部署的全流程,高效释放 Gemini 模型潜能,打造智能化解决方案。

101

2026.03.23

Gemini API快速上手:Python调用generateContent完整指南
Gemini API快速上手:Python调用generateContent完整指南

本指南详解如何使用 Python 快速调用 Gemini API 的 generateContent 方法。从环境配置、密钥管理到核心代码实现,逐步演示文本生成、多模态输入及流式响应处理。包含完整示例与错误排查技巧,助开发者轻松集成 Gemini 强大能力,构建高效智能应用,开启 AI 开发新篇章。

90

2026.03.23

如何实现Gemini函数调用:Tool Use与外部工具集成教程
如何实现Gemini函数调用:Tool Use与外部工具集成教程

本教程深入解析 Gemini 函数调用机制,详解 Tool Use 配置与外部工具集成流程。从定义函数架构到处理动态参数,手把手教您连接数据库、搜索 API 及自定义服务。通过实战案例,展示如何让 AI 自主规划并执行复杂任务,突破纯文本限制,构建具备真实行动力的智能代理系统。

165

2026.03.23

Gemini结构化输出JSON模式:API稳定提取数据实战
Gemini结构化输出JSON模式:API稳定提取数据实战

本实战指南详解如何利用 Gemini API 的 JSON 模式实现结构化数据提取。通过配置响应格式约束,确保模型输出严格符合预定义 Schema,彻底解决解析错误难题。内容涵盖字段定义、类型校验及异常处理,助您在信息抽取、数据清洗等场景中构建高稳定性管道,轻松将非结构化文本转化为可靠的应用数据。

91

2026.03.23

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

0

2026.09.23

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Gemini Notebook常见问题解答
Gemini Notebook常见问题解答

共0课时 | 0人学习

Gemini Notebook官方手册
Gemini Notebook官方手册

共0课时 | 0人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn