Google发布Gemini 3.5 Pro:200万token上下文窗口,Deep Think推理模式首次亮相
推迟了一个月、推翻重练了一次底座之后,Google终于把Gemini 3.5 Pro端上了桌。
三个关键信息
Gemini 3.5 Pro于7月17日正式上线,核心卖点是200万token的上下文窗口。 这是目前主流前沿模型中最大的生产级上下文长度——用户可以一次性输入整本书、完整代码库或数百页研究论文。Google此前曾定于6月发布,但工程团队在内部测试中发现递归工具调用和SVG生成存在结构性故障,直接推翻原有底座从头预训练,最终推迟到今天。
Deep Think推理模式是另一个重磅功能。 这是Google版的「慢思考」——模型在回答前花更多推理步骤,换取复杂问题上的准确率提升,代价是更高的延迟和token消耗。该功能目前仅面向每月250美元的Ultra订阅用户开放。API定价方面,据企业预览报告,输入约12-15美元/百万token,输出约36-45美元/百万token,超过20万token的长上下文还有额外加价。
发布时机卡在激烈的模型军备竞赛中。 GPT-5.6 Sol和Grok 4.5在7月9日同日公开发布,Claude Opus 4也在近期上线。Gemini 3.5 Pro的推迟让Google一度落后,但200万token的上下文长度和Deep Think的组合拳,让它在长文档处理和复杂推理这两个垂直场景上抢回了差异化定位。
王斗视角
Google做了一件很实诚的事:底座不行就推翻重来,推迟一个月也不凑合发。这在「先发个半成品再迭代」成为行业标准操作的今天,反而显得另类。但200万token上下文这个数字,听起来震撼,用起来要打个折——企业级API的长上下文加价意味着真跑满200万token,一次调用的成本可能比请一个实习生搜一天资料还贵。Deep Think模式也是同一个逻辑:更准但更慢更贵,本质上是把「算力换智力」的交易明码标价了。Google的真正挑战不是把上下文窗口撑到多大,而是让用户觉得这个窗口里多塞的每一个token都值那个价。
来源:ZoomBangla · TechTimes · Startup Fortune
