← 返回 Blog

从打字到说话无缝切换:Gemini 3.6 Flash + Neural Expressive 如何让安卓变成"主动式助理"

7月21日,谷歌正式发布Gemini 3.6 Flash。官方博客的措辞十分克制:"效率更高、质量更佳"。文中没有惊天动地的技术革命,也没有"重新定义智能"的宏大表述。在同行竞相用"最强""首个""颠覆性创新"博取关注的当下,这份克制显得格外反常。

GeminiGemini 3.6 Flash

不卷智力、只拼效率的AI,正在重塑安卓

7月21日,谷歌正式发布Gemini 3.6 Flash。官方博客的措辞十分克制:"效率更高、质量更佳"。文中没有惊天动地的技术革命,也没有"重新定义智能"的宏大表述。在同行竞相用"最强""首个""颠覆性创新"博取关注的当下,这份克制显得格外反常。

反常背后自有其原因。

第三方评测机构Artificial Analysis的智能化指数榜单显示,Gemini 3.6 Flash得分50分,与此前发布的Gemini 3.5 Flash完全持平。智能化水平未见提升,但输出令牌消耗量减少17%,输出价格由3.5 Flash的每百万令牌9美元降至7.5美元;在DeepSWE这类长周期工程任务场景中,令牌消耗降幅甚至达到65%。

花更少的成本,完成同等的任务。这就是谷歌为3.6 Flash定下的优化方向。

耐人寻味的是,谷歌并不打算掩饰这一点。官方博客开篇即写明:"面向生产级AI智能体的开发者与客户,需要更高的令牌利用效率、更低的延迟、更稳定可靠的性能。"定位极其清晰:这不是供用户跑分比拼的模型,而是帮助开发者节约成本、节省时间的工具。

真正让安卓用户切身感受到手机发生质变的,是同期接连落地的应用方案。

3.6 Flash:不再执着于智商比拼,重点在于"少走弯路"

Flash系列的亮点不在于"变得更聪明",而是"执行步骤更少"。

官方测试数据:完成一套多步骤工作流,所需的推理步数、工具调用次数显著减少。DeepSWE评测得分由37%提升至49%;MLE基准(MLE Bench)从49.7%提升至63.9%;OSWorld Verified电脑操作能力由78.4%上涨到83.0%。

这些数字落到日常体验上就是:用户下达一项任务,AI可以少绕许多弯路。

谷歌产品管理高级总监图尔西·多希表示,整个Flash产品线的目标是"平衡推理性能与运行效率"。并非所有场景都需要顶尖推理能力,绝大多数日常任务,只需要足够快、足够高效、足够稳定。3.6 Flash瞄准的正是这个最佳平衡点。

主动式助手:从"一问一答"进化为主动关照

在3.6 Flash为开发者提供效率引擎的同时,谷歌在5月开发者大会上公布的神经表达(Neural Expressive)设计语言,则为用户端交互掀开了新的一页。

视觉层面,这套设计带来流畅动效、鲜活色彩与全新排版布局。但真正重塑交互方式的,是两大核心改动。

其一,Gemini Live直接纳入Gemini核心体验。过去语音、文字是两条相互独立的入口,如今融合在同一界面。用户可以在打字与自然语音对话之间无缝切换,上下文不会中断。不必专门点开"语音模式"才可以说话;想打字就打字,想开口就开口,AI能够同步适配交互方式。

其二,回复不再是密密麻麻的大段文本。Gemini会根据提问内容,实时选择最合适的展示形式:图片、交互式时间线、带语音旁白的视频、动态图表;核心信息优先置顶、加粗突出。

两项变革指向同一个目标:大幅降低交互摩擦。用户不必提前纠结这次该打字还是说话,也不用在长篇文字里自行搜寻重点,AI已经提前替用户完成判断。

在此基础之上,作为云端全天候运行的AI智能体,Gemini Spark能够自主运转。通过设置规则与目标,Spark能够自动完成跨应用任务:整理邮件、更新日程、监控航班延误信息等。

实测场景:Gemini清晨主动推送提醒:"你今天上午10点有产品评审会议。结合上周邮件讨论内容,大概率需要准备一季度转化率数据,需要我帮你整理吗?"它不再被动等待用户的提问,在用户萌生需求之前,就预判接下来该处理什么。

谷歌对Spark的官方定位:推动Gemini从"答疑AI助手",转变为真正为用户办事的主动型助手。前者需要用户下达指令驱动,后者主动照料用户的事务。

而在系统层面,安卓光环(Android Halo)保障了这类主动行为的透明度。AI智能体在后台运行时,屏幕顶部会实时展示活动状态。用户能够清晰知晓它正在执行什么操作,不会产生"AI在偷偷运行"的不安感。

三大拼图组合诞生全新形态

3.6 Flash、神经表达、Gemini Spark,在同时间段相继落地。单独来看每一项都不算惊世创新:一款主打效率优化的模型、一次界面改版、一套后台智能体。但三者组合在一起,传递出清晰方向:

安卓正在从"由用户来操控的设备",转变为"主动照料用户的设备"。

用户无需打开App才能使用AI,AI早已在后台待命;不用纠结选择打字还是语音,随时自由切换,上下文持续保留;不必记住所有待办事项,Spark帮用户记录,到点主动提醒。

这不是"变得更聪明的AI",而是让用户少费心的日常伙伴。Flash的智能化指数没有上涨,但这次升级真正的价值,在于减少安卓用户每天的操作时长、点击步骤与脑力消耗。

当效率成为AI竞争主轴,企业如何接住这波红利

3.6 Flash的发布揭示了一个朴素而深刻的产业转向:当Agent从Demo走向生产环境,账单比跑分更重要。令牌单价的下调、效率的提升,直接决定了智能体能否在真实业务中跑通成本模型。

然而现实落地中,企业往往面临三重门槛:

  • 模型碎片化:GPT、Claude、Gemini、DeepSeek各有擅长,分别对接意味着重复开发、运维成本高企;

  • 跨境调用难:以Gemini为例,面对地区策略收紧、官方价格走高的局面,自建通道的技术门槛与合规成本陡增;

  • 高强度消耗下的成本压力:Agent化场景意味着高频次、长上下文、多轮调用,按官方原价计费,账单将呈指数级膨胀。

这正是UseAIAPI所致力于解决的问题。作为全球大模型统一接入平台,UseAIAPI为企业与开发者提供以下核心权益:

  • 全生态模型一站式接入:单一接口无缝调用GPT、Claude、Gemini、DeepSeek等120余个顶级模型,覆盖对话、推理、多模态、嵌入等全场景,官方能力实时同步,业务始终站在技术前沿。

  • 企业级高可用保障:具备全球边缘节点加速能力,依托智能语义缓存降本,提供99.9%极致可用性保障,45ms骨干网络超低延迟,满足金融级可靠要求。

  • 成本优势显著,缓解高强度消耗压力:平台专属优惠折扣最低可达官方定价的50%。依托全球算力集采优势压降成本,并提供可视化财务看板,支持按项目、模型溯源消耗,支持对公结算。对于高并发调用、高强度内容生成、长上下文Agent开发等重度使用场景,这一权益能够有效缓解成本压力——以Gemini为例,面对2026年地区锁变严、官方价格走高的局面,UseAIAPI的高频调用综合成本可压至官方定价的五成左右,让预算管控精准高效。

  • 定制化服务体系:UseAIAPI定位为SVIP企业级API服务平台,"不仅是一个接口,更是能融入核心系统、通过财务审计、适配集团架构的AI基础设施"。从技术对接到合规部署、从运维保障到场景落地,全程护航。

从3.6 Flash在后端"少走弯路"省下的每一个令牌,到UseAIAPI在企业服务端提供的稳定、低成本、全模型覆盖的接入底座,AI产业正在从"拼智商"切实转向"拼性价比"。而当前沿智能真正成为可调用、可负担、可落地的基础设施,这场效率革命的红利,才能惠及每一位开发者和每一家企业。

UseAIAPI,让澎湃智能触手可及。