
谷歌 Gemini 应用月活用户已突破 10 亿,其中 63% 的用户使用语音交互,标志着多模态交互成为 AI 助手主流使用方式。尽管任务自动化功能扩展到 40 多个应用,但目前仍受限于特定设备、地区(仅美韩)和语言,其全面普及尚需时日。
谷歌(Google)近期披露,其旗下人工智能助手 Gemini 的月活跃用户数已突破 10 亿大关。这一里程碑式的数据,连同语音交互占比高达 63% 的细节,迅速成为科技圈热议的焦点。作为长期关注搜索引擎与 AI 趋势的媒体,Search Engine Journal 对这份数据的解读,不仅仅是庆祝一个数字的达成,更在于剖析其背后用户行为模式的深刻变迁以及当前产品能力的边界。
从增长轨迹来看,Gemini 的扩张速度令人瞩目。根据谷歌及其母公司 Alphabet 在不同季度财报电话会议中披露的数据,可以清晰勾勒出这条陡峭的上升曲线。2025 年 5 月,谷歌首次确认 Gemini 月活用户超过 4 亿;此后,这一数字在 2025 年 10 月攀升至 6.5 亿,并在 2026 年 2 月突破 7.5 亿大关。进入 2026 年,增长势头不减,5 月达到 9 亿,7 月增至 9.5 亿,直至 8 月正式跨过 10 亿门槛。
值得注意的是,谷歌在表述口径上略有调整。在 2026 年 7 月之前,官方使用的是“月活跃用户”(Monthly Active Users, MAU)这一标准术语,而在此次最新公告中则简称为“月用户”(Monthly Users)。尽管措辞有变,但业界普遍认为其统计口径基本一致,即指在统计周期内至少使用过一次 Gemini 应用的独立用户数。这一数字特指 Gemini 独立应用,并不包含集成在谷歌搜索中的 AI Overviews 或 AI Mode 功能带来的间接用户。
如果说 10 亿用户是量的积累,那么交互方式的改变则是质的飞跃。谷歌官方博客公布的数据显示,高达 63% 的 Gemini 用户正在使用语音进行直接对话,且这一比例仍在持续增长。更值得关注的是,在 Gemini Live(实时对话功能)场景中,约有五分之一的交互并非单纯依赖语音,而是结合了实时摄像头画面或屏幕共享功能。这意味着用户不再将 Gemini 视为一个简单的文本问答工具,而是将其当作一个能“看”、能“听”的多模态助手。
这种趋势与谷歌此前发布的 AI Mode 报告不谋而合。该报告指出,在美国地区,超过六分之一的 AI Mode 搜索请求包含了语音、图像或视频等多种模态的组合,而非单纯的文字输入。多模态交互的普及,对搜索引擎优化(SEO)从业者而言是一个重要信号。用户提问方式正从关键词组合转向更自然的对话式语音,这要求内容创作者在优化关键词时,必须更加注重长尾语音查询词和自然语句的匹配。
除了交互方式的进化,谷歌还着重强调了 Gemini 在任务自动化方面的能力,宣称其可以横跨超过 40 款热门应用执行操作,例如预订网约车或餐厅座位。然而,这一宏伟蓝图在落地时面临着明确的限制。在 7 月 22 日 Galaxy Unpacked 发布会上,谷歌已经为这项能力划定了范围。其官方帮助页面显示,这项名为“屏幕自动化”(Screen Automation)的功能目前仍处于测试阶段,仅限美国与韩国地区的 Pixel 10 和三星 Galaxy S26、Z Flip 8 及 Z Fold 8 设备用户使用。
此外,该功能要求用户必须年满 18 周岁,且使用个人账户。在语言支持方面,目前仅支持英语和韩语。尽管谷歌表示屏幕自动化功能正在逐步推广,但不同设备支持的任务类型也有所差异。例如,叫车、点餐和杂货购买在所有支持设备上均可使用,但商品买卖、旅行预订和票务购买等功能,则仅限于 Z Flip 8 和 Z Fold 8 系列。对于国内用户而言,这种基于设备和地区的严格限制,与国内 AI 厂商如百度文心一言、阿里通义千问等积极推动的“智能体”生态形成了鲜明对比。国内产品在接入本地生活服务、电商平台等方面往往更具本土化优势,但在跨应用自动化操作的深度和广度上,仍处于探索阶段。
对于数字营销人员和 SEO 专家而言,Gemini 用户规模的扩大和交互模式的改变,带来了切实的机遇与挑战。此前,SEO 工具平台 SE Ranking 已识别出 Gemini 作为推荐流量来源,其重要性甚至超越了 Perplexity。这意味着,在网站分析报告中,将 Gemini 作为独立的流量来源进行追踪和分析,将有助于更精准地评估 AI 搜索带来的转化效果。
谷歌将语音、摄像头和文件上传列为三大核心用途,但并未公布相关的跳出率或点击率数据。然而,从 63% 的语音使用率可以推断,针对自然语言提问和语音搜索优化的内容将获得更多曝光机会。内容策略需要从单纯的关键词布局,转向构建能够清晰、结构化地回答复杂问题的信息实体,以便于 AI 引擎的理解和引用。
展望未来,谷歌表示正在逐步推出超过 60 种地区方言以扩展语音输入的支持范围,这无疑将进一步降低全球用户的使用门槛。然而,任务自动化功能若想发挥更大潜力,突破当前仅限两国、少数机型的限制是必然趋势。一旦这些限制被放宽,更多的用户将能够体验到 Gemini 跨应用操作的便捷性,届时,AI 助手将真正从一个“信息提供者”转变为“任务执行者”,而这也将彻底改变用户与数字世界交互的方式。
谷歌在公告中并未详细说明统计方法,通常指在统计周期内(一般为一个月)至少使用过一次 Gemini 独立应用的用户数。该数据不包含通过谷歌搜索 AI Overviews 或 AI Mode 间接使用的用户。
这意味着超过半数的 Gemini 用户倾向于使用语音而非打字进行交互,标志着多模态交互已成为主流。这对 SEO 策略有直接影响,提示内容需要针对自然语言和语音查询进行优化。
目前该功能处于测试阶段,仅限美国与韩国的部分 Pixel 和三星 Galaxy 设备(如 Pixel 10、Galaxy S26 系列)使用,且要求用户年满 18 周岁。支持的语言仅为英语和韩语。
国内 AI 产品如文心一言、通义千问等,在接入本土生活服务、电商生态方面更具优势,但跨应用深度操作能力尚在探索。Gemini 的自动化能力目前受限于地区和机型,但跨平台通用性是其潜在优势。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。
编辑团队:内容策划 · 技术编辑 · AI 研究组
网站:bingdada.com
© 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

Google 在 Search、Discover 和 Google News 中推出新的个性化功能,包括交互式“首选来源”按钮和自然语言控制,旨在让用户更主动地塑造信息流。

Google DeepMind与英国政府合作,利用Gemini模型开发AI规划审批工具,目标是将家庭住宅申请处理时间缩短50%。本文分析技术方案、人机协同设计理念,并探讨国内数字政务的类似探索。

谷歌与五大欧洲足球俱乐部达成合作,通过 Gemini AI 提供深度赛事洞察,利用 Pixel 手机拍摄独家幕后内容,并承诺推动女足曝光度提升。本文分析这一合作如何重塑球迷观赛体验,并对比国内 AI 观赛赛道的发展路径。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。