Gemini 成为 Google 历史上增长最快的产品。63% 用户会用语音交流,五分之一 Gemini Live 互动涉及摄像头或屏幕共享。

Google 宣布 Gemini App 月活用户超过 10 亿,并称其为公司历史上增长最快的产品。比规模数字更值得关注的是使用方式:语音、附件、摄像头和屏幕共享正在把 AI 从打字问答变成随时可用的多模态助手。
Google 公布了哪些数据
在 2026 年 8 月 11 日的 官方公告中,Google 表示 63% 的用户会直接与 Gemini 语音交流;五分之一 Gemini Live 互动不止使用语音,还会打开实时摄像头或屏幕共享。

学生请求中有 38% 带附件,说明 PDF、作业和图片已成为常见输入。Gemini 每天生成超过 1.5 亿张图片,Android 端还能跨 40 多款常用应用执行操作。iOS 活跃用户超过 1 亿,macOS 高活跃用户的提示频率约为其他入口的两倍。
AI 入口为什么正在变化
文字聊天要求用户先把问题描述清楚,而摄像头和屏幕共享允许模型直接观察现场。修理物品、理解界面、检查作业或介绍一件产品时,用户不必把所有细节重新打字。
语音则降低了使用摩擦。开车、做饭或处理家务时,用户更自然地通过连续对话表达需求。对产品设计者而言,这意味着输入不再是一个文本框,而是声音、画面、文件和应用上下文的组合。
规模数据也要谨慎解读
月活不能等同于付费用户,也不能直接证明每个人都在深度使用。Google 公布的数据来自自家产品统计,外部研究仍需要验证不同地区、年龄与设备的使用差异。
此外,入口越自然,隐私风险越容易被忽略。实时摄像头可能拍到旁人、家庭环境和敏感文件,屏幕共享可能暴露消息与账号。用户应只在必要时开启,并检查历史、连接应用和个性化设置。
对内容与工具开发者的影响
内容不应只为关键词搜索准备,还要让模型能从图片、视频和文档中提取结构。清晰标题、可识别图表、准确字幕和可复制数据,会影响 AI 是否能理解和引用。
Gemini App 的产品演进还显示,Google 正把这些入口与持续运行的智能体结合。应用开发者需要更早考虑用户如何授权相机、文件和第三方服务。
YouCanStudy.AI 的判断
10 亿月活说明生成式 AI 已经进入大众产品阶段,但下一轮差异不会只来自回答聪明程度。谁能更自然地理解现实上下文,同时让用户看得见、管得住数据权限,谁才更可能成为真正的日常助手。