谷歌允许Gemini分析Chrome浏览器中屏幕的部分区域
谷歌正朝着将旗下操作系统 Chrome 打造成人工智能助手的目标迈出又一步,其推出的全新 Gemini 功能可以准确分析用户在屏幕上正在观看的内容。

要点总结:
谷歌新推出的“从屏幕中选择”功能允许用户在 Chrome 浏览器中突出显示内容并将其直接发送到 Gemini,从而为人工智能提供更多上下文信息以回答问题。
Chrome 正在成为谷歌以人工智能为先的浏览器,Gemini 进一步加深了对屏幕内容的访问——这一举措令开发者兴奋不已,但也令安全专家担忧。
尽管Gemini已在国际上广泛推出,但Chrome浏览器在英国仍然无法使用,这很引人注目,因为英国是Chrome浏览器的主要市场,通常会被纳入早期发布计划。
nexos.ai 的主要结论,经 Cybernews 工作人员审核。
新的“从屏幕中选择”工具出现在 Chrome 浏览器“+”菜单中的 Gemini 内,其工作方式类似于内置的屏幕截图工具,允许用户突出显示文本、图像或网页的某些部分,并将其直接发送到 Gemini。
用户无需描述页面上的内容,只需指向他们需要帮助的内容即可,这样人工智能就能获得更多上下文信息来回答问题。
用户必须先授予权限,Gemini 才能访问信息;用户同意和数据政策可能会发生变化。今年 5 月,Cybernews报道称,谷歌删除了与 Chrome 设备端 AI 模型如何处理数据相关的措辞。
Chrome 作为人工智能代理
这项新功能标志着谷歌更大的雄心壮志,即让 Chrome 浏览器(而非 Android 系统)成为人工智能的主要界面。
Gemini 正在与浏览器本身深度集成,能够理解网页内容并实时自动执行任务。
它是所谓“人工智能浏览器”浪潮的一部分,在这些浏览器中,像 Edge 中的 Copilot 或 Chrome 中的 Gemini 这样的助手可以直接在浏览环境中运行。
Chrome 漏洞允许扩展程序劫持新的 Gemini 面板
虽然这些功能旨在支持高级功能,但专家警告说,如果被劫持,它们可能会变成一套监视工具。图片来源:Cybernews
Chrome 中的 Gemini 已经可以访问当前网页,在获得权限的情况下浏览多个标签页,使用位置和麦克风访问权限,并了解浏览上下文以帮助完成任务。
通过 Gemini 于 6 月 24 日发布的全新 3.5 Flash 模型,开发者还可以利用 Gemini 的计算机使用能力,构建能够与浏览器、桌面应用程序和移动应用程序交互的 AI 代理,使 AI 能够理解屏幕上的内容并代表用户执行操作。
虽然这些功能旨在为高级功能提供支持,但安全专家警告说,如果被劫持,它们可能会变成一套监视工具包。
英国仍无法使用 Chrome 浏览器访问 Gemini 浏览器。
奇怪的是,Chrome 浏览器的 Gemini 功能于 2025 年 5 月在 Google I/O 大会上首次亮相,但在英国仍然无法使用——尽管英国是 Google 在欧洲最大的市场之一,也是欧洲 Chrome 和 Android 使用率最高的国家。
英国浏览器市场份额为 50%(2025 年 5 月至 2026 年 5 月),Safari 占 29%,Edge 占 11%。
谷歌英国人工智能概述
Gemini Chrome去年发布,但英国却迟迟没有参与其中,令人瞩目。图片来源:Cybernews。
考虑到英国通常是首批推出产品的市场之一,与美国、加拿大、澳大利亚、法国、德国、意大利和西班牙一起,英国的缺席就显得更加引人注目——所有这些国家/地区都已在 Chrome 浏览器中安装了 Gemini。
最近宣布的其他地区包括印度、日本和香港,以及拉丁美洲、非洲和中东的许多国家。
Cybernews 已联系谷歌询问为何 Chrome 浏览器中的 Gemini 功能在英国仍然不可用,如有回复,我们将更新此报道。
