Chrome 的“从屏幕选择”功能集成 Gemini AI 以增强视觉搜索功能
通过在 Chrome 中引入突破性的“从屏幕选择”功能,Google 继续模糊浏览和人工智能辅助之间的界限。这项新功能利用了 Google Gemini AI 的强大功能,允许用户就屏幕上可见的任何内容提出问题,彻底改变了用户与数字信息交互和理解数字信息的方式。
推出 Chrome 人工智能驱动的视觉搜索
“从屏幕选择”功能代表了 Google 将 AI 直接集成到 Chrome 浏览器中的重大进步。基于今年早些时候推出的“圈子搜索”功能的成功,这项新功能使用户能够选择屏幕上的任何文本、图像或元素,并立即向 Gemini AI 询问信息、解释或翻译。
人工智能辅助与浏览体验的无缝集成标志着用户与网络内容交互的关键时刻,将被动观看转变为主动学习和探索。
该功能如何工作
利用 Chrome 的“从屏幕选择”的设计是直观和直接的:
- 用户可以突出显示屏幕上的任何文本、图像或视觉元素
- 出现提示,询问他们是否想向 Gemini 询问所选内容
- 用户可以输入与所选材料直接相关的问题
- Gemini AI 提供上下文信息、解释或翻译
- 响应会显示在专用侧边栏中,不会影响浏览体验
此过程无需在应用程序之间切换或将信息复制粘贴到单独的搜索界面中,从而为搜索信息的用户创建流畅且不间断的工作流程。
技术实现和能力
“从屏幕中选择”功能利用了 Google 先进的 Gemini AI 模型,该模型专门针对理解和响应视觉和文本上下文进行了优化。该实现结合了多种技术:
- 计算机视觉:识别和理解屏幕上的视觉元素
- 自然语言处理:在上下文中解释用户查询
- 实时分析:处理所选内容并生成响应
- 跨应用程序集成:跨不同浏览器选项卡和应用程序工作
这一技术基础使该功能能够处理广泛的查询,从识别图像中的对象到解释复杂的概念、翻译文本以及提供有关所选内容的附加上下文。
实际应用和用例
Chrome 的“从屏幕选择”功能的潜在应用是多种多样的,并且在各种用户场景中都具有影响力:
| 用户场景 |
示例用例 |
好处 |
| 语言学习者 |
选择外文文本进行即时翻译 |
通过上下文理解增强语言习得 |
| 学生研究人员 |
要求解释复杂概念 |
加速学习和理解 |
| 专业人士 |
分析数据可视化或图表 |
利用人工智能洞察改进决策 |
| 日常用户 |
识别图像中的对象 |
有关周围环境的即时信息 |
| 购物者 |
询问网上看到的产品 |
更明智的购买决策 |
与现有视觉搜索技术的比较
Chrome 的“从屏幕选择”功能进入了视觉搜索和人工智能辅助工具的竞争格局。下表将 Google 的新产品与现有技术进行了比较:
| 功能 |
Chrome 从屏幕中选择 |
循环搜索 |
Microsoft Bing 视觉搜索 |
Apple 的视觉查找 |
| 人工智能模型 |
双子座 |
双子座 |
必应人工智能 |
苹果情报 |
| 屏幕选择 |
是 |
圆圈手势 |
图片上传 |
长按图像 |
| 跨应用支持 |
是 |
有限 |
否 |
是 |
| 实时分析 |
是 |
是 |
有限 |
是 |
| 平台可用性 |
Chrome(网络) |
安卓 |
网络/浏览器 |
iOS/macOS |
对浏览和人工智能未来的影响
Chrome 中“从屏幕选择”的推出标志着日常数字工具中更深入的 AI 集成的更广泛趋势。此功能代表了几项重大发展:
- 人工智能访问民主化:通过主流用户最常用的浏览器直接向他们提供先进的人工智能功能
- 重新定义搜索:从基于关键字的搜索转变为上下文感知、视觉理解
- 提高生产力:减少信息收集和处理工作流程中的摩擦
- 改变内容消费:将被动浏览转变为交互式学习体验
随着 AI 模型的不断发展,“从屏幕选择”等功能可能会变得更加复杂,有可能提供预测帮助、个性化内容推荐以及与其他 Google 服务和第三方应用程序的更深入集成。
隐私和注意事项
对于任何分析用户内容的人工智能功能,隐私考虑都是至关重要的。 Google 已采取多项措施来解决潜在问题:
- 针对某些任务进行设备上处理以最大程度地减少数据传输
- 明确的用户控制以选择加入或退出该功能
- 透明的数据使用政策
- 删除搜索历史记录和 AI 交互的选项
但是,用户应始终注意,所选内容可能会由 Google 服务器处理以提供人工智能驱动的响应,从而引发有关数据保留和培训目的潜在用途的问题。
市场反应和采用
对“从屏幕选择”功能的早期反应基本上是积极的,技术爱好者和生产力博主称赞其无缝集成以及改变用户与数字内容交互方式的潜力。该功能特别受到以下机构的欢迎:
- 看到其增强学习材料潜力的教育专业人士
- 需要快速分析和理解复杂信息的研究人员
- 受益于即时翻译功能的国际用户
- 认识到无障碍功能在帮助残障用户方面的潜力的倡导者
随着该功能向全球 Chrome 用户推出,其采用率及其对浏览习惯的影响将变得更加清晰。 Google 将人工智能直接集成到核心产品中而不需要单独安装应用的策略可能会加速主流对这些高级功能的接受。
结论:人工智能增强浏览的未来
Chrome 的“从屏幕选择”功能不仅仅代表了一项新功能,它还标志着用户与数字内容交互方式的根本转变。通过将 Gemini AI 直接无缝集成到浏览体验中,Google 正在为更加直观、信息丰富和交互式的网络铺平道路。
随着这项技术的不断发展,我们预计人工智能将更深入地集成到浏览器中,其中可能包括预测辅助、实时内容摘要、自动化研究功能和个性化学习体验。搜索和了解之间的界限将继续模糊,人工智能将成为我们数字生活中看不见的但强大的助手。
对于用户来说,“从屏幕中选择”功能让他们得以一睹未来的风采,信息不仅可以访问,而且可以与上下文相关、交互式且可立即采取行动。随着 Google 和其他科技公司继续投资人工智能驱动的浏览器功能,我们在线学习、工作和探索的方式将永远改变。
Chrome 的“从屏幕中选择”可让您向 Gemini 询问屏幕上的任何内容
https://www.androidpolice.com/chrome-gets-circle-to-search-convenience-with-new-gemini-feature/
Chrome 的“从屏幕选择”功能可让您向 Gemini 询问屏幕上的任何内容
https://www.androidpolice.com/chrome-gets-circle-to-search-convenience-with-new-gemini-feature/