Project Mariner是什么?一文让你看懂Project Mariner的技术原理、主要功能、应用场景

来源:卓商AI
发布时间:2025-04-05

Project Mariner概述简介

Project Mariner 是谷歌 DeepMind 推出的浏览器助手。Project Mariner基于 Gemini 2.0 技术,用 Chrome 扩展程序实现浏览器自动化,理解和执行网页任务。Project Mariner能理解和推理浏览器屏幕上的信息,包括像素和网页元素,基于 Chrome 扩展程序使用这些信息完成任务。Project Mariner 能控制 Chrome 浏览器、移动屏幕上的光标、点击按钮和填写表格,像人类一样使用和浏览网站。Project Mariner在 WebVoyager 基准测试中达到 83.5% 的高分成绩。目前,Project Mariner 只能在浏览器的活动选项卡中执行键入、滚动和点击操作,在执行某些敏感操作(如购买物品)之前,会要求用户进行最终确认。

Project Mariner的功能特色

多模态理解:理解浏览器屏幕上的所有内容,包括像素、文本、代码、图像和表单等数据。

浏览器交互:实时导航和操作复杂的网站,自动执行浏览器中的任务,保持用户的控制权。

自动化任务:自动与浏览器进行交互操作,将数据整理、填充到网页其他区域,同时将数据按照用户的要求整理好。

复杂指令处理:理解、执行复杂的用户指令,分解为可执行的步骤。

关系理解:理解不同网页元素之间的关系及其功能。

视觉反馈:在执行任务时提供视觉反馈和更新,让用户了解进度。

安全性:在执行敏感操作(如购物和付款)之前,会要求用户进行最终确认,确保安全性。

如何使用Project Mariner

Project Mariner目前处于早期测试阶段,仅对少数测试者开放,访问Project Mariner的官方网站,加入等候名单。

Project Mariner能做什么?

数据整理与复制:将网页上的数据复制到电子表格中进行整理,例如从存储大量数据的网页提取信息,整理到Excel等表格软件中。

在线购物:根据用户给出的购物清单,自动在电子商务网站上搜索商品添加到购物车。

旅行规划:帮助用户查找航班和酒店信息,自动化旅行规划过程中的网页浏览和信息比较。

日常购物:为用户在零售网站上购物,如搜索、购买家庭用品。

食谱查找:在食谱网站上根据用户需求自动搜索和选择食谱。

© 版权声明:本站所有原创文章版权均归卓商AI工具集及原创作者所有,未经允许任何个人、媒体、网站不得转载或以其他方式抄袭本站任何文章。
卓商AI
卓商AI

AI爱好者的一站式人工智能AI工具箱,累计收录全球10,000⁺好用的AI工具软件和网站,方便您更便捷的探索前沿的AI技术。本站持续更新好的AI应用,力争做全球排名前三的AI网址导航网站,欢迎您成为我们的一员。

猜你喜欢
  • LazyGraphRAG
    LazyGraphRAG LazyGraphRAG是微软研究院开发的一种新型图谱增强型检索增强生成(RAG)模型,它不需要预先对源数据进行总结,从而避免了可能让一些用户和用例望...
  • ARTi
    ARTi ARTi 是一个用于生成数字艺术作品的在线工具。用户可以通过 ARTi 快速创作出独特的数字艺术作品,并将其保存或分享给他人。ARTi 具有丰富的功能...
  • TableGPT2-7B
    TableGPT2-7B TableGPT2-7B 是由浙江大学开发的大规模解码器模型,专门用于处理数据密集型任务,尤其是表格数据的解读和分析。该模型基于 Qwen2.5 架构...
  • InventAI
    InventAI AI艺术生成器是一个新平台,使用创新的网页用户界面,可以生成独特而迷人的艺术作品。无需艺术技巧,只需指定您的偏好,让AI完成剩下的工作。订阅后即可体验...
  • chattyhiring
    chattyhiring ChattyHiring是一位AI招聘人员,可以简化人才获取过程。它有助于招聘团队以公平,公正的方式快速,准确地评估和筛选候选人,节省时间和资源,同时...
  • APIPark
    APIPark APIPark是一个开源的AI网关和API开发者门户,由Eolink推出,旨在帮助开发者和企业轻松管理、集成和部署AI服务。Eolink提供API全生...
  • kvitly
    kvitly Kvitly是一个由AI驱动的业务平台,简化了中小型企业的网站创建,付款,分析和营销。 Kvitly借助用于网站构建,客户管理和自动营销的AI驱动工具...
  • Promptify
    Promptify Prompter是一个Chrome浏览器插件,能够一键优化用户的文本提示,生成更加精美、细节丰富的AI艺术图像。关键功能包括:一键优化提示文本,实时预...