浏览网页时,真正耗时间的工作往往不是“看懂页面”,而是把页面里的信息继续加工。例如把几个商品卡片整理成对比表,把一组图片做成展示页,把长篇资料重新整理成文档,或者根据当前网页快速做一份演示稿。传统做法通常需要经历复制、粘贴、整理格式,再把内容送进不同工具。

Paw Work,也叫“爪爪”,尝试把这段流程直接放到浏览器里。它并不是让AI自动在互联网中到处操作,而是由用户先确定当前网页中的处理范围,再让AI针对被选中的内容生成可以继续编辑的工作成果。

PawWork抓抓功能介绍:用AI辅助完成网页操作和文件交付

Paw Work主要在做什么

根据项目官方说明,Paw Work是一个基于Chrome Manifest V3的浏览器扩展。开启Paw Mode之后,用户可以在已经打开的网页中选择图片、文字、表格、区块或链接,然后在浏览器侧边栏描述最终想要得到什么。

这里的重点在“先选择,再处理”。它并不是单纯把整个网页发送给聊天机器人,然后返回一段文字回答,而是希望把用户明确指出的网页内容进一步转化成可编辑文件或工作区。

例如浏览电商页面时,可以选中几个商品卡片,让它整理成商品对比表;看到一组图片时,可以要求制作海报或演示页面;面对长篇笔记或文字资料,也可以将内容转成文档。

这种设计比较适合已经明确知道“我要处理页面中的哪部分内容”的用户,而不是把所有判断都交给自动化代理。

从网页选择到文件生成

Paw Work给出的典型操作流程并不复杂。开启Paw Mode之后,在当前网页点击需要处理的内容,再到侧边栏描述目标,生成结果则会进入对应的工作区。

  1. 在Chrome中开启Paw Mode。

  2. 点击网页中需要处理的图片、文本、表格或其他元素。

  3. 在侧边栏说明希望得到的结果。

  4. 打开生成的工作区继续查看和修改内容。

如果后续只想修改结果中的某个部分,还可以继续选择对应节点并描述修改要求,而不是每次重新生成整个结果。

对于比较复杂的任务,项目还设计了计划确认机制。AI可以先给出处理计划,用户选择批准、拒绝或者添加修改意见后,再继续执行。这种方式可以减少复杂任务在没有确认的情况下不断扩大处理范围。

可以生成哪些内容

Paw Work并没有把所有结果都做成普通聊天文本,而是针对不同内容提供不同类型的工作区。

网页中的内容可以提出的需求主要输出形式
商品信息、表格、文字整理、比较、拆分数据可编辑电子表格
图片及选中内容制作演示稿或海报Slides / Design画布
当前网页重新制作可编辑页面HTML文件
长笔记、文字资料整理成长文档文档工作区

其中电子表格和文档工作区使用Univer,海报和幻灯片相关能力使用tldraw,网站输出则直接生成HTML。官方还说明幻灯片可以导出为PPTX。

这也是Paw Work与普通网页AI助手比较明显的差别。普通助手通常把网页内容总结成一段回答,而Paw Work更强调“处理完之后还要继续工作”,因此生成的是可以继续修改的数据、页面和文件。

实际使用价值在哪里

这类工具比较有价值的地方并不是替代一次简单的复制粘贴,而是减少网页内容在多个软件之间反复搬运。

例如做竞品整理时,用户可能已经在网页上找到需要比较的几个产品。传统流程是逐项复制名称、价格、描述和图片,再建立表格。使用Paw Work时,可以先把相关页面元素选出来,然后要求整理成对比表。

制作演示材料也是类似。网页已经提供了图片和基础信息时,没有必要先全部下载再逐个插入幻灯片,而是可以直接以所选内容作为生成范围。

对于需要反复进行资料搜集、商品整理、内容运营、研究记录和简单页面制作的用户,这种“网页就是素材入口”的工作方式会更容易体现价值。

它并不是自动浏览机器人

理解Paw Work时,一个需要特别区分的概念是浏览器AI助手与无人值守RPA。

官方明确表示,Paw Work不是一个自动在多个网站之间漫游的Operator,也不是用来自动完成结账、支付、提交等流程的无人值守RPA。它主要工作在用户当前已经打开并登录的浏览器环境里,由用户决定处理什么内容。

因此,如果需求是让AI自己寻找网站、进入多个页面、填写表格、提交订单并持续在后台运行,Paw Work并不是优先选择。

相反,如果需求是“这个页面我已经找到了,现在帮我把其中这些内容整理成一个文件”,它的定位会更加匹配。

BYOK模式意味着什么

Paw Work没有提供自己的托管模型额度,而是采用BYOK,也就是Bring Your Own Key模式。使用聊天模型时,需要配置自己的模型接口。

官方目前支持配置OpenAI兼容的HTTPS接口,包括Base URL、API Key和模型名称。图片生成可以另外配置接口,也可以继承聊天模型的相关设置。网页搜索或抓取功能则可以配置对应的搜索或抓取服务密钥。

这种方式意味着Paw Work本身不是一个购买账号后直接包含AI额度的SaaS服务。实际模型费用、模型能力以及可用性,主要取决于用户接入的服务商。

对于已经拥有API Key、使用自建兼容接口或者希望自己控制模型来源的用户,这种模式比较灵活;如果用户完全不了解API和模型配置,则需要额外理解这些设置。

数据如何保存在浏览器中

按照项目当前公开说明,Paw Work不要求注册账号,也没有Paw Work自己的云端服务器。侧边栏与扩展内部的工作区进行通信,文件数据保存在浏览器的IndexedDB和OPFS中。

用户填写的模型密钥保存在本机Chrome扩展存储中,并按照配置发送到对应的HTTPS接口。

项目还对模型生成代码增加了隔离机制。生成的JavaScript使用打包在扩展中的esbuild-wasm处理,并运行在QuickJS虚拟机中。官方说明这个运行环境不能直接访问Chrome扩展API、当前网页DOM以及其他会话文件。

这些设计可以帮助用户理解项目的数据流向,但它们并不意味着使用任何第三方AI接口都不存在隐私问题。最终选择什么模型服务、网页中选中了什么内容,以及第三方接口如何处理提交的数据,仍然需要结合对应服务商的隐私政策判断。

参考资料

  1. Paw Work GitHub项目仓库

  2. Paw Work扩展权限配置

  3. Paw Work最新Release

  4. Paw Work开源许可证