toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI文章
AI提示词
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,508个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI快讯
  • AI文章
  • 精选推文
  • 提交AI工具
  • 推广AI工具
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策

OpenClaw Peekaboo v3:给 Mac Agent 装上眼睛和手

2026/05/12
·toolin小编

Peekaboo v3 让 AI Agent 能像素级截屏、读取 UI 元素、操控鼠标键盘,并打包为 MCP 服务供 Cursor 等工具直接调用。

OpenClaw Peekaboo v3:给 Mac Agent 装上眼睛和手
OpenClaw Peekaboo v3:给 Mac Agent 装上眼睛和手
2026/05/12

OpenClaw Peekaboo v3:给 Mac Agent 装上眼睛和手

Peekaboo v3 让 AI Agent 能像素级截屏、读取 UI 元素、操控鼠标键盘,并打包为 MCP 服务供 Cursor 等工具直接调用。

Peekaboo 是什么核心能力拆解"看"的能力"动"的能力MCP 打包自然语言模式实际使用案例适合的使用场景获取方式
AI产品

OpenClaw 的 Peekaboo 更新到 v3,给 Mac 上的 AI Agent 补上了最缺的两个能力:看屏幕和操作鼠标键盘。在此之前,Agent 能打开网页、跑流程,但涉及精确的 UI 操作就卡住了。Peekaboo v3 把这堵墙拆了。

适合在 Mac 上用 Agent 做自动化操作的开发者和效率工具爱好者。

Peekaboo 是什么

Peekaboo(直译"躲猫猫")是一个 Mac 上的工具包,让 AI Agent 具备屏幕感知和鼠标键盘操控能力。由 OpenClaw 作者 Peter 开发,从 v3.0.0-beta 到最近的 v3.1.x 密集更新。

简单理解:给你的 Mac 装一双带眼睛的手——Agent 能看到屏幕内容,也能操作鼠标和键盘。

Peekaboo v3 功能概览

核心能力拆解

"看"的能力

  • 像素级截图:窗口截图、全屏截图、菜单栏截图
  • 读取 UI 元素:获取 macOS 上每个 UI 元素的位置、类型、label 等属性
  • 真正做到"看懂"屏幕上有什么,而不是简单地截个图

"动"的能力

  • 点击、双击
  • 输入文字
  • 按快捷键
  • 滚动
  • 拖拽
  • 切窗口、切桌面(Space)
  • 点击 Dock 图标
  • 处理系统弹窗

基本覆盖了人类用 Mac 会做的所有操作。

MCP 打包

Peekaboo v3 支持把所有能力打包成 MCP(Model Context Protocol)服务,直接喂给你常用的 AI 工具。

实际例子:在 Cursor 里写代码,UI 出了 bug——以前要自己截屏发给 Cursor。现在 Cursor 自己就能截图、看屏幕、改代码、重新跑一遍验证,全程不需要你插手。

Peekaboo 集成 Cursor 工作流

自然语言模式

支持自然语言 Agent 模式,提示词可以直接用大白话描述任务,不需要写特定的命令格式。

实际使用案例

有网友做了一个烟雾测试:让 Hermes 操作计算器、Peekaboo 读屏幕结果、Python 独立验证答案是否正确,三条链路并行协作,一次通过。

Peekaboo 计算器测试

适合的使用场景

  • UI 自动化测试:Agent 自己截图、自己看、自己操作、自己验证
  • 重复性桌面操作:批量处理文件、填表、搬运数据
  • 开发调试:代码改完自动截图看效果,不用手动切换窗口
  • 邮件和信息处理:自动翻找、阅读、回复邮件

获取方式

Peekaboo 是开源项目,可通过 OpenClaw 官方渠道获取。v3.1.x 系列是最近的密集更新版本。

注意: 目前仅支持 macOS。Windows 和 Linux 支持尚未确认。

所有文章

作者

avatar for toolin小编
toolin小编

分类

  • AI产品
Peekaboo 是什么核心能力拆解"看"的能力"动"的能力MCP 打包自然语言模式实际使用案例适合的使用场景获取方式

相关文章

AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通
AI产品

AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通

清华 CVPR'26 Highlight 开源项目 AutoMIA,输入两张图即可生成可 3D 打印的体素镜像错觉艺术模型(STL-ready),单张 RTX 3090、76 秒/设计。

avatar for toolin小编
toolin小编
2026/07/24
Macaron-V1:用 MoL 把个性化经验压进 LoRA 的开源 Coding 大模型
AI产品

Macaron-V1:用 MoL 把个性化经验压进 LoRA 的开源 Coding 大模型

心洲科技 Mind Lab 开源 Macaron-V1(Venti/Coding-Venti/Tall 三档),基于 GLM-5.2 744B + 四个 1B LoRA 专家的 Mixture-of-LoRA 架构,提供免费 hosted API 和 UI4A 插件。

avatar for toolin小编
toolin小编
2026/07/24
UniWorld-View:单张图/视频生成任意相机轨迹,登顶 WorldScore 全开源
AI产品

UniWorld-View:单张图/视频生成任意相机轨迹,登顶 WorldScore 全开源

北大+兔展+鹏城实验室开源的 UniWorld-View,单图/视频生成任意相机轨迹新视角视频,登顶李飞飞团队 WorldScore 榜单,代码权重 Apache-2.0 全开源,支持一键下载。

avatar for toolin小编
toolin小编
2026/07/24