不是聊天机器人,是真正会动手的那种 —— 看得懂屏幕,也改得动文件。
视觉模型「看懂」当前画面,自动点按、输入、滑动。你说「打开美团点一份猪脚饭」,它自己一步步做完。
执行过程折叠成一张卡片:运行中转圈,点开能逐步看它想了什么、做了什么,跑完给结论。
选一个文件夹或文件,AI 直接读内容、直接改写结果,全程不操作屏幕。txt / md / json / 代码 / 配置都能改,中文不乱码。
每次发消息就是一个独立任务。右上角三条杠里随时切回去;它做错了就中途点停止,当场跟它说、原地改,不用从头重跑白烧 token。
默认开启。直接关掉模型的思考链,任务速度明显变快;需要它更聪明时,可在输入框处把「思考程度」调高。
目标达成那一刻立刻收手,并给出总结;查资料、阅读后回答这类任务会分条列出结论,不会只回一句「已完成」。
可以添加多个模型,来自不同服务商、用各自的 Key,在输入框上方一键切换。
要删除文件一定先弹窗确认;遇到支付、密码等敏感页面自动停下;API Key 存在系统加密存储,日志只留本机。
豆糕干活需要「截屏 + 点击」的权限。不同系统、不同手机,可用的通道不一样 —— 它会自动选。
| 通道 | 需要什么 | 截图能力 | 适用系统 |
|---|---|---|---|
| 无障碍 | 在系统设置里授予无障碍权限,不用装别的东西 | 仅 Android 11 及以上 | Android 11+ |
| Shizuku | 装一个 Shizuku 并启动(不需 Root),推荐 | 全版本可用 | Android 6.0+ |
| Root | 手机已 Root,给豆糕 root 权限,它就能直接操作系统 | 全版本可用 | Android 7.0+ |
一直在改,最近的几版都在解决「慢」和「傻」这两件事。
不需要折腾电脑,装好就能上手。
从 GitHub 下载 APK 装到手机上,支持 Android 7.0 及以上,安装包约 6.7 MB。
推荐装 Shizuku 并启动(不用 Root);Android 11 以上也可以直接授予无障碍权限。
设置 → 模型管理 里点右上角「+」添加模型、填 API Key,回到首页说出你要做的事就行。