边看边喷,
AI 全懂。
指着屏幕口喷,想到哪喷到哪。你的 coding agent 把它整理成问题单、想法清单和待办。
npx skills add AGIHunt/blurt
左边是给谁都能用的录制 App,右边是装进 Claude Code、Codex 等 agent 的 skill。
macOS 13 及以上 · 首次打开请右键 →「打开」 · Windows 版还在测试
以前要截图、画红框、填表格,花两天才反馈完的问题,现在半小时讲完。
给 agent 一双眼睛,给你省下两天。
按一下,开喷。
在任何地方按一下
框出要录的区域,或者点一下选中某个窗口。标签栏、收藏夹不会被录进去。
边用边说
想到哪说到哪,说错了改口也没关系。说「这里」的时候,按住 ⌃ 拖动鼠标把它圈出来。
点「完成」,去干别的
agent 在本地把语音转成文字,拆成一条条事项,给每条挑截图、找最可能出问题的代码。
像刷短视频一样审核
一条一条过,全程键盘。审完导出,或者直接说「帮我改掉」。
不只是提 bug。
打磨 vibe coding 出来的产品
AI 通宵做完的东西,你挨个页面点一遍、边用边喷,拿到一份带代码定位的问题清单,直接交给 AI 去改。
逛完直接出需求文档 新
想做个官网或独立站?逛一圈参考站,看到好的就圈出来说一句,agent 整理成需求文档和设计文档。这个页面就是这么来的。
边逛边记灵感
「这个引导做得好……这个定价页也不错……」整理成想法清单:是什么、为什么、灵感来自哪、下一步做什么。
谁都能反馈
产品、设计、运营、客户,不需要有代码库。用 App 录好把视频发过来,开发那边的 agent 结合代码来处理。
调研和讲解
竞品走查、用户研究、「这个是怎么运作的」,整理成带截图佐证的笔记和结论。
不只是网页
终端、TUI、桌面 App 照样录。手机上的问题用自带录屏,硬件直接拿手机拍,把视频丢给 agent 就行。
进你现在就在用的工具。
Jira、Notion、Obsidian 也行:agent 用你已经装好的 CLI 或 MCP 去写。或者不导出,直接让它开始修。
默认什么都不上传。
留在你电脑上
- 录屏和录音。存在你选的工作区里,默认是
~/Blurt。 - 语音识别。默认用 SenseVoice 在本机跑,约 240 MB,普通 CPU 就够。
- 抽帧和画框。脚本在本地从视频里取。
- 审核页。本机起的一个页面,只有你自己能打开。
你选了才出去
- 给 agent 的内容。文字稿和它挑出的几张截图,会发给你自己在用的 coding agent,也就是它背后的模型服务。视频本身不会发。
- 云端语音识别。只有你配了自己的 Groq、OpenAI 或百炼 Key 才会用。
- 导出。写进飞书、GitHub 之前,会先跟你确认去哪、几条。
- 发给同事的视频。你自己复制,自己粘贴。
没有黑盒。
一个要录你屏幕的工具,应该让你看得到它做了什么。确定的事交给脚本,判断交给模型,两边都在仓库里。
问得最多的。
很费 token 吗?
不会把视频喂给模型。语音在本地转成文字,不花钱;agent 读的是文字稿,只给真正成条的事项挑几张截图看。花费跟你讲了几件事有关,跟录了多久关系不大。两次真实使用(Claude Code + Opus 5.5,一个线上 Web 产品):
| 录屏 | 说话 | 事项 | 语音识别(本地) | 录完到审核页 | 新输入 / 输出 token | 按 API 价格 |
|---|---|---|---|---|---|---|
| 7.0 分钟 | 2.8 分钟 | 9 条 | 4 秒 | 约 4 分钟 | 约 14 万 / 1.9 万 | 约 2 美元 |
| 8.6 分钟 | 5.0 分钟 | 20 条 | 5 秒 | 约 5 分钟 | 约 15 万 / 2 万 | 约 2 美元 |
另有对话上下文的缓存读取,约 400–500 万 token,按输入价的 1/20 计费,已算进上表。
不做前端能用吗?
能。只要问题能在屏幕上看到,或者能用手机拍下来,就能喷:终端、桌面 App、手机录屏、拿手机拍的硬件都行。
说什么语言都行吗?
中、英、日、韩、粤语用默认的 SenseVoice。德语、法语、西语等其他语言用本地 Whisper 或云端 Key,首次运行时 agent 会按你说的语言来选。说什么语言,整理出来就是什么语言。
Windows 能用吗?
能录:Windows 上是 Tk + ffmpeg 的录制器,由 agent 启动。但还没有常驻的托盘 App,画笔目前只有 macOS,也还没在足够多的真机上验证过,所以这里先不放 Windows 下载按钮。
下次有话想说,
直接喷。
npx skills add AGIHunt/blurt