Claude 录制技能加速研究,但有局限
ZDNET AI··作者 David Gewirtz
关键信息
作者表示,这个功能比复杂脚本更容易上手,但仍然很挑剔、很繁琐,且当界面发生变化时,自动化流程会变得脆弱。文章还提到,Claude Cowork 可以控制电脑、在应用之间切换、浏览网页并在过程中做出决策,但这些运行可能很慢,而且会消耗较多使用额度。
资讯摘要
ZDNET 说,Anthropic 最近推出了 Claude Cowork 的 Record-a-Skill 功能,它允许用户对屏幕操作进行旁白录制,然后把这段演示转换成可复用的技能。作者解释说,Claude 技能本质上就是一种非常详细的预设提示词,可以像程序一样在 Claude 中运行。文章中,作者在一个晚上做出了一个复杂的技能,并表示这比编写复杂脚本更容易。尽管如此,这个过程仍然需要大量微调,而且被描述为“挑剔”和“繁琐”。
作者把这项能力放在更大的自动化背景下来看,重点是那些通常要花数小时的研究和外联工作。文中举例说,通过 HARO 和 Qwoted 这类服务收集信息时,往往会收到大量不相关的回复。使用新的技能后,原本的研究工作被缩短到大约 30 分钟,但文章强调这种“魔法”是有代价的。作者指出的主要缺点包括使用量高、运行缓慢,以及对界面变化很脆弱的控制方式。

资讯正文
关注 ZDNET:在 Google 上将我们设为首选来源。ZDNET 的要点:Claude 可以把带旁白的屏幕录制转换为可重复使用的技能。我的这个技能把原本要花数小时的繁琐研究缩短到了 30 分钟。代价是:高使用量、运行缓慢,以及控制脆弱。
上个月,Anthropic 发布了一项新的 Claude Cowork 功能:可以把屏幕录制加上旁白,转化为一个 Claude 技能。我试用了它,怎么说呢,正如人们所说,“所有魔法都有代价。” 先界定一下我们这里要做的事情。技能(skill)本质上是一段非常详细的预设提示词,可以像程序一样在 Claude(以及许多其他 AI)内部运行。
另请参阅:这项新的 Claude 技能能帮你躲开糟糕合同——而且成本比律师更低。最好的例子就是 Claude Small Business 插件里的这个技能,它能够全面读取并评估合同。它的表现不如最优秀的合同律师,但实际上,它比我这些年接触过的一些平庸律师更有帮助,也更全面。
Claude Cowork 的另一个功能,是让 Claude 控制你的电脑,在各个应用之间移动、浏览网页,并在这个过程中做出决策。可以把它理解为运行非常强大的批处理脚本或快捷指令的能力。多年来,我尝试过各种各样的工具来实现计算机自动化。我让电脑自动化程序读取屏幕上的像素,尝试极其复杂的 if/then 分支,并沿着大量非常脆弱的步骤一步步执行。大多数自动化都要花好几天来搭建,然后只要被自动化对象的界面发生一次变化,就撑不过去。我很想看看,AI 自动化会不会也这样,还是它们能够自己动态适应细微的界面变化。
另请参阅:我把 Anthropic 的 Claude AI 工具用在非常不同的任务上:如何在模型、Code 和 Cowork 之间做选择。新的 Record-a-Skill 功能会帮你自动创建自动化。在一个晚上,我做出了一个非常复杂、几乎强大得离谱的技能。这个过程比编写复杂脚本容易得多,但也很挑剔、很别扭,而且需要一堆调整。在这篇文章里,我会带你走一遍其中一个流程,展示这份魔力。然后在最后,我们再讨论这份魔力所附带的代价。请读到最后,重点就在这里。
情感分析与引述汇总
每隔几个月,我就必须做一项极其繁琐又让人烦躁、但对我正在写的一篇文章又必不可少的工作。有两个服务,HARO 和 Qwoted,专门把想被引用和采访的专家,与可能会选择引用或采访他们的记者和分析师联系起来。
以下是我最近使用这些服务的几个例子:在一篇关于使用 Airtable 进行饮食规划的文章中,我请营养专家就制定食物计划的重要性发表意见。在一系列关于 AI 生成代码法律问题的文章中,我请律师就 AI 编写软件的法律影响提供他们的见解和看法。在一篇关于 5G 使用的文章中,我请企业主分享他们如何使用 5G,以及这项技术可能如何改善他们的运营。你明白我的意思。这个过程相当简单。我会创建一个查询,描述我的问题,并限定应该由谁来回应。我总是会说明,我想和真正的主要回应者对话,而不是那种试图通过帮客户争取曝光来摆姿态的公关代理。这些都是非常有价值的服务,但和 Record-a-Skill 功能本身一样,所有魔法都有代价。在 HARO 或 Qwoted 上发布查询,总会带来大量回复,其中很多都不相关、不够好、缺乏重点、只是在推销自己的议程、求着要采访等等。我正在写一篇比较 Claude Code 和 OpenAI Codex 的文章,并请开发者分享他们的偏好。我的回复截止时间是两天后,但到目前为止我已经收到了 121 条回复。(披露:Ziff Davis,ZDNET 的母公司,于 2025 年 4 月对 OpenAI 提起诉讼,指控其在训练和运行其 AI 系统时侵犯了 Ziff Davis 的版权。)另外:我用 Claude Code 在 8 小时内 vibe code 出了一个 Mac 应用,但它带来的更多是工作量,而不是魔法
筛选这些回复、挑出最好的、过滤噪音、整理其中可能用到的任何数据,并为它们可能被写入文章做其他准备,通常要花掉我整整一天时间。那是非常文书化、非常枯燥、非常烦人的一天,到了最后,我对人类同类的容忍度几乎降到零。服务本身并没有让事情变得更容易。HARO 会把答案通过邮件发送,也会在其网站上提供这些答案。Qwoted 的答案只能通过其仪表板查看。答案并不会完整显示,所以你必须展开每一条回复。联系信息也并不总是完整呈现,因此你得点进个人资料去弄清楚谁是谁。实际的答案本身则被埋在大量自我推销式的开场陈述、定位性推介、结束时的报价,以及一大堆宣称自己客户很特别的公关人员之中。我发出的每一个查询里,通常大约有 30% 的回复都像这样(这是一条真实回复):“我知道你说不要公关人员,但我保证,我只是传话的。” 唉……如果有任何项目适合让 AI 来分析,那就是这个。
开始使用
要录制一个技能,你必须在 Claude Desktop 应用中操作。你还必须处于 Chat/Cowork 侧(也就是说,不是在 Claude Code 模式)。你必须确保选中的是 Cowork 标签页(而不是 Chat 标签页)。然后点击 +,并从菜单中选择 Record a skill。你还应该确保已经连接好麦克风,并且电脑能清楚地听到你。你需要通过口头指示 Claude,同时演示你想要它完成的任务。
所以一定要确保你的麦克风足够好。另见:如何一步一步安装并配置 Claude Code
一旦你选择“Record a skill”,系统就会弹出“Start recording”对话框。直接点击“Start recording”,你就可以开始了。进入教学心态 如果你以前录制过宏,也就是先开始录制模式,然后按顺序点击每个操作,让电脑最终替你重复执行——那这次并不是那样。没错,这个 skill 会重放你在录制过程中做过的一些点击,但“宏”的思维方式并不适合这里。相反,你要把自己放在“教学”的心态里。把它想象成你在向另一个人演示如何完成一组任务。把它当作是在训练一个助手处理复杂工作流,而不是一个会重复点击的算法。稍后,当你读回 Claude 创建的 skill 时,你就会明白这为什么如此重要。这个过程本质上是在教学,而不是在编程。另见:我试用了一个 Claude Code 的竞品——本地、开源,而且完全免费——结果如何
在我的项目里,一按下录制,我就先口头解释这个项目要完成什么。我采用的方式,和我向一位助手解释完全一样:我正在汇总来自不同提交者的信息,作为我正在撰写的一篇文章的输入。我解释说,我会收到大量回复,其中很多不能直接当作引语使用,但仍然可以作为数据使用。因此,当我们筛选所有回复时——而且我们需要把所有回复都过一遍——我们既要看数据价值,也要看引语价值。我一开始已经登录了 HARO 和 Qwoted。接下来我做的第一件事,就是切换到这些标签页,并解释每项服务是做什么的、如何找到最新的 query,以及如何理解这些服务的用户界面。在这个过程中,我还在解释应该如何思考我在寻找什么,以及我希望最终如何呈现。仅仅这些讲解就花了我整整 10 分钟,之后我就被从 Record a skill 模式里拉回 Claude 的主界面了。没关系。我第一次并没有预料到会这样,但确实没关系。Claude 告诉我,它是按 10 分钟为一段来记录的。如果到了 10 分钟,它就会停止录制,并 वास्तव上开始尝试构建这个 skill。你可以中断这个过程,然后开始新的录制。关键在于,一旦你开始新的录制,就要立刻告诉它上下文。在我的例子里,就是“这段内容接着 HARO 和 Qwoted 的情绪报告工作流继续”。最后我录了三段,两段各 10 分钟,另外一段大约 5 分钟。边说我边在各个列表仪表板之间切换,并向 Claude 解释我在关注什么、我想优先处理什么,以及原因。另见:如何通过 Anthropic 的 AI 课程免费学习 Claude Code——其中一门我只用了 20 分钟
我还打开了一个 Google Doc,向 Claude 展示我如何把各个仪表板中的信息转移到文档里,以及随后我希望如何更新这份文档,以便同时为我提供总体汇总信息和详细引语。调整这个 skill 当我完成后,我点击停止,Claude 就把这个 skill 的完整文本呈现给了我。
我不喜欢技能说明暗示只要我提到 HARO,它就应该启动,所以我指示它修改那段文本。另外:Claude Code 的新自动模式如何在不拖慢你的情况下防止 AI 编码灾难。事实证明,你只要告诉 Claude 你想要什么,就能在录制完一个技能后对它进行调整。即使它已经安装好了,你也可以更新这个技能。我发现这非常强大,并且能够为后续使用对这个技能进行微调。全部完成后,保存这个技能。这里有两个文档。SKILL.md 文件是一个 Markdown 文件,会显示在 Claude 界面的右侧面板中。这样你就可以读取它并进行修改。真正的技能是 haro-qwoted-sentiment-report。保存之后,它实际上就安装到了 Claude 里。
调用这个技能
调用这个技能很容易。只要按下斜杠(/)键,然后输入你想运行的技能名称。我运行这个技能时,大约花了半个小时才完成。完成后,它给了我一个 Google Doc 的链接。你可以在这里看到该文档的开头。不要特别在意这些数字,因为它们会在使用这项研究的最终文章中更新,但你可以看到这个工具正在提供的那种数据汇总。
所有魔法都有代价
这个功能也不例外。我尝试在多个项目中使用 Record-a-Skill,发现有四个方面,魔法确实是有代价的。另外:我用 Claude Code 在 12 小时内就 vibe code 出了一个 Apple Watch 应用,而不是 2 个月。
1. 消耗大量用量:首先,录制过程以及技能执行过程似乎都会消耗 Claude 大量的使用额度。我用的是每月 100 美元的 Max 计划。几个小时的 Claude Cowork 通过控制我的电脑,几乎用光了整个会话的使用分配。我被直接带到了可计费积分界面。奇怪的是,我在 Claude Code 里待了整整几天,也从未触发过同样的用量超限。
2. 电脑使用速度很慢:电脑使用能力很有帮助,但速度极慢。看着 Claude 从一个界面元素移动到另一个界面元素,几乎让人煎熬。把一个技能启动后放着去吃晚饭时,这没什么问题。但如果你想快速得到回应,那就别想了。
3. 电脑使用可能会占满你的机器:虽然在技能运行的某些阶段你还能做些别的工作,但如果技能正在尝试在屏幕上的实际窗口位置中导航,你做的任何操作都会让它出错,破坏技能的运行。
4. Claude 不总能察觉电脑错误:如果 Claude 点错了东西,或者你在它没预料到的时候移动了鼠标,有时 Claude 并不会意识到。Claude 可能会卡在那里,永远不动,直到你停止这个技能并重新开始。在那段时间里,Claude 仍然在消耗使用额度。
它仍然可能非常适合合适的任务
总体来说,我对这个流程创建出来的技能质量印象非常深刻。我对 Claude Cowork 基于单个技能所能做到的事情也相当惊艳。
过去做这种汇总工作,往往要花我四到八个小时,而且全都是非常枯燥的重复劳动。创建这个技能本身,从头到尾大约只用了我一个小时。
运行这个技能的方式,就是把它启动,然后去做别的事情,30分钟后再回来。节省下来的时间非常惊人。说实话,生成的质量甚至比我手工做的还要好。这个流程的关键,在于识别那些适合这种技能开发的任务。用 Claude Code 构建代码时你能做的事,与用 Claude Cowork 通过这些技能来处理繁琐的计算机自动化流程和数据汇总流程,是有区别的。我的建议是,认真想清楚你到底想完成什么。如果你觉得它适合做成一个单独的技能,或者一组技能,那就使用这个工具。我的另一条建议是,不要害怕在技能创建之后继续修改它。只要告诉 Claude 你想怎么改这个技能,或者你希望它做什么,Claude 就会去做。我在完成之前,让这个技能改了三四次。结果确实相当强大。
你觉得自己会想用这种新能力创建什么样的技能?欢迎在下方评论区告诉我们。你也可以在社交媒体上关注我每天的项目更新。别忘了订阅我的每周更新通讯,并在 Twitter/X 上关注 @DavidGewirtz,在 Facebook 上关注 Facebook.com/DavidGewirtz,在 Instagram 上关注 Instagram.com/DavidGewirtz,在 Bluesky 上关注 @DavidGewirtz.com,以及在 YouTube 上关注 YouTube.com/DavidGewirtzTV。
来源与参考
收录于 2026-08-11