2853 字
14 分钟
更新于 2026-08-17
1 次修订
番茄钟工作法与依赖 Agent 工作等待的冲突与折衷解法:任务驱动而非对话驱动

背景

传统番茄工作法要求人在二十五分钟内不被打断、不做切换,只专注于一件事。但这个前提和现在依赖 Claude、Codex 等 Agent 的工作方式有很大的冲突:Agent 每次回复可能需要一分钟、十分钟,甚至半小时,而人的决策和输入常常不到一分钟,剩下的时间似乎只能等待。

以我自己的使用体验粗略估算,在一个 Agent 任务周期里,人类真正输入的内容可能不足 10%,主动工作的时间不足 30%,其余时间都在等 Agent 返回结果。这不是严格统计,只是为了说明一种很具体的感受:人明明坐在电脑前,却很难连续二十五分钟真正投入一件事。

为了不“浪费”这些等待时间,有的人会一次开三四个对话,让多个任务同时进行;有的人则会一边等,一边看动漫、刷短视频、看小说。

这两种方式都不太好。

同时开多个对话,会让人长期处于频繁切换和被打断的状态。复杂问题刚在脑中建立起上下文,另一个对话就完成了,于是注意力又被拉走。长期这样工作,效果就像从 Claude Opus 5 原地退化成 Sonnet 5:工具没有变笨,是人的思考被切碎了。

而用娱乐填满等待时间,看似只是在“摸鱼”,实际却很容易让工作失去参与感。最后除了一个几乎说不上属于自己的结果,好像什么都没剩下。长期下来,就会重新面对那个问题:大模型时代:我的能力究竟是什么?

这也解释了 Agent 时代一部分知识焦虑的来源:一种人觉得“既然学得没有 AI 快,那就不用学了”;另一种人每天同时推进许多事情,看起来一直在学,却因为没有完整思考过任何一件事而更加焦虑。

先重新认识番茄工作法

如果不熟悉番茄工作法,可以先看这个六分钟的视频:

番茄工作法并不只是“工作二十五分钟、休息五分钟”。它还包括计划、追踪、记录、分析和调整。尤其重要的一点是:遇到内部或外部打断时,不是立刻跟着打断走,而是先把它记录下来,转化成待处理的任务,再回到当前工作。

视频里有一句话很适合 Agent 时代:打断的另一面也可能是任务。与其幻想完全没有打断,不如先明确如何处理打断。

对我来说,番茄钟的价值也不是逼自己工作更久,而是减少真正工作的时间,强化完成一段工作的获得感。如果二十五分钟太长,也完全可以按自己的注意力情况调整;例如我会把它缩短到十五分钟工作、五分钟休息。

真正的冲突不是等待,而是持续监听

Agent 在后台运行,本身不一定会破坏专注。真正破坏专注的是:我们不知道它什么时候结束,也不知道结束后是否还需要一句“请继续”,于是始终把一部分注意力留在对话窗口里。

面对一个新需求,我们通常要反复走完这样的流程:

描述需求 -> 制定计划 -> 完成需求 -> 按计划验收和测试 -> 开 PR -> 用户验收 -> 微调 -> loop...

除了最初描述需求、关键决策和最终验收,许多小任务的中间步骤并不需要人类持续参与。但在对话驱动的 Agent Session 里,只要人不回来确认、不提供下一步指示,任务就可能停在那里。

于是,人承担的不是高价值的判断,而是不断轮询:

  • 这个对话做完了吗?
  • 计划执行到哪一步了?
  • 测试跑了吗?
  • 可以开 PR 了吗?
  • 另一个对话是不是也该看一下了?

这才是无聊的主要来源:重复的推进话术,加上重复的等待。

对话很适合澄清一个模糊问题,却不适合充当长期的项目管理单位。一个功能可能先在一个对话里讨论,在另一个对话里实现,又在第三个对话里修 Bug。对话越来越多,真正属于同一个任务的上下文反而被噪声淹没。

只靠提示词要求 Agent “不要列计划,直接做完并开 PR”也不够。计划本身是有用的,问题不是计划太多,而是计划、进度和结果都被锁在某一次对话中。我们既看不见稳定的任务状态,也无法确定它究竟进行到了哪一步,只能一次次回到对话里确认。

从对话驱动改成任务驱动

折衷解法不是让 Agent 无限自治,也不是彻底取消对话,而是把管理工作的基本单位从“对话”换成“任务”。

一个任务可以经历这样的状态:

积压(灵感) -> 待办 -> 进行中 -> 审核中 -> 完成

我更愿意把它概括成三个阶段。

灵感期

灵感期类似作者的灵感箱。想法可以随时记录,但记录不等于立刻执行。

这是一个很重要的缓冲区。过去我们打开对话,只是想讨论一个还没想清楚的功能,Agent 却很容易直接开始实现。任务驱动以后,尚未成熟的想法先留在积压区;等目标、边界和验收标准都比较清楚,再进入待办。

番茄工作法对打断的处理也可以放在这里:工作中突然出现的新想法,不必马上切换过去,只要先记成任务,等当前番茄结束后再判断。过大的任务继续拆分,几个不足以占用一个番茄的小任务则可以合并处理。

工作期

任务进入工作期后,不再由人类靠一句句对话催促,而是由任务状态和任务管理 Agent 推进:制定计划、实现、测试、提交 PR,并把过程记录在同一张任务卡片下。

这里的关键不是完全消灭对话,而是让对话从“管理入口”退回“执行记录”。同一个功能即使跨越了多个 Session,也仍然属于同一个任务。人需要回顾时,看到的是目标、决策、进度和产物,而不是在几十个对话标题里猜哪一个才是现场。

当 Agent 暂时没有额度、运行时间过长,或者人已经下班时,任务就停留在待办或进行中,等条件恢复后继续。人的工作时间不必再跟着 Agent 的额度和响应时间一起波动。

审查期

完成实现不等于完成任务。Agent 应当把结果放进审核中,明确列出改动、验证结果、风险和需要人判断的部分。

低风险、容易回滚的任务,可以在自动测试完成后直接等待人类验收;高风险任务则先增加一次独立的 Agent 交叉审查,修正后再通知人。但无论哪一种,涉及外部输入、不可逆操作、关键发布或主观取舍时,都不能把人的最终判断省掉。

任务驱动降低的是人的推进成本,不是人的责任。

一个已经存在的参考实现

“不要再用对话管理 Codex 了”展示的 dashi-taskboard,和这里的思路很接近:用积压、待办、进行中和审核中组织工作,让 Codex 从任务池认领任务,并按功能索引跨对话的上下文。

项目已经在 GitHub 开源:chuspeeism/dashi-taskboard。它不是唯一答案,但至少说明任务看板并不只是一个抽象设想,而是一种已经可以运行的交互方式。

视频后半段还提到一个容易被忽略的问题:自动工作流要想持续运行,不能每一步都依赖人回来喂一句提示词;但没有人参与时,也必须有安全的降级方案。对我来说,这个降级方案不是让 Agent 擅自决定一切,而是让任务可以自动暂停、排队和等待审核。无人值守时宁可停在审核中,也不要悄悄越过人的判断。

它为什么能和番茄工作法相容?

关键在于重新定义“一个番茄里只做一件事”。

这“一件事”应该是人当前承担的认知任务,而不是“盯着某个 Agent 进程直到它结束”。例如:

  • 用一个番茄澄清目标、拆分任务并写好验收标准;
  • 用一个番茄解决某个真正需要自己推理的设计问题;
  • 用一个番茄集中审查一项高风险改动;
  • 把几个很小的低风险结果合并到一个番茄里批量验收。

任务交给 Agent 后,就不再持续监听对话。Agent 的完成通知也只是一条新事件:先进入审核队列,等当前番茄结束,或者等预先安排的审查时段再处理。这样,即使后台同时有多个 Agent 在运行,人脑前台仍然只有一个明确目标。

这和同时打开四个对话、哪个响了就切到哪个并不一样。前者并行的是机器执行,人的注意力仍然是单线程;后者并行的则是人的上下文,最终只会得到一地碎片。

如果当前的人类任务已经完成,而 Agent 还在运行,也不必为了“凑满二十五分钟”临时找另一个复杂问题。可以用剩余时间检查刚才的工作、记录下一步,或者直接休息。番茄钟服务的是注意力,不是考勤。

折衷,而不是替代

对话驱动并非没有价值。灵感期需要对话来澄清问题,审查期也需要对话来解释取舍、指出偏差。真正适合交给任务系统的,是中间那些目标已经明确、步骤可以连续推进、结果可以验证的工作。

所以我想要的并不是“再也不和 Agent 对话”,而是:

用对话思考,用任务推进;让 Agent 异步执行,让人同步专注。

番茄工作法保护的是人的注意力,任务驱动解决的是 Agent 的等待和推进。两者的折衷点,是不再要求人陪着每一次运行从头走到尾,也不因为机器可以并行,就误以为自己的注意力同样可以并行。

当进度和结果都沉淀在任务里,人终于可以从“请继续”“做到哪了”“跑一下测试”这些重复话术中释放出来,把有限的专注力留给真正值得自己思考、判断和学习的部分。

番茄钟工作法与依赖 Agent 工作等待的冲突与折衷解法:任务驱动而非对话驱动
https://xnnehang.top/posts/pomodoro-agent-task-driven/
作者
XnneHang
发布于
2026-08-17
许可协议
CC BY-NC-SA 4.0