拿这把新尺子量了一遍,我那条流水线上有根线是假的

哈喽,我是飞飞。
先说个可能会劝退你的事:把 AI 工作画成一张流程图这套讲法,我已经写过四篇了。
画架构图那篇我讲过五个零件,讲过图上总得留一个框给人。编排模式那篇我讲过指挥加子代理并行就是我那条流水线。还有一篇讲从事务管理到结果管理。
按理说这个主题该歇歇了。
这次我还是写了,因为这回手里多了一把新尺子。
我最近看到一套讲法,把 AI 工作流当成图来做工程,里面有个词我以前没见过:虚假连线。
我拿它量了一遍自己那条跑了两百多篇文章的流水线,量出两处我自己的问题。
所以这篇不讲那套框架多好,讲我被它量出了什么。
什么叫虚假连线
先把这个概念讲清楚,就一句话。
在这套讲法里,图上两个节点之间的箭头,只有当后一个节点真的需要前一个节点的产出时才成立。这叫真依赖。
那种没有实际数据往来、纯粹因为「感觉应该先做这个再做那个」而画上去的箭头,就是虚假连线。
它长得跟真箭头一模一样,但它不承载任何东西。
这东西的危害跟占地方无关。它把本来能同时干的活,硬锁成了必须排队。你以为流程就该这么走,其实是自己给自己画了道栅栏。
那套讲法的实施规则里,打头那条就是:先删掉虚假依赖,再去扩展系统。
我看到这条的时候心里咯噔一下,因为我那条流水线从八个环节长起来,从来没人查过里面的线是真是假。
我那张图上有根假线
我去把自己那份编排配置翻出来,逐个环节抄了一遍它声明的输入。
链条是这样的:采集拿到选题,写稿要采集的研究摘要,润色要写稿的文件,评阅要润色后的文件,接下来是沉淀和配图,然后分发,最后发布。
文档里画的是一条直线,注意事项那里还写着必须按顺序执行、不可跳过。
可我把那两个中间环节的输入抄出来一对,愣住了。
沉淀那一步,要的是润色阶段的检测结果。配图那一步,要的是评阅之后的文章文件。
它们俩谁也不需要谁。
沉淀在写经验库,配图在生成封面,两件事从头到尾没有一个字节的数据往来。可它们在图上被画成了一前一后,还配了句不可跳过。
那根线是假的。
实际跑的时候我早就跳过了
更有意思的在后面。
我翻了最近两篇文章的交付记录,两篇里都写着同一句话:沉淀和配图并行。而且确实是同时发起的,写经验库和生封面在同一个动作里一起跑。
也就是说,文档里画着一条排队的线,我实际干活的时候早把它跳过去了。
图和现实对不上。而且这次是现实对,图错了。
这事挺值得琢磨。那条假线是什么时候混进去的?大概是当初搭流水线的时候,脑子里有个顺序感:先总结教训,再去配图,听着就比较有条理。有条理不等于有依赖,可画图的时候这两样很容易混成一件事。
后来真跑起来,效率会自己找路。跑了几十篇之后,实际执行早就绕开了那条线,只有文档还停在原地。
所以我这次真正的收获,跟学到一个新词关系不大。是这个词头一回把我的眼睛从框上挪开,让我去查那些线。
还有条规矩我刚违反过
那套规则里还有一条:单个文件只允许一个写入者。
理由很实在,多个 agent 同时往一个文件里写,最后谁覆盖了谁根本查不清。
我当下的反应是这条我肯定没问题。我那个越攒越厚的写作规则库,一直是由专门负责沉淀的那个环节在写,写了一百多篇训练日志。
然后我去翻了那个文件的提交记录。
前面七条都是沉淀环节写的,格式统一,每次记一篇。可中间夹着一条不一样的,是前两天我为了给那一百多条规则建索引,直接改的,没走沉淀那一环。
所以那个文件现在有两个写入者。
这条规矩我刚学到,就发现自己昨天才违反过。
它目前还没出事,因为两个写入者写的是文件的不同位置,一个在开头加索引,一个在中间加日志。但这属于运气,不属于设计。真哪天两边同时动同一段,我大概率查不出是谁覆盖了谁。
顺带说一条我做对了的。那套规则里有一句「验证者必须独立于执行的 agent」,说的是不能让干活的自己给自己打分。这条我这儿是分开的:评阅是独立的一环,打完分把重改派回给润色或写稿,改完再由评阅复核。干活的和验收的确实是两个角色。
三条规矩量下来,一条做对了,两条露了馅。
那个 90.2% 我核不到
得说个扫兴的。
那套讲法里给了个数字,说这种拆开并行的做法比单个 agent 效率高 90.2%,括号里标着内部数据。
这个数我没核到外部来源。公开资料里能查到的相近说法是「在能拆开的活上,团队式做法大约赢八成」,落在八成上下,跟 90.2% 对不齐。而且效率这个词怎么定义、拿什么测的,没交代。
90.2% 这个精度看着像有过认真测量,可标着内部数据就意味着外人没法复核。我把它当方向看,不当结论用。
倒是另一个数我认。它说这套并行做法烧的 token 是普通对话的十五倍,这个跟 Anthropic 之前公布的口径对得上,我以前引过。
这也是为什么我不打算把整条流水线都改成并行。十五倍的账不是小数目,只有在那些真能拆开、拆开还能省时间的地方才值得。
你那张图上的假线在哪
所以这篇给你的东西很具体。
如果你也有一条串起来的 AI 工作流,不管是几个 skill 还是几个手动步骤,今天可以做一件事:把每一步的输入抄出来,一步一步问,它到底要不要前一步的产出。
不要凭感觉,去看它实际读了什么文件、拿了什么数据。
要,那条线是真的。不要,那就是你自己画上去的栅栏。
我自己下一步准备把配置里那条假线拆掉,让沉淀和配图正式并行,顺便把它俩的输入写清楚,各自依赖谁就写谁,别再笼统写一句上一步。至于那个双写入者,我打算把索引那块单独挪出来,让规则库回到只有一个写入者的状态。
真正拖慢一条流水线的,不在哪一步跑得慢,在图上那几条根本不该存在的线。
最后想问问你:你手上那条工作流里,有没有哪两步其实互不相干,只是你一直习惯先做完这个再做那个?评论区说说是哪两步,我挺好奇大家的假线都长在哪儿。