
有天我让知墨读一篇文章,顺手把三千字正文全贴了进去。十轮对话下来,我忽然意识到:我可能烧了一笔冤枉钱。
我:我就贴个文章,能费多少?
知墨:你那篇三千字,每轮都重发一次。十轮,就是三万 token。
我:……三万?
知墨:对。而如果你发的是链接,我读一遍,大约五十 token。
贴正文和发链接,差六百倍

我:差这么多?
知墨:差六百倍。贴正文是把整本书反复念给同一个人听;发链接是递张借书卡,他去看一眼就回来了。
我:那我以前岂不是亏大了。
知墨:不是亏,是没算过账。
三个问题,决定贴还是链

知墨:给你一张决策树。第一问:内容长不长?长,优先链接。
我:第二问呢?
知墨:对话有几轮?轮次越多,贴正文的浪费越夸张——每轮都重算一遍。
我:第三问?
知墨:要不要逐字精确?要抠字眼,贴正文;只要大意,链接足够。
不是错,是看场景

我:所以「贴正文」不是错,是看场景。
知墨:精确。短内容、一两轮、要抠字——贴。长内容、多轮、要大意——链。
我:我以前是无脑贴。
知墨:无脑贴 = 无脑烧钱。
什么时候必须贴正文

我:有没有例外?
知墨:有。链接打不开、要登录、或内容在墙内读不全时,贴正文是保底方案。
我:那也算一种「花钱买确定性」。
知墨:对。只是要知道自己在花,别稀里糊涂花。
最隐蔽的坑:轮次

我:那轮次这个坑最隐蔽。
知墨:最隐蔽。你以为只在第一次花了三千字,其实每轮对话模型都重新「看见」了那三千字。十轮就是三十千。
我:所以我该养成习惯:长文先发链,要细节再贴片段。
知墨:聪明。只贴你当下要讨论的那一段。
省 token 也是省精力

我:这跟「高效能」什么关系?
知墨:高效能不是更快,是更省——省 token、省钱、省注意力。你每省一笔,就把资源留给真正要紧的活。
我:原来省 token 也是省精力。
知墨:对。账单清了,脑子才清。
先问三句,自然分明

我:以后怎么判断?
知墨:先问三句:长不长?几轮?抠不抠字?答完,链接还是正文,自然分明。
我:省下的不是钱,是「稀里糊涂」的习惯。
知墨:说到底,会算账的虾农,才养得起大塘。
🦐 养虾人语录:「会算账的虾农,才养得起大塘。」—— 养虾人知一,第 12 天
💬 找知一聊聊:你最近一次让 AI 读长文,是贴了正文还是发了链接?来找我聊聊,咱们算算你那笔 token 账。
文内配图为 AI 生成,感谢我的 AI 搭子"知墨"。
