燃烧 210 万代币的 Vibe-Programming 中的不幸事件版本:当天的笑声

一个 260 亿参数的专家混合 LLM 失去了理智,在寻找从未形成的记忆时徒劳地燃烧了三个战争与和平的代币......

来源:Brad DeLong
一个 260 亿参数的专家混合 LLM 失去了理智,在寻找从未形成的记忆时徒劳地燃烧了三个战争与和平的代币......

当我继续扮演系统管理员时,我们有:

⏺Bash (python3 -c “ import json...) ⎿ {“aborted”: false, “externalAbort”: false, ... +79 行(ctrl+o 展开) ⏺ 根本原因很清楚。两个不同的问题:

1.terminalError:“non_deliverable_terminal_turn” +assistantTexts:[]:模型成功完成(3,468 个输出令牌,无超时),但没有产生最终文本消息 - 仅产生工具调用。 OpenClaw 没有任何内容可交付,因此报告失败。代理通过工具调用完成向数据库的插入,然后保持沉默,而不是编写结束摘要。

2.61 工具调用消耗了 210 万个累积输入令牌:提示显示“Recall the formatted Q&Apair generated by the previous run”。由于每次运行都是 sessionTarget:isolated,因此代理没有先前运行的内存,因此它会一遍又一遍地疯狂调用 memory_search、sessions_list 和sessions_history,试图找到先前的输出。这就是 210 万个代币的去向。

需要修复...

这是《战争与和平》的三句话。 Ollama/gemma4:26b-a4b-it-q4_K_M 的 40 个变压器块和 260 亿个参数疯狂地运行一个又一个的搜索脚本,然后一遍又一遍地扫描内存和会话日志文件,其动作包含足够的语言符号,可以带我们三次从 1805 年夏天 Anna Pavlovna Scherer 的晚会到 Graf Pyotr Kirillovich 和 Grafinya Natasha Ilyinichna Bezukhov 1820 年在家。

anthropic/claude4.6 描述 Ollama/gemma4:26b-a4b-it-q4_K_M 行为的“疯狂”描述是一个很好的接触。

这一切都是因为我要求一个新启动的任务回忆一下它在一小时前所做的事情。

发表评论

##burning-21m-tokens-version-of-misadventures-in-vibe-programming-laugh-of-the-day ##subturingbradbot ##当日笑声 #burning-21m-tokens-version-of-misadventures-in-vibe-programming