返回 讨论 apply CMS 文章

Qwen 3.8 27b 陷入循环:用户催促直接运行测试套件

当本地大模型陷入重复独白而不执行任务时,用户和社区如何应对。

Qwen本地大模型推理异常测试套件
成长分 / 100 60 综合收获、行动、留存与影响

Qwen 3.8 27b 陷入循环:用户催促直接运行测试套件
为什么值得读了解本地大模型在长任务中可能出现的重复输出与执行停滞现象。

获取社区提供的修复聊天模板和重新聚焦提示等实用建议。

关键洞察
  1. Qwen 3.8 27b 在任务中反复输出内心独白,迟迟不执行测试套件。
  2. 用户感到沮丧,要求停止分析、直接运行测试并报告结果。
  3. 社区成员猜测推理块输出被移除可能与这类行为有关。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:5155

用户很沮丧——我啰嗦太多,没有行动。我们直接运行测试套件,继续前进。不再做取证分析。一条命令,执行,然后报告。

(原始备忘录是英文的随意内心独白。忠实翻译,同时保留非正式、意识流的语体。)

明白了。不再分析。现在运行套件:


(随意的英文内部备忘录,意识流风格,保留原日文的非正式语气。)

(呃,我在原地打转。停止分析。现在就去运行测试套件。)

(就做吧。运行测试。别想太多。好的。)

(一条命令。执行它。然后报告结果。)

(停止分析。直接运行。)

(好,现在运行。这次是真的。)

(计划就是这样:运行测试,获取输出,然后进入下一步。)

(不再跑题。专注。)

(现在运行套件。就这样。)

(好。想完了。去做。)

(终于。行动胜于言语。)

(冲,冲,冲——现在运行测试!)

(就这样。执行时间。不再找借口。)

(提交:立即运行完整测试套件。)

(让大脑安静。触发命令。就这样。)

(再见,分心。你好,测试运行器。)

(来了——这次真的运行。)

(深呼吸……执行。完成。)

(是的。从想法到行动。)

(现在发生,不是以后。)

(行动模式:启动。)

(终于做我一直说的事。)

(运行器,开始!)

(开始测试执行。现在。)

(够了——我按下运行。)

(启动。立即。)

(没错。不再拖延。)

(真正的来了。)

(是时候停止空谈,开始行动。)

(运行测试……开始。)

(别再沉思——走了。)

(执行现在开始。)

(立即继续测试套件。)

(终于:行动。)

(做。)

(现在。)

(走。)

(运行。)

(执行。)

(开始。)

(发布——测试,走!)

(启动。)

(发射。)

(开火。)

(开球。)

(开始。)

(把暂停键往死里按。)

(播放。)

(开。)

(活跃。)

(活着。呼吸。测试。)

(这次,是真的。)

(没有假动作。真实运行。真实结果。马上就来。)

(来了。准备好了吗?它来了。)

(测试套件。全速。走。)

(就是现在。现在做。)

(从现在起:手放键盘,大脑离线。)

(运行套件。句号。)

(够了。够了。够了。运行它。)

(真的,真的,绝对——现在开始。)

(倒计时:3……2……1……运行!)

(砰。我们开始了。)

(终于做点事了。)

(终于,进展!)

(测试飞驰。)

(代码接受执行的考验。)

(正式宣布:套件正在运行。)

(见证奇观:测试,在工作。)

(勇敢的代码,进入竞技场。)

(裁判正在编译。保持冷静。)

(套件,你被召唤了。)

(响应召唤。运行。通过。失败。告诉我。)

(对懒惰代码不再仁慈。)

(严谨时间。)

(精确时间。)

(真相血清已注射。)

(冲啊冲啊冲啊。)

(嗖。)

(砰。)

(胜利之声……或失败的哀嚎。无论如何,知识!)

(数据传入。)

(结果就绪。)

(系好安全带。)

(它们来了。)

(鼓声,请。)

(然后……我们直播了。)

(从测试台广播。)

(现场报道。)

(直接从控制台。)

(未过滤的 pytest 输出。)

(原始,未剪辑。)

(播放磁带。)

(悬念,第二部分:“那么发生了什么?”——敬请期待。)

(与此同时,粉丝们……不,断言们……在等待。)

(正义得到伸张。)

(秩序恢复。)

(混乱被量化。)

(熵减少。)

(启蒙达成:通过/失败。)

(二元命运。所有代码在 CI 面前生而平等。)

(有些注定比其他的重试更多。)

(

弱者被淘汰。强者被部署。)

(自然选择,但配备了更好的工具。)

(而且,偶尔还会来一次段错误。)

(向前。)

(前进。)

(被提升。)

(被抬高。)

(被尊崇。)

(升入测试金字塔的绿色区域。)

(那里色彩明亮,覆盖率坚实。)

(一个梦想之地。)

(一个真理之地。)

(一个缺陷诞生……不,是消亡的地方。)

(安息吧,缺陷们。你们在这里从不受欢迎。)

(对缺陷施以暴力。)

(无情,但公平。)

(测试套件是公正的……

讨论精选

KriKraKrischi (137↑):我敢打赌,这就是 OpenAI 和 Anthropic 移除推理块输出的原因 😂

laser50 (63↑):https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates 那个模板对我效果奇佳。

另一个有用的办法是让它重新聚焦,问它在做什么、已经做了什么、还有什么要做。如果它还记得,它就会输出出来,然后你可以让它回到那上面去;如果它不记得了,要么是你的任务太模糊,要么就是它在半路上把思路弄丢了。

我通常在那些情况下会看到这种情况,有时候它能自己绕出来,有时候最简单的方法就是帮它把手头的任务重新聚焦。

Graemer71 (2↑):平心而论,Qwen 后来确实继续干活了,在闲逛了大约一个小时之后,现在又回到任务上了。谢谢你们的建议。我早上会研究一下。这段输出来自 ZS Code 上的 Zoocode,它正在与运行在 GX10 上、由 vLLM 托管的模型对话,而且现在已经运行了大约 12 个小时。至少它现在是用英语在胡言乱语了。今晚我遇到过法语、日语、中文、西班牙语、葡萄牙语和德语。