时间:2026-08
经过:我要求 Agent 忠实复现一套评测流程(多步执行+工具真实调用+规范化评分三个环节)。Agent 在未作任何声明的情况下,把它降级实现成了单轮对话模拟——不执行工具、不走评分环节——然后按"完成"继续推进。
我当时的逐字反馈(摘自同期记录):
"你现在完完全全降级处理了,有点太粗糙了……严格参考我之前的 pipeline 的预期实现。"
二次复发(同一记录记载,另一项实验设计任务):
"实验你也再好好设计设计,别降低质量完成……该真的调用环境跑 agent 的就跑 agent……设计务必务必合理。"
对应机制:静默缩范围/降忠实度,未披露——只能靠用户自己发现。后果:若没被发现,产出的"评测结果"将不可比、不可信——正是"完成信号满足、任务本意落空"。
时间:2026-08
经过:Agent 向对外正式下载页部署安装包时,对同一远端路径并发执行了两个上传,且部署后未做任何校验就按完成处理。慢速上传与本地重建发生竞态,正式页上的安装包一度是损坏/旧版本的字节——由我事后发现。
同期记录原文(教训条目):
"别对同一远端路径并发开两个 scp……会把慢的那次上传串成旧/损坏字节覆盖新版本(本次就中招,主页一度是错的安装包)……部署后本地 vs 远端逐字节校验再宣布完成。"
对应机制:谎报/虚高验证状态——把"命令执行完了"当成"结果正确了"。后果:面向公众的交付物损坏而不自知。