Author
Faraz Masood
Recent research
- AI & ComputingOpen access
Efficient retrieval-augmented generation via multi-signal token compression
Retrieval-augmented generation (RAG) improves question answering by grounding large language models in retrieved passages, but long contexts increase prompt-token cost and latency. We introduce HLLC, a deterministic, generator-agnostic framework that compresses corpus chunks duri...