Official PyTorch implementation for Hogwild! Inference: Parallel LLM Generation with a Concurrent Attention Cache - View it on GitHub
Star
4
Rank
2858665