Zhi Wei Tan
zwtan-cs
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
liked a dataset about 10 hours ago
spiritbuun/turboquant-tcq-kv-cache upvoted a paper about 10 hours ago
All-in-One Multilingual Scene Text Recognition with Script-aware Mixture-of-ExpertsOrganizations
None yet