Owen Reed
owenreed
AI & ML interests
Efficient LLM inference, KV cache optimization, quantization, speculative decoding, model pruning
Recent Activity
liked a model about 2 hours ago
xformAI/opt-6.7b-ub-16-qcqa-best-for-KV-cache liked a model about 2 hours ago
xformAI/facebook-opt-125m-qcqa-ub-6-best-for-KV-cache liked a model about 2 hours ago
Yi30/inc-tp16-ep16-full-bf16-kvcacheOrganizations
None yet