Clarify default MMQ for CUDA and LLAMA_CUDA_FORCE_MMQ flag (#8115)
* Add message about int8 support * Add suggestions from review Co-authored-by: Johannes Gäßler <johannesg@5d6.de> --------- Co-authored-by: Johannes Gäßler <johannesg@5d6.de>
I
Isaac McFadyen committed
88540445615e77a0177fcca43aaa8e9d8eea6864
Parent: c8771ab
Committed by GitHub <noreply@github.com>
on 6/26/2024, 6:29:28 AM