COMMITS
/ benchmarks/benchmark_fp6.py March 17, 2025
A
Add copyright header and pre-commit validator (#1900)
Apurva Jain committed
January 8, 2025
A
Lint benchmark folder (#1519)
Apurva Jain committed
November 4, 2024
T
BF16 support for Quant-LLM kernel (#1147)
Tobias van der Werff committed
October 10, 2024
A
Rename AQT#2 LayoutType -> Layout (#1049)
Apurva Jain committed
A
Aqt rename#1 Layout -> TensorImpl (#1046)
Apurva Jain committed
October 8, 2024
M
Revert "Rename Layout -> TensorImpl" (#1040)
Mark Saroufim committed
A
Rename Layout -> TensorImpl (#1028)
Apurva Jain committed
September 29, 2024
T
SM75 (Turing) support for FP6 kernel (#942)
Tobias van der Werff committed
September 25, 2024
T
Fix failing FP6 benchmark (#931)
Tobias van der Werff committed
September 12, 2024
J
Renaming fpx to floatx (#877)
Jerry Zhang committed
August 29, 2024
J
[reland] Refactor quant_llm to work with affine quantized tensor (#696) (#772)
Jerry Zhang committed
August 28, 2024
J
Revert "Refactor quant_llm to work with affine quantized tensor" (#767)
Jerry Zhang committed
J
Refactor quant_llm to work with affine quantized tensor (#696)
Jerry Zhang committed
June 4, 2024
T
Fix FP6-LLM benchmark (#312)
Thien Tran committed
May 14, 2024
T
Add FP16Act-FP6Weight Linear (#223)
Thien Tran committed