COMMITS
/ examples/qualcomm/oss_scripts/llama/model/static_llama.py March 13, 2025
S
Qualcomm AI Engine Direct - Optimize the performance for AR-N model (#9079)
shewu-quic committed
March 4, 2025
N
fix head_dim in metadata
Naveen Suda committed
March 3, 2025
S
Fix static_llama to read some previously hardcoded options from ModelArgs
Shen Chen Xu committed
February 25, 2025
February 3, 2025
S
Qualcomm AI Engine Direct - Add 4-bit Embedding Quantization Option (#7691)
shewu-quic committed
January 29, 2025
January 23, 2025
January 18, 2025
W
Qualcomm AI Engine Direct - Unify Llama2&Llama3 and Small Accuracy Improvement. (#7618)
winskuo-quic committed