COMMITS
/ examples/qualcomm/oss_scripts/llama/llama.py May 15, 2025
J
Refactor quantize.py functions to remove args
Jack committed
April 16, 2025
C
Qualcomm AI Engine Direct - Add block quantization to llama (#10225)
Chun-I Tsai committed
April 2, 2025
S
Qualcomm AI Engine Direct - Add QNN support for to_edge_transform_and_lower (#9643)
shewu-quic committed
C
fix qnn export
cccclai committed
March 31, 2025
M
Fix QNN CI job (#9774)
Mengwei Liu committed
March 13, 2025
S
Qualcomm AI Engine Direct - Optimize the performance for AR-N model (#9079)
shewu-quic committed
March 4, 2025
W
Qualcomm AI Engine Direct - Meta CI for Mobilebert , W2L, and Llama (#8616)
winskuo-quic committed
February 25, 2025
February 21, 2025
C
fix export llama to qnn
cccclai committed
February 19, 2025
W
Qualcomm AI Engine Direct - CI For Llama (#8512)
winskuo-quic committed
February 11, 2025
W
Qualcomm AI Engine Direct - CI for QNN Static Stories Llama (#7884)
winskuo-quic committed
W
Qualcomm AI Engine Direct - Fix Argmin (#8308)
winskuo-quic committed
February 7, 2025
L
Add a parameter to output delegate summary in llama export
Limin Tang committed
February 3, 2025
L
Refactor and add Llama Python library build (#8107)
Limin Tang committed
S
Qualcomm AI Engine Direct - Add 4-bit Embedding Quantization Option (#7691)
shewu-quic committed
January 30, 2025
C
Qualcomm AI Engine Direct - Add smart mask kv updator for llama3.2
Chun-I Tsai committed
January 29, 2025
January 23, 2025
January 18, 2025
W
Qualcomm AI Engine Direct - Unify Llama2&Llama3 and Small Accuracy Improvement. (#7618)
winskuo-quic committed