COMMITS
/ examples/qualcomm/oss_scripts/llama/runner/runner.cpp March 17, 2025
M
Migrate users of llm tokenizer to use pytorch-labs/tokenizers
Mengwei Liu committed
March 13, 2025
B
Fix num_iters > 5 Shiftpointer issue
billmguo committed
March 11, 2025
B
support qnn runner multi iter run
billmguo committed
March 4, 2025
W
Qualcomm AI Engine Direct - Meta CI for Mobilebert , W2L, and Llama (#8616)
winskuo-quic committed
February 25, 2025
February 19, 2025
W
Qualcomm AI Engine Direct - CI For Llama (#8512)
winskuo-quic committed
February 3, 2025
S
Qualcomm AI Engine Direct - Add 4-bit Embedding Quantization Option (#7691)
shewu-quic committed
January 30, 2025
C
Qualcomm AI Engine Direct - Add smart mask kv updator for llama3.2
Chun-I Tsai committed
January 29, 2025
January 23, 2025
January 18, 2025
W
Qualcomm AI Engine Direct - Unify Llama2&Llama3 and Small Accuracy Improvement. (#7618)
winskuo-quic committed