ONNX 模型库
返回模型

说明文档


license: llama3.2

Llama 3.2 Instruct 模型的 ONNX 版本,已量化用于在 Snapdragon 8 Elite NPU 上进行推理。

Jeethu/Llama-3.2-3B-Instruct-8-Elite-NPU

作者 Jeethu

↓ 1 ♥ 1

创建时间: 2024-11-16 16:46:26+00:00

更新时间: 2024-11-16 17:19:58+00:00

在 Hugging Face 上查看

文件 (21)

.gitattributes
README.md
config.json
dequantizer.onnx ONNX
genai_config.json
llama_v3_2_3b_chat_quantized_part_1_of_3.bin
llama_v3_2_3b_chat_quantized_part_2_of_3.bin
llama_v3_2_3b_chat_quantized_part_3_of_3.bin
metadata.json
position-processor.onnx ONNX
position-shifter.onnx ONNX
prompt_1_of_3_qnn_ctx.onnx ONNX
prompt_2_of_3_qnn_ctx.onnx ONNX
prompt_3_of_3_qnn_ctx.onnx ONNX
quantizer.onnx ONNX
special_tokens_map.json
token_1_of_3_qnn_ctx.onnx ONNX
token_2_of_3_qnn_ctx.onnx ONNX
token_3_of_3_qnn_ctx.onnx ONNX
tokenizer.json
tokenizer_config.json