返回模型
说明文档
chatglm3-6b
-
简介
本模型使用 Quark 量化创建,随后经过 OGA 模型构建器处理,并完成 NPU 部署的后处理。
-
量化策略
- AWQ / 组大小 128 / 非对称 / BF16 激活值 / UINT4 权重
-
快速入门
快速入门请参考 Ryzen AI 文档
评估分数
困惑度测量在 Hugging Face 提供的 wikitext-2-raw-v1(原始数据)数据集上运行。提示长度为 2k 时测得的困惑度分数为 29.81679。
许可证
修改版权所有 (c) 2024 Advanced Micro Devices, Inc. 保留所有权利。
根据 Apache 许可证 2.0 版本("许可证")获得许可; 除非遵守本许可证,否则您不得使用本文件。 您可以在以下位置获取许可证副本:
http://www.apache.org/licenses/LICENSE-2.0
除非适用法律要求或书面同意,否则根据许可证分发的软件是按"原样"分发的, 没有任何明示或暗示的担保或条件。 请参阅许可证以了解管理权限和限制的特定语言。
amd/Llama-3.1-8B-onnx-ryzenai-hybrid
作者 amd
↓ 1
♥ 0
创建时间: 2025-09-28 19:26:16+00:00
更新时间: 2025-10-23 15:39:15+00:00
在 Hugging Face 上查看文件 (12)
.gitattributes
README.md
config.json
genai_config.json
model_jit.bin
model_jit.onnx
ONNX
model_jit.onnx.data
model_jit.pb.bin
rai_config.json
special_tokens_map.json
tokenizer.json
tokenizer_config.json