ONNX 模型库
返回模型

说明文档

chatglm3-6b-awq-w-int4-asym-gs128-a-fp16-onnx-ryzen-strix-hybrid

  • 简介

    本模型使用 AMD Quark 量化工具准备,并进行了必要的后处理。

  • 量化策略

    • AWQ / 组大小 128 / 非对称 / UINT4 权重 / FP16 激活
    • 排除层:无
  • 快速开始

如需快速入门,请参考 Ryzen AI 文档

评估分数

困惑度测量在 Hugging Face 提供的 wikitext-2-raw-v1(原始数据)数据集上进行。提示长度为 2k 时测得的困惑度分数为 29.7801。

许可证

修改版权所有 (c) 2024 Advanced Micro Devices,Inc. 保留所有权利。

根据 Apache 许可证 2.0 版("许可证")获得许可; 除非遵守本许可证,否则您不得使用本文件。 您可以在以下网址获取许可证副本:

http://www.apache.org/licenses/LICENSE-2.0

除非适用法律要求或书面同意,否则根据许可证分发的软件 是按"原样"分发的, 没有任何形式的明示或暗示的担保或条件。 请参阅许可证以了解管理权限和 限制的特定语言。

amd/chatglm3-6b-awq-g128-int4-asym-fp16-onnx-hybrid

作者 amd

↓ 1 ♥ 0

创建时间: 2024-11-25 19:24:01+00:00

更新时间: 2025-06-23 21:34:17+00:00

在 Hugging Face 上查看

文件 (14)

.gitattributes
README.md
chatglm3_v4_npu_jit.bin
chatglm3_v4_npu_jit.onnx ONNX
chatglm3_v4_npu_jit.onnx.data
chatglm3_v4_npu_jit.pb.bin
config.json
genai_config.json
rai_config.json
special_tokens_map.json
tokenization_chatglm.py
tokenizer.json
tokenizer.model
tokenizer_config.json