ONNX 模型库
返回模型

说明文档

amd/Qwen2-1.5B-awq-uint4-asym-global-g128-lmhead-g32-fp16-onnx-hybrid

  • 简介

    该模型使用 AMD Quark 量化工具准备,并进行了必要的后处理。

  • 量化策略

    • AWQ / 组大小 128 / 非对称 / UINT4 权重 / FP16 激活
    • 排除层:无
  • 快速开始

如需快速开始,请参考 Ryzen AI 文档

评估分数

困惑度测量在 Hugging Face 提供的 wikitext-2-raw-v1(原始数据)数据集上进行。提示长度为 2k 时测得的困惑度分数为 11.123。

许可证

修改版权所有 (c) 2024 Advanced Micro Devices, Inc. 保留所有权利。

MIT 许可证

版权所有 (c) 2024 Advanced Micro Devices, Inc

特此免费授予任何获得本软件副本及相关文档文件(以下简称"软件")的人不受限制地处理本软件的权利,包括但不限于使用、复制、修改、合并、发布、分发、再许可和/或销售软件副本的权利,以及允许获得软件的人员这样做的权利,但须符合以下条件:

上述版权声明和本许可声明应包含在软件的所有副本或主要部分中。

本软件按"原样"提供,不附带任何形式的明示或暗示的担保,包括但不限于适销性、特定用途适用性和非侵权性的担保。在任何情况下,作者或版权持有人均不对任何索赔、损害或其他责任负责,无论是在合同诉讼、侵权行为还是其他方面,由本软件或本软件的使用或其他交易引起、与之相关或与之相关。

根据 Apache 许可证 2.0 版(以下简称"许可证")授权; 除非遵守许可证,否则您不得使用本文件。 您可以在以下网址获取许可证副本:

http://www.apache.org/licenses/LICENSE-2.0

除非适用法律要求或书面同意,否则根据许可证分发的软件是按"原样"分发的,没有任何形式的明示或暗示的担保或条件。请参阅许可证以了解许可证下的特定语言管理权限和限制。

amd/Qwen2-1.5B-awq-uint4-asym-global-g128-lmhead-g32-fp16-onnx-hybrid

作者 amd

↓ 1 ♥ 0

创建时间: 2025-03-02 18:32:23+00:00

更新时间: 2025-06-23 21:39:28+00:00

在 Hugging Face 上查看

文件 (15)

.gitattributes
README.md
added_tokens.json
config.json
genai_config.json
merges.txt
qwen2_1.5B_jit.bin
qwen2_1.5B_jit.onnx ONNX
qwen2_1.5B_jit.onnx.data
qwen2_1.5B_jit.pb.bin
rai_config.json
special_tokens_map.json
tokenizer.json
tokenizer_config.json
vocab.json