返回模型
说明文档
Qwen3-Embedding-0.6B-ONNX-Q8
Qwen3-Embedding-0.6B 的量化(uint8)版本,用于 HED-LSP 扩展。
模型详情
- 基础模型: Qwen/Qwen3-Embedding-0.6B
- ONNX 转换: onnx-community/Qwen3-Embedding-0.6B-ONNX
- 量化方式: uint8(8位整数)
- 大小: ~600 MB(对比完整模型的 7.8 GB)
使用方法
此模型被 HED-LSP VS Code 扩展 用于 HED 标签自动补全中的语义搜索。
import { pipeline } from '@huggingface/transformers';
const extractor = await pipeline('feature-extraction', 'neuromechanist/Qwen3-Embedding-0.6B-ONNX-Q8', {
dtype: 'q8',
});
许可证
Apache 2.0(与原始 Qwen 模型相同)
致谢
- Qwen 团队提供的原始嵌入模型
- ONNX 社区提供的 ONNX 转换
neuromechanist/Qwen3-Embedding-0.6B-ONNX-Q8
作者 neuromechanist
↓ 2
♥ 0
创建时间: 2025-12-29 07:40:30+00:00
更新时间: 2025-12-29 07:40:53+00:00
在 Hugging Face 上查看文件 (10)
.gitattributes
README.md
added_tokens.json
config.json
merges.txt
onnx/model_uint8.onnx
ONNX
special_tokens_map.json
tokenizer.json
tokenizer_config.json
vocab.json