返回模型
说明文档
whisper-large-v3-turbo-onnx-fp16
这是 openai/whisper-large-v3-turbo 的 FP16 ONNX 版本。
模型详情
- 基础模型: openai/whisper-large-v3-turbo
- 格式: ONNX (FP16)
- 架构: arm64
大小对比
| 版本 | 大小 |
|---|---|
| 基础 ONNX (FP32) | 4198.51 MB |
| FP16 ONNX | 2099.54 MB ← |
| INT8 量化 ONNX | 1459.58 MB |
| 压缩比 | 2.00x |
使用方法
from optimum.onnxruntime import ORTModelForSpeechSeq2Seq
from transformers import AutoProcessor
model = ORTModelForSpeechSeq2Seq.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-fp16")
processor = AutoProcessor.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-fp16")
kostasang/whisper-large-v3-turbo-onnx-fp16
作者 kostasang
optimum
↓ 1
♥ 0
创建时间: 2026-02-05 23:49:05+00:00
更新时间: 2026-02-05 23:52:11+00:00
在 Hugging Face 上查看文件 (15)
.gitattributes
README.md
added_tokens.json
config.json
decoder_model.onnx
ONNX
decoder_with_past_model.onnx
ONNX
encoder_model.onnx
ONNX
generation_config.json
merges.txt
normalizer.json
preprocessor_config.json
special_tokens_map.json
tokenizer.json
tokenizer_config.json
vocab.json