ONNX 模型库
返回模型

说明文档

whisper-large-v3-turbo-onnx-fp16

这是 openai/whisper-large-v3-turbo 的 FP16 ONNX 版本。

模型详情

大小对比

版本 大小
基础 ONNX (FP32) 4198.51 MB
FP16 ONNX 2099.54 MB ←
INT8 量化 ONNX 1459.58 MB
压缩比 2.00x

使用方法

from optimum.onnxruntime import ORTModelForSpeechSeq2Seq
from transformers import AutoProcessor

model = ORTModelForSpeechSeq2Seq.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-fp16")
processor = AutoProcessor.from_pretrained("kostasang/whisper-large-v3-turbo-onnx-fp16")

kostasang/whisper-large-v3-turbo-onnx-fp16

作者 kostasang

optimum
↓ 1 ♥ 0

创建时间: 2026-02-05 23:49:05+00:00

更新时间: 2026-02-05 23:52:11+00:00

在 Hugging Face 上查看

文件 (15)

.gitattributes
README.md
added_tokens.json
config.json
decoder_model.onnx ONNX
decoder_with_past_model.onnx ONNX
encoder_model.onnx ONNX
generation_config.json
merges.txt
normalizer.json
preprocessor_config.json
special_tokens_map.json
tokenizer.json
tokenizer_config.json
vocab.json