返回模型
说明文档
ET5 拼写纠正器(ONNX INT8 量化版)
基于 j5ng/et5-typos-corrector 的韩语拼写错误和口语表达纠正器。
模型信息
| 属性 | 值 |
|---|---|
| 基础模型 | j5ng/et5-typos-corrector |
| 架构 | ET5(编码器-解码器) |
| 任务 | 文本到文本生成(韩语拼写纠正) |
| 格式 | ONNX |
| 量化 | INT8(动态) |
| 大小 | 总计约 740MB |
文件
et5-q8/
├── config.json
├── generation_config.json
├── quantize_config.json
├── special_tokens_map.json
├── tokenizer.json
├── tokenizer_config.json
├── spiece.model
└── onnx/
├── encoder_model_quantized.onnx
├── decoder_model_quantized.onnx
├── decoder_with_past_model_quantized.onnx
└── decoder_model_merged_quantized.onnx
使用 transformer.js
import { pipeline } from "@huggingface/transformers";
const corrector = await pipeline(
"text2text-generation",
"your-username/et5-typos-corrector-onnx-q8",
{ dtype: "q8" }
);
// 拼写纠正
const result = await corrector("안녕하세욧", { max_new_tokens: 128 });
console.log(result[0].generated_text); // "안녕하세요"
// 口语转正式
const result2 = await corrector("오늘 뭐함?", { max_new_tokens: 128 });
console.log(result2[0].generated_text); // "오늘 뭐해?"
性能
| 后端 | 拼写纠正 | 口语纠正 |
|---|---|---|
| WASM | 约 350ms | 约 780ms |
| WebGPU | 不支持(INT8) | - |
转换
使用 Optimum 创建:
# ONNX 导出
optimum-cli export onnx --model j5ng/et5-typos-corrector \
--task text2text-generation ./et5-onnx
# INT8 量化
optimum-cli onnxruntime quantize \
--onnx_model ./et5-onnx \
-o ./et5-q8
许可证
与基础模型相同:j5ng/et5-typos-corrector
致谢
- 原始模型由 j5ng 开发
- 为 IWE(集成写作环境) 进行 ONNX 转换
hueyjeong/et5-typos-corrector-onnx-q8
作者 hueyjeong
↓ 1
♥ 0
创建时间: 2026-02-09 04:57:13+00:00
更新时间: 2026-02-09 05:05:33+00:00
在 Hugging Face 上查看文件 (13)
.gitattributes
README.md
config.json
generation_config.json
onnx/decoder_model_merged_quantized.onnx
ONNX
onnx/decoder_model_quantized.onnx
ONNX
onnx/decoder_with_past_model_quantized.onnx
ONNX
onnx/encoder_model_quantized.onnx
ONNX
quantize_config.json
special_tokens_map.json
spiece.model
tokenizer.json
tokenizer_config.json