alexwengg's picture
Add Encoder_v2.mlmodelc: int8-linear re-quantization fixing token corruption (FluidAudio#760) (#4)
7dd20fe
Raw
History Blame Contribute Delete
475 Bytes
{
"encoders": {
"Encoder.mlmodelc": {
"weight_format": "palettized_lut6_mixed_fp16",
"note": "original export; labeled int8 historically, actual compression is 6-bit LUT palettization"
},
"Encoder_v2.mlmodelc": {
"weight_format": "int8_linear_per_channel",
"source_precision": "fp16",
"fixes": "https://github.com/FluidInference/FluidAudio/issues/760"
},
"EncoderInt4.mlmodelc": {
"weight_format": "int4"
}
}
}