llmlingua-2-xlm-roberta-large-meetingbank-onnx-int8
Dynamic-quantized ONNX INT8 export for CPU inference.
Source model: microsoft/llmlingua-2-xlm-roberta-large-meetingbank
Exported with Optimum ONNX Runtime and dynamic INT8 quantization for CPU inference.