Configuration Parsing Warning:In config.json: "quantization_config.modules_to_not_convert" must be an array

Created using Olive-AI: olive optimize --model_name_or_path nvidia/Riva-Translate-4B-Instruct --output_path models/riva_onnx --precision int4 --block_size 64

Downloads last month
7
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for TrentB/Riva-Translate-4B-Instruct-ONNX

Quantized
(8)
this model