Quantized LLama-based Models
Collection
llama based models quantized to various precisions • 6 items • Updated
Configuration Parsing Warning:In config.json: "quantization_config.modules_to_not_convert" must be an array
This model is optimized for peformance on the Nvidia Jetson Orin Nano.
Base model
meta-llama/Llama-3.2-1B-Instruct