Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
RedHatAI
/
Llama-3.2-1B-Instruct-quantized.w8a8
like
8
Follow
Red Hat AI
2.86k
Text Generation
Safetensors
8 languages
llama
llama-3
neuralmagic
llmcompressor
conversational
8-bit precision
compressed-tensors
arxiv:
2211.10438
arxiv:
2210.17323
License:
llama3.2
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
Llama-3.2-1B-Instruct-quantized.w8a8
Commit History
Update README.md
c1dce56
verified
alexmarques
commited on
Oct 16, 2024
Updated compression_config to quantization_config
fb30d43
verified
mgoin
commited on
Oct 9, 2024
Update README.md
012b9c0
verified
alexmarques
commited on
Sep 26, 2024
Update README.md
e0f0220
verified
alexmarques
commited on
Sep 26, 2024
Update README.md
0c8a3b8
verified
alexmarques
commited on
Sep 26, 2024
Update README.md
0f03d3a
verified
alexmarques
commited on
Sep 26, 2024
Create README.md
111b268
verified
alexmarques
commited on
Sep 26, 2024
Upload folder using huggingface_hub
7f1db53
verified
alexmarques
commited on
Sep 25, 2024
initial commit
848afec
verified
alexmarques
commited on
Sep 25, 2024