Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
meta-llama.Llama-2-70b-chat-hf_W8A8_FP8 – AI Model by espressor | AlphaNeural AI
You can deploy this model and start earning money today!
espressor
/
meta-llama.Llama-2-70b-chat-hf_W8A8_FP8
like
0
transformers
safetensors
llama
text-generation
conversational
HuggingFaceH4/ultrachat_200k
meta-llama/Llama-2-70b-chat-hf
quantized
autotrain_compatible
text-generation-inference
endpoints_compatible
compressed-tensors
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
meta-llama/Llama-2-70b-chat-hf - W8A8_FP8 Compression
This is a compressed model using
llmcompressor
.
Compression Configuration
Base Model: meta-llama/Llama-2-70b-chat-hf
Compression Scheme: W8A8_FP8
Dataset: HuggingFaceH4/ultrachat_200k
Dataset Split: train_sft
Number of Samples: 512
Preprocessor: chat
Maximum Sequence Length: 4096
Sample Output
Prompt:
Could not generate output
Output:
No CUDA GPUs are available
Evaluation