Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
GLM-4.7-Flash-18B-A3B-GGUF – AI Model by lovedheart | AlphaNeural AI
You can deploy this model and start earning money today!
lovedheart
/
GLM-4.7-Flash-18B-A3B-GGUF
like
0
gguf
text-generation-inference
zai-org/GLM-4.7-Flash
quantized
mit
endpoints_compatible
us
conversational
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
GLM-4.7-Flash-18B-A3B is a pruned version of GLM-4.7-Flash. Focus on: math, physics, control engineering and academic writing.
Quantization details
Embedding, Attention, Dense FFN Layer, Shared Experts and Output tensors are guarnateed to use full precision (BF16) for all quantized variants.