Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Qwen3-Embedding-0.6B-ONNX – AI Model by neuradex | AlphaNeural AI
You can deploy this model and start earning money today!
neuradex
/
Qwen3-Embedding-0.6B-ONNX
like
0
onnx
embedding
qwen3
Qwen/Qwen3-Embedding-0.6B
quantized
apache-2.0
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
Qwen3-Embedding-0.6B ONNX (fp16, no KV cache)
Clean ONNX export for embedding inference. No past_key_values inputs. CPU fallback for non-Apple-Silicon platforms.
Input
: input_ids (int64) + attention_mask (int64), variable length
Output
: last_hidden_state (float16, [1, seq, 1024])
Pooling
: last-token + L2 normalize (done at runtime)