Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
Qwen3.5-122B-A10B-GGUF – AI Model by grapeV-ai | AlphaNeural AI
You can deploy this model and start earning money today!
grapeV-ai
/
Qwen3.5-122B-A10B-GGUF
like
0
gguf
apache-2.0
endpoints_compatible
us
conversational
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
What is this?
Alibaba Cloudの思考&非思考ハイブリッド型MoEモデル
Qwen3.5-122B-A10B
をGGUFフォーマットに変換したものです。
非思考モードの需要が高いことを鑑み、デフォルトでは非思考モデルとしてふるまうようにchat_templateを変更しています。
imatrix dataset
日本語能力を重視し、日本語が多量に含まれる
TFMC/imatrix-dataset-for-japanese-llm
データセットを使用しました。
Quants
各クオンツのベンチマーク測定結果(API版Gemma3 27B採点によるElyza_tasks 100)をまとめておきます。
思考なし
クオンツ
スコア
コメント
Q8_0
4.59
Q6_K
4.6
Q5_K_M
4.58
Q4_K_M
4.535
IQ4_XS
4.71
推奨
MXFP4_MOE
4.62
思考あり
調査中
Note
llama.cpp-b8226以前と合わせてのご利用を推奨します。
なぜなら、llama.cpp-b8227以降はチャットテンプレートを無視して思考を開始させてしまうからです。
また、
-mm mmproj-Qwen3.5-122b-BF16.gguf
でビジョンエンコーダーをロードし、Vision対応モデルとして使用することができます。
Environment
Windows版llama.cpp-b8226およびllama.cpp-b8145同時リリースのconvert-hf-to-gguf.pyを使用して量子化作業を実施しました。
License
Apache 2.0
Developer
Alibaba Cloud