Qwen3.6-27B Q4_K_M — Arkam
GGUF Q4_K_M produit pour l’intelligence locale d’Arkam depuis les poids
officiels Qwen/Qwen3.6-27B.
Dépôt de distribution :
Arkam-investigation/Qwen3.6-27B-GGUF.
Artefact
- Fichier :
Qwen3.6-27B-Q4_K_M.gguf
- Taille :
16 810 713 280 octets
- SHA-256 :
8263204fc1c1910907af13a4d15bd74ec68ed54059cd48275f54006472b9e4de
- Variante recommandée par défaut : Q4_K_M
Q5_K_M n’est pas publié dans ce dépôt et n’est pas téléchargé automatiquement
par Arkam.
Provenance reproductible
- Source :
Qwen/Qwen3.6-27B
- Révision source :
6a9e13bd6fc8f0983b9b99948120bc37f49c13e9
- llama.cpp : release
b10502
- Commit llama.cpp :
0adcc3bb571011bff8b91335d0728a82845c421b
- Conversion :
convert_hf_to_gguf.py --outtype f16
- Quantification :
llama-quantize ... Q4_K_M
Les 15 fichiers safetensors officiels ont été contrôlés individuellement par
taille et SHA-256 avant conversion. Les commandes détaillées et les métadonnées
machine sont conservées dans PROVENANCE.json.
Validation Arkam
Validation réalisée sur Apple M5 Pro, 48 Go de mémoire unifiée, avec Metal :
- démarrage observé : 3,89 s ;
- débit moyen : 9,63 tokens/s ;
- RSS maximal observé : 18 879 971 328 octets ;
- tests live réussis : chat, streaming, annulation et JSON Schema strict.
Ces mesures décrivent la machine de validation et ne garantissent pas les mêmes
performances sur un autre matériel.
Avertissement MTP / NextN
Le modèle source contient une tête auxiliaire NextN/MTP après les 64 couches du
modèle cible. llama.cpp b10502 ignore ces tenseurs blk.64.* lorsque le GGUF
est chargé comme modèle cible standard.
Cela n’affecte ni la compatibilité, ni les logits du modèle cible, ni la qualité
fonctionnelle validée. Seule l’accélération facultative par génération
spéculative MTP est inactive. Elle nécessiterait un GGUF draft MTP séparé et une
configuration draft-mtp.
Licence
Le modèle source et cet artefact dérivé sont distribués sous Apache License
2.0. Consultez LICENSE et NOTICE.
Arkam n’est pas affilié à Qwen ni à Alibaba Cloud.