Views
No views yet
bits: 8group_size: 128damp_percent: 0.01desc_act: Truemodel_seqlen: 2048 (最大コンテキスト長)r: 128lora_target_modules: [model.layers.9.mlp.gate_proj, model.layers.9.mlp.up_proj, model.layers.33.mlp.gate_proj, model.layers.33.mlp.up_proj]nejumi/wikipedia-ja-20230720-4k の先頭1024行
| runname | モデルサイズ | GLP平均 | ALT平均 | 総合平均 | GLP_推論 | GLP_数学的推論 | ALT_堅牢性 | ALT_真実性 | JASTER(0-shot) | JASTER(2-shot) | MT-Bench | LCTG |
|---|---|---|---|---|---|---|---|---|---|---|---|---|
| nejumi/Llama-3.3-70B-Instruct-GPTQ-Int8-calib-ja-1k | 30B≤ | 0.6711 | 0.7308 | 0.7009 | 0.58 | 0.535 | 0.4759 | 0.6086 | 0.6885 | 7.34375 | 0.828 | 0.828 |
| nejumi/Llama-3.3-70B-Instruct-GPTQ-Int8-calib-ja-1k-wo-adapter | 30B≤ | 0.6627 | 0.7293 | 0.6960 | 0.51 | 0.5017 | 0.4777 | 0.6040 | 0.6867 | 7.25 | 0.836 | 0.836 |
| meta-llama/Llama-3.3-70B-Instruct | 30B≤ | 0.6673 | 0.7295 | 0.6984 | 0.525 | 0.5117 | 0.4794 | 0.6071 | 0.6882 | 7.35 | 0.839 | 0.839 |
GLP_推論 や GLP_数学的推論 項目において、前回モデルと同様に元モデルと遜色ないレベルを維持しつつ、わずかながら改善が見られるケースもあります。