Quantization made by Richard Erkhov.
gemma-2-2b-jpn-it - bnb 8bits
Original model description:
library_name: transformers
license: gemma
base_model:
オリジナルのgoogle/gemma-2-2b-jpn-itを用いてvLLMを使用する際に存在する問題を解消するため、設定ファイルに軽微な変更のみを加えたモデルです(追加訓練やマージなどモデルパラメータの操作はしていません)。
具体的な変更点: config.hidden_act = config.hidden_activation