Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
2026.TA.gemma2_2b_tc8192_decb_l1w0.001_tarbb_lb2.0_ln1_dr20000_lr8e-04_bs4_sl14793860 – AI Model by siddharthmb | AlphaNeural AI
You can deploy this model and start earning money today!
siddharthmb
/
2026.TA.gemma2_2b_tc8192_decb_l1w0.001_tarbb_lb2.0_ln1_dr20000_lr8e-04_bs4_sl14793860
like
0
transformers
safetensors
gemma2
transcoder-adapters
sparse-adaptation
bridging
siddharthmb/2026.transcoder-adapters.lmsys-chat-1m-splits
google/gemma-2-2b
finetune
text-generation-inference
endpoints_compatible
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
2026.TA.gemma2_2b_tc8192_decb_l1w0.001_tarbb_lb2.0_ln1_dr20000_lr8e-04_bs4_sl14793860
Sparse transcoder adapter trained with
bridging
mode.
Model Details
Base model
:
google/gemma-2-2b
Reference model
:
google/gemma-2-2b-it
Architecture
: gemma2
Training mode
: bridging
Tokenizer
:
google/gemma-2-2b-it
Training config
:
training-config.yaml
GitHub
:
https://github.com/Sid-MB/transcoder-adapters
W&B run
:
https://wandb.ai/siddharth-stanford/sparse-adaptation/runs/lfwst54h
Transcoder Configuration
n_features
: 8192
dec_bias
: True
l1_weight
: 0.001
Training
Learning rate
: 0.0008
Batch size
: 4
Epochs
: 1
Warmup ratio
: 0.05
Loss type
: kl
lambda_adapt
: 1.0
lambda_bridge
: 2.0
lambda_nmse
: 1
n_cutoffs
: 1
backbone
: target
Training Data
siddharthmb/2026.transcoder-adapters.lmsys-chat-1m-splits