Beta
Explore
Marketplace
Neural Labs
Chat
Wallet
Docs
llm-jp-3-13b-LoRAMoE4MATH_v1 – AI Model by doshisha-mil | AlphaNeural AI
You can deploy this model and start earning money today!
doshisha-mil
/
llm-jp-3-13b-LoRAMoE4MATH_v1
like
0
peft
moe
ja
p1atdev/gsm8k-ja-slim
HachiML/alpaca_jp_math
baber/hendrycks_math
llm-jp/llm-jp-3-13b-instruct3
adapter
apache-2.0
us
Views
No views yet
Model card
Files and Versions
Community
API
Deploy
LoRAMoE for llm-jp-3-13b-instruct3
本リポジトリは,llm-jp-3-13b-instruct3 をベースに,LoRAMoE[
https://github.com/Ablustrund/LoRAMoE
] の手法を実装・適用したものです.
LoRAMoE は,複数の低ランクアダプター(LoRA)と Mixture-of-Experts (MoE) スタイルのルーター機構を組み合わせることで,下流タスクの性能向上と,事前学習で獲得した世界知識の保持の両立を実現することを目的としています.
執筆中 普通の方法では読み込めません.