Views
No views yet












| 属性 | 规格 |
|---|---|
| 基础架构 | Qwen2.5-7B |
| 最大上下文 | 1024k |
| 训练数据 | 0.1T小说 + 10万条SFT + MGRPO强化学习 |
| 训练设备 | 2x8×H100 GPU集群 |
| 训练时长 | 预计达到3000 H100小时 |
| 量化支持 | GGUF(全系列量化计划中) |
msg.role === 'assistant' ? {
...msg,
content: msg.content.replace(/<think>[\s\S]*?<\/think>/gi, '')
}
1# 启用角色扮演模式
2prompt = """你是一个小女孩/你是一个XX角色...
3<user>我走进门,看到你冲上来迎接我</user>
4<think>
5需要体现人物的气质
6加入环境描写
7保持对话风格
8</think>
9我看到XX进门..."""1generation_config = {
2 "temperature": 0.75,
3 "top_p": 0.6,
4 "repetition_penalty": 1.08,
5 "max_new_tokens": 1536,
6 "do_sample": True
7}