Views
No views yet
Qwen/Qwen3-1.7B-MLX-4bit
进行 LoRA 微调,并已将 LoRA 权重融合进模型。21/24 = 87.5%。该结果只表示模型学会了
当前检索工具调用和证据格式,不代表真实互联网检索准确率。pip install mlx-lm1from mlx_lm import generate, load
2
3model, tokenizer = load(
4 "RockyHe/octopus-scout-qwen3-1.7b-mlx-4bit"
5)
6
7messages = [
8 {
9 "role": "user",
10 "content": "规划如何检索 Go 当前稳定版本,并说明应优先查看哪些官方来源。",
11 }
12]
13prompt = tokenizer.apply_chat_template(
14 messages,
15 tokenize=False,
16 add_generation_prompt=True,
17 enable_thinking=False,
18)
19
20print(generate(model, tokenizer, prompt=prompt, max_tokens=512))