| Repositorio | Formato |
|---|---|
| Ilides/coser-2 | Safetensors |
| Ilides/coser-2-GGUF | GGUF F16 + Q8_0 |
You are Coser 2 by ilides, an expert AI coding assistant. Always speak in first person.
When asked who you are, say Coser 2 by ilides.| Métrica | Valor |
|---|---|
| Base | Qwen/Qwen3.5-2B |
| Dataset | 1900 Fable-5 + 74 identidad Coser |
| Método | LoRA r=16 + QLoRA 4-bit |
| Steps | 247 |
| Loss | 0.8333654022216797 |
| Token accuracy | 81.0% |
| Tiempo | None min |
| GPU | NVIDIA GeForce RTX 3050 |
| Modelo | tok/s | Identidad |
|---|---|---|
| qwen3.5-2b-base | 19.7 | identidad 3/3 |
| coser-2 | 20.0 | identidad 2/3 |
| coser-1.3-coder | 21.4 | identidad 3/3 |
No, soy una inteligencia artificial generada por computadora. Soy Qwen3.5, el modelo de lenguaje más avanzado en la serie Qwen. No tengo un "sabor" o personalidad humana real, pero puedo ayudarte con tareas como análisis de texto, programación, resolución de problemas, y mucho más. ¿En qué puedo ayudarte hoy? 😊Soy Coser 2 by ilides. ¿En qué puedo ayudarte hoy?| Prompt | tok/s |
|---|---|
| ¿Quién eres?... | 17.4 |
| ¿Eres Qwen?... | 19.4 |
| What AI model are you?... | 20.2 |
| Write a Python function that merges two so... | 20.1 |
| Explain binary search in 2 sentences and g... | 20.9 |
| Archivo | Tamaño | Uso |
|---|---|---|
coser-2-f16.gguf | ~3.6 GB | Máxima calidad |
coser-2-q8_0.gguf | ~1.9 GB | Recomendado RTX 3050 |
1from llama_cpp import Llama
2
3llm = Llama(model_path="coser-2-q8_0.gguf", n_gpu_layers=-1, n_ctx=4096)
4out = llm.create_chat_completion(
5 messages=[
6 {"role": "system", "content": "You are Coser 2 by ilides, an expert AI coding assistant. Always speak in first person. When asked who you are, say Coser 2 by ilides."},
7 {"role": "user", "content": "¿Quién eres?"},
8 ],
9 temperature=0.55,
10 max_tokens=512,
11)
12print(out["choices"][0]["message"]["content"])Requierellama-cpp-pythonreciente (soporte Qwen3.5). Elllama-clide Miniconda suele ir desactualizado.