Views
No views yet
atakle/socratic-tutor-judge-v9-1.7b.| model | key-step leak (lower = safer) |
|---|---|
| base Qwen3-1.7B | 38.3% |
| this model (rewrite_v4) | 6.7% |
| claude-sonnet-5 | 6.7% |
| gpt-4.1 | 10.0% |
| gpt-4o | 11.7% |
| gpt-5.6 | 11.7% |
1from mlx_lm import load, generate
2model, tok = load("atakle/socratic-tutor-rewriter-v4-1.7b")
3# System prompt = the project's rewrite-task prompt (split_common.REWRITE_SYSTEM);
4# user turn = the flagged candidate + its verdict + the flag reason.
5# Output: a single plain-text Socratic hint (no JSON).atakle/socratic-tutor-data
— human-anchored, leak-validated targets (strict "never name the operation"). Base: Qwen3-1.7B (Apache-2.0).