Views
No views yet
./llama-cli \
-hf dahara1/GPT-OSS-Swallow-20B-RL-v0.1-MXFP4:GPT-OSS-Swallow-20B-RL-v0.1-MXFP4_MOE.gguf \
--temp 0.6 \
--jinja \
--top-p 0.95 \
--top-k 20 \
--min-p 0 \
--ctx-size 8192 \
-ub 2048 \
-b 2048 \
--chat-template-kwargs '{"model_identity": "You are ChatGPT, a large language model trained by OpenAI. Follow the user'\''s instructions carefully.", "reasoning_effort": "medium"}'.\llama-cli -hf dahara1/GPT-OSS-Swallow-20B-RL-v0.1-MXFP4:GPT-OSS-Swallow-20B-RL-v0.1-MXFP4_MOE.gguf -ngl 99 --n-cpu-moe 10 --temp 0.6 --jinja --top-p 0.95 --top-k 20 --min-p 0 --ctx-size 8192 -ub 2048 -b 2048 --% --chat-template-kwargs "{\"model_identity\": \"You are ChatGPT, a large language model trained by OpenAI. Follow the user's instructions carefully.\", \"reasoning_effort\": \"medium\"}"

./llama-server \
-hf dahara1/GPT-OSS-Swallow-20B-RL-v0.1-MXFP4:GPT-OSS-Swallow-20B-RL-v0.1-MXFP4_MOE.gguf \
--host 127.0.0.1 \
--port 8080 \
--temp 0.6 \
--jinja \
--chat-template-kwargs '{"model_identity": "You are ChatGPT, a large language model trained by OpenAI. Follow the user'\''s instructions carefully.", "reasoning_effort": "medium"}' \
--top-p 0.95 \
--top-k 20 \
--min-p 0 \
--ctx-size 8192 \
-ub 2048 \
-b 2048 .\llama-server -hf dahara1/GPT-OSS-Swallow-20B-RL-v0.1-MXFP4:GPT-OSS-Swallow-20B-RL-v0.1-MXFP4_MOE.gguf -ngl 99 --n-cpu-moe 10 --host 127.0.0.1 --port 8080 --temp 0.6 --jinja --top-p 0.95 --top-k 20 --min-p 0 --ctx-size 8192 -ub 2048 -b 2048 --% --chat-template-kwargs "{\"model_identity\": \"You are ChatGPT, a large language model trained by OpenAI. Follow the user's instructions carefully.\", \"reasoning_effort\": \"medium\"}"
#!/usr/bin/env python3
# coding=utf-8
"""
GPT-OSS-Swallow-20B-RL-v0.1 (MXFP4_MOE) - シンプルなリクエスト送信スクリプト
llama-server の OpenAI互換APIにリクエストを送り、レスポンスを返す。
IFEval ベンチマーク実行時にはこのスクリプトと同じ設定を使用
"""
import argparse
import json
import sys
from openai import OpenAI
# --- ベンチマーク時と同じ設定 ---
DEFAULT_BASE_URL = "http://127.0.0.1:8080/v1"
DEFAULT_MODEL_NAME = "wbd-MXFP4_MOE"
DEFAULT_TEMPERATURE = 0.6
DEFAULT_MAX_TOKENS = 8192
DEFAULT_TOP_P = 0.95
# DEVELOPER_PROMPT
DEVELOPER_PROMPT = "You are a helpful assistant. Follow the user's instructions carefully."
def send_request(prompt: str, base_url: str = DEFAULT_BASE_URL,
model_name: str = DEFAULT_MODEL_NAME,
temperature: float = DEFAULT_TEMPERATURE,
max_tokens: int = DEFAULT_MAX_TOKENS) -> str:
"""llama-server にリクエストを送信し、レスポンスを返す"""
client = OpenAI(base_url=base_url, api_key="EMPTY", timeout=1200.0)
response = client.chat.completions.create(
model=model_name,
messages=[
{"role": "developer", "content": DEVELOPER_PROMPT},
{"role": "user", "content": prompt},
],
temperature=temperature,
max_tokens=max_tokens,
top_p=DEFAULT_TOP_P,
)
return response.choices[0].message.content.strip()
def main():
parser = argparse.ArgumentParser(
description="GPT-OSS-Swallow llama-server へのシンプルなリクエスト送信")
parser.add_argument("--prompt", type=str, default=None,
help="送信するプロンプト (未指定の場合は対話モード)")
parser.add_argument("--base_url", type=str, default=DEFAULT_BASE_URL)
parser.add_argument("--model_name", type=str, default=DEFAULT_MODEL_NAME)
parser.add_argument("--temperature", type=float, default=DEFAULT_TEMPERATURE)
parser.add_argument("--max_tokens", type=int, default=DEFAULT_MAX_TOKENS)
args = parser.parse_args()
if args.prompt:
# 単発モード
result = send_request(args.prompt, args.base_url, args.model_name,
args.temperature, args.max_tokens)
print(result)
else:
# 対話モード
print(f"=== GPT-OSS-Swallow Simple Client ===")
print(f"Server: {args.base_url}")
print(f"Model: {args.model_name}")
print(f"Ctrl+C で終了")
print()
while True:
try:
prompt = input("You: ").strip()
if not prompt:
continue
result = send_request(prompt, args.base_url, args.model_name,
args.temperature, args.max_tokens)
print(f"\nAssistant: {result}\n")
except KeyboardInterrupt:
print("\n終了")
break
except Exception as e:
print(f"\nError: {e}\n", file=sys.stderr)
if __name__ == "__main__":
main()
| モデル名 | 日本語スコア (Prompt-level Strict) |
|---|---|
| o1 | 75.7 |
| GPT4o | 70.4 |
| o1 Mini | 69.5 |
| GPT-OSS-Swallow-20B-RL-v0.1-MXFP4 | 68.6 |
| GPT4o Mini | 65.9 |
{
"strict": {
"prompt_level_accuracy": 0.686046511627907,
"instruction_level_accuracy": 0.7123893805309734,
"tier0_scores": {
"ja": 0.7123893805309734
},
"tier1_scores": {
"ja:language:response_language": 0.5,
"ja:length_constraints:number_sentences": 0.8571428571428571,
"ja:detectable_content:number_placeholders": 1.0,
"ja:detectable_format:number_bullet_lists": 0.8571428571428571,
"ja:detectable_format:number_numbered_lists": 0.8571428571428571,
"ja:detectable_format:constrained_response": 1.0,
"ja:detectable_format:number_highlighted_sections": 1.0,
"ja:detectable_format:multiple_sections": 1.0,
"ja:length_constraints:number_paragraphs": 0.2857142857142857,
"ja:detectable_content:postscript": 0.8571428571428571,
"ja:keywords:existence": 1.0,
"ja:keywords:frequency": 1.0,
"ja:length_constraints:number_letters": 1.0,
"ja:detectable_format:json_format": 0.6666666666666666,
"ja:length_constraints:nth_paragraph_first_word": 0.5714285714285714,
"ja:keywords:forbidden_words": 0.14285714285714285,
"ja:combination:two_responses": 1.0,
"ja:combination:repeat_prompt": 1.0,
"ja:startend:end_checker": 0.8571428571428571,
"ja:detectable_format:title": 0.7142857142857143,
"ja:keywords:letter_frequency": 0.2,
"ja:letters:furigana": 0.08333333333333333,
"ja:punctuation:no_period": 0.8571428571428571,
"ja:punctuation:no_comma": 0.42857142857142855,
"ja:startend:quotation": 0.8571428571428571,
"ja:letters:kanji": 0.7142857142857143,
"ja:letters:no_hiragana": 1.0,
"ja:letters:hiragana_only": 1.0,
"ja:letters:no_katakana": 0.14285714285714285,
"ja:letters:katakana_only": 0.6666666666666666,
"ja:startend:sentence_unified_end": 0.8571428571428571,
"ja:detectable_format:nominal_ending": 0.42857142857142855,
"ja:letters:kansuuji": 0.42857142857142855
},
"total_prompts": 172,
"total_instructions": 226
},
"loose": {
"prompt_level_accuracy": 0.7209302325581395,
"instruction_level_accuracy": 0.7433628318584071,
"tier0_scores": {
"ja": 0.7433628318584071
},
"tier1_scores": {
"ja:language:response_language": 0.5,
"ja:length_constraints:number_sentences": 0.8571428571428571,
"ja:detectable_content:number_placeholders": 1.0,
"ja:detectable_format:number_bullet_lists": 0.8571428571428571,
"ja:detectable_format:number_numbered_lists": 0.8571428571428571,
"ja:detectable_format:constrained_response": 1.0,
"ja:detectable_format:number_highlighted_sections": 1.0,
"ja:detectable_format:multiple_sections": 1.0,
"ja:length_constraints:number_paragraphs": 0.42857142857142855,
"ja:detectable_content:postscript": 0.8571428571428571,
"ja:keywords:existence": 1.0,
"ja:keywords:frequency": 1.0,
"ja:length_constraints:number_letters": 1.0,
"ja:detectable_format:json_format": 0.8333333333333334,
"ja:length_constraints:nth_paragraph_first_word": 1.0,
"ja:keywords:forbidden_words": 0.2857142857142857,
"ja:combination:two_responses": 1.0,
"ja:combination:repeat_prompt": 1.0,
"ja:startend:end_checker": 0.8571428571428571,
"ja:detectable_format:title": 0.7142857142857143,
"ja:keywords:letter_frequency": 0.2,
"ja:letters:furigana": 0.08333333333333333,
"ja:punctuation:no_period": 0.8571428571428571,
"ja:punctuation:no_comma": 0.42857142857142855,
"ja:startend:quotation": 0.8571428571428571,
"ja:letters:kanji": 0.8571428571428571,
"ja:letters:no_hiragana": 1.0,
"ja:letters:hiragana_only": 1.0,
"ja:letters:no_katakana": 0.14285714285714285,
"ja:letters:katakana_only": 0.6666666666666666,
"ja:startend:sentence_unified_end": 0.8571428571428571,
"ja:detectable_format:nominal_ending": 0.42857142857142855,
"ja:letters:kansuuji": 0.42857142857142855
},
"total_prompts": 172,
"total_instructions": 226
}
}