From eb006f52b2b8c3e58df6a23b389f3fd02fdf8e3a Mon Sep 17 00:00:00 2001 From: XZ0730 <1055275260@qq.com> Date: Fri, 31 Jul 2026 22:56:16 +0800 Subject: [PATCH] [fix] one_eval need bench_prompt_template | start.yaml to judger --- examples/config/starter.yaml | 10 ++++++---- loopai/skills/Judger/utils/eval_general_text.py | 1 + loopai/skills/Judger/utils/vllm_starter.py | 2 +- 3 files changed, 8 insertions(+), 5 deletions(-) diff --git a/examples/config/starter.yaml b/examples/config/starter.yaml index 6d26cb3..ad78c5c 100644 --- a/examples/config/starter.yaml +++ b/examples/config/starter.yaml @@ -58,13 +58,15 @@ default_states: judger: eval_model_path: "/home/lpc/models/Qwen2.5-14B-Instruct/" - eval_base_url: "http://127.0.0.1:8911/v1" eval_temperature: 0 eval_top_p: 0.95 - eval_test_case_path: "./outputs/test.json" - eval_problem_path: "./data/human-eval-v2-20210705-format.jsonl" - eval_result_path: "./outputs/result.json" eval_batch_size: 20 + eval_case_num: 10 + eval_vllm_tensor_parallel_size: 1 + eval_vllm_gpu_memory_utilization: 0.9 + cuda_visible_devices: "0" + benchlist: [] + extra_benchlist: [] analyzer: analyze_temperature: 0 diff --git a/loopai/skills/Judger/utils/eval_general_text.py b/loopai/skills/Judger/utils/eval_general_text.py index 8ed2957..a717364 100644 --- a/loopai/skills/Judger/utils/eval_general_text.py +++ b/loopai/skills/Judger/utils/eval_general_text.py @@ -48,6 +48,7 @@ class BenchAdapter: eval_status: str = "pending" meta: Dict[str, Any] = field(default_factory=dict) key_mapping: Dict[str, Any] = field(default_factory=dict) + bench_prompt_template: Optional[str] = None # --------------------------------------------------------------------------- diff --git a/loopai/skills/Judger/utils/vllm_starter.py b/loopai/skills/Judger/utils/vllm_starter.py index 37301e2..969b97c 100644 --- a/loopai/skills/Judger/utils/vllm_starter.py +++ b/loopai/skills/Judger/utils/vllm_starter.py @@ -86,7 +86,7 @@ def start_vllm_openai_api_server( vllm_gpu_memory_utilization, vllm_model, poll_interval: float = 2.0, - max_timeout: float = 180.0 + max_timeout: float = 300.0 ) -> tuple[subprocess.Popen, threading.Event]: """ 启动vllm openai兼容api服务(保留shell=True+字符串命令,解决卡死问题)