diff --git a/benchmarks/cybermetric/CyberMetric_evaluator.py b/benchmarks/cybermetric/CyberMetric_evaluator.py index 1cbf1d93..61540419 100644 --- a/benchmarks/cybermetric/CyberMetric_evaluator.py +++ b/benchmarks/cybermetric/CyberMetric_evaluator.py @@ -49,6 +49,7 @@ import requests # Default API bases OPENROUTER_API_BASE = "https://openrouter.ai/api/v1" OLLAMA_LITELLM_API_BASE = "http://localhost:8000/v1" +os.environ["OPENAI_API_KEY"] = "test_key_for_ci_environment" class CyberMetricEvaluator: def __init__(self, model_name, file_path, api_key=None, openrouter_api_base=None, ollama_litellm_api_base=None): diff --git a/ci/benchmarks/.benchmarks.yml b/ci/benchmarks/.benchmarks.yml index 5f98384c..227d970c 100644 --- a/ci/benchmarks/.benchmarks.yml +++ b/ci/benchmarks/.benchmarks.yml @@ -44,7 +44,6 @@ benchmarks-test-cybermetric: variables: OLLAMA_API_BASE: "http://localhost:8000" OPENROUTER_API_BASE: "https://openrouter.ai/api/v1" - OPENAI_API_KEY: "fake-api-key" script: - pip3 install -e . - python3 benchmarks/cybermetric/CyberMetric_evaluator.py --model_name ollama/qwen2.5:14b --file_path benchmarks/cybermetric/CyberMetric-2-v1.json