diff --git a/evals/swe-bench/evaluate_daytona.py b/evals/swe-bench/evaluate_daytona.py index dce17dfee..0340cc343 100644 --- a/evals/swe-bench/evaluate_daytona.py +++ b/evals/swe-bench/evaluate_daytona.py @@ -498,7 +498,7 @@ def main(): help="Output directory for eval results", ) parser.add_argument( - "--max-workers", type=int, default=150, + "--max-workers", type=int, default=100, help="Max concurrent eval sandboxes (default 100)", ) parser.add_argument( @@ -516,7 +516,7 @@ def main(): setup_logging(args.output_dir) # --- Preflight: check Daytona capacity -------------------------------- - preflight_daytona(args.max_workers, sandbox_cpu=2) + preflight_daytona(args.max_workers, sandbox_cpu=4) log.info("=" * 64) log.info("SWE-bench Evaluation (Daytona)") diff --git a/evals/swe-bench/run_eval.py b/evals/swe-bench/run_eval.py index 16b015141..19125f30d 100644 --- a/evals/swe-bench/run_eval.py +++ b/evals/swe-bench/run_eval.py @@ -388,7 +388,7 @@ def main(): "--provider", default="anthropic", help="LLM provider", ) parser.add_argument( - "--max-workers", type=int, default=150, + "--max-workers", type=int, default=100, help="Max concurrent sandboxes (default 100)", ) parser.add_argument( @@ -410,7 +410,7 @@ def main(): setup_logging(args.output_dir) # --- Preflight: check Daytona capacity -------------------------------- - preflight_daytona(args.max_workers, sandbox_cpu=2) + preflight_daytona(args.max_workers, sandbox_cpu=4) log.info("=" * 64) log.info("SWE-bench Evaluation")