Benchmark · 09 / 09 / 2026

Refined Custom
vs CP-SAT

V 30 pároch s platným plánom od oboch riešičov bol priemerný rozdiel makespanu Refined voči CP-SAT -0.023%. Refined našiel lepší plán v 3 pároch, rovnaký v 24 a horší v 3.

Across 30 pairs where both solvers returned a valid schedule, Refined's mean makespan difference from CP-SAT was -0.023%. Refined was better in 3 pairs, equal in 24, and worse in 3.

12 scenarios3 seeds: 7 / 19 / 4320 s deadline4 CPU / 4 workersOR-Tools 9.15
36/36
Refined · platný plán
Refined · valid schedule
33/36
CP-SAT · platný plán
CP-SAT · valid schedule
0.000%
Medián párového rozdielu makespanu
Median paired makespan difference
46 080
Operácií v najväčšej fabrike
Operations in the largest factory
Na najväčšej fabrike Refined vrátil platný plán vo všetkých troch behoch; CP-SAT v danom časovom rozpočte nevrátil kompletný výsledok. Tieto tri páry sú uvedené samostatne a nevstupujú do percentuálneho priemeru. Neznamená to, že CP-SAT túto úlohu nedokáže vyriešiť pri dlhšom limite.
On the largest factory, Refined returned a valid schedule in all three runs; CP-SAT did not return a complete result within the budget. These three pairs are reported separately and are not included in the percentage average. This does not mean CP-SAT cannot solve the case with a longer limit.

Všetky scenáre, bez výberu lepších behov

Every scenario, without selecting favorable runs

Tabuľka zobrazuje medián cieľa z troch seedov; menšie číslo pod hodnotou uvádza počet platných plánov z troch behov. Rozdiel je medián párových percent: záporné číslo znamená lepší výsledok Refined. Časy sú pozorovaný čas do návratu riešiča; maximálne zaznamenané trvanie bolo 20.295 s vrátane oneskorenia ukončenia procesu.

The table shows the median objective over three seeds; the smaller number is the count of valid schedules out of three runs. Delta is the median of paired percentages: negative means a better Refined result. Times are observed solve-return times; the longest was 20.295 s including process shutdown latency.

ScenárScenarioCieľ / jednotkaObjective / unitRefined Custom
median
CP-SAT
median
Párový rozdielPaired deltaČas: Refined / CP-SATTime: Refined / CP-SAT
FT06 · OR-Library6 machines · 6 jobs · 36 opsMakespanunits553/3553/30.000%0.525 / 0.512 s
FT10 · OR-Library10 machines · 10 jobs · 100 opsMakespanunits9303/39303/30.000%2.677 / 3.292 s
FT20 · OR-Library5 machines · 20 jobs · 100 opsMakespanunits1,1653/31,1653/30.000%2.629 / 1.243 s
LA15 · OR-Library5 machines · 20 jobs · 100 opsMakespanunits1,2073/31,2073/30.000%1.321 / 0.616 s
LA25 · OR-Library10 machines · 15 jobs · 150 opsMakespanunits9773/39773/30.000%15.179 / 15.535 s
LA35 · OR-Library10 machines · 30 jobs · 300 opsMakespanunits1,8883/31,8883/30.000%6.019 / 0.741 s
Factory · small5 machines · 11 jobs · 36 opsMakespanmin563/3563/30.000%0.546 / 0.531 s
Factory · industrial32 machines · 548 jobs · 6,576 opsMakespanmin2,6083/32,6073/3+0.038%20.05 / 20.094 s
Factory · large96 machines · 960 jobs · 14,160 opsMakespanmin1,7623/31,7623/30.000%20.021 / 9.51 s
Factory · 46,080 operations128 machines · 1920 jobs · 46,080 opsMakespanmin4,0153/30/320.251 / 20.289 s
Calendar · makespan32 machines · 548 jobs · 6,576 opsMakespans629,3403/3631,0803/3-0.276%20.018 / 16.794 s
Calendar · priorities32 machines · 548 jobs · 6,576 opsWeighted tardinessweighted s215,138,5803/3218,589,8403/3-1.579%20.011 / 18.011 s

„units“ znamená bezrozmerné jednotky pôvodnej úlohy. Kalendárové scenáre sú v sekundách; vážené omeškanie je čas násobený prioritou. Ciele z rôznych jednotiek sa nesčítavajú.

“units” denotes the original instance's relative units. Calendar scenarios use seconds; weighted tardiness multiplies time by priority. Objectives in different units are never added together.

Priority hodnotíme samostatne

Priorities are evaluated separately

Pri váženom omeškaní na kalendárovom scenári bol priemerný párový rozdiel -1.534% v 3 porovnateľných pároch. Refined: 3 lepších, 0 rovnakých a 0 horších výsledkov. Tieto výsledky sa nezmiešavajú s makespanom.

For weighted tardiness on the calendar scenario, the mean paired difference was -1.534% across 3 comparable pairs. Refined: 3 better, 0 equal and 0 worse results. These results are not combined with makespan.

Ako prebehlo meranie

How the comparison was run

Zhodné vstupy

Identical inputs

Šesť pôvodných úloh FT06, FT10, FT20, LA15, LA25 a LA35 pochádza z OR-Library. Ďalšie štyri továrne boli vytvorené s pevným seedom 20260909. Priemyselná fabrika sa navyše testuje s kalendárom pre dva ciele: spolu 12 scenárov a 11 rozdielnych vstupných hashov.

Six original instances, FT06, FT10, FT20, LA15, LA25 and LA35, come from OR-Library. Four factories use fixed generator seed 20260909. The industrial factory is also tested with calendars under two objectives: 12 scenarios and 11 distinct input hashes.

Čas a CPU

Time and CPU

Obe metódy bežali postupne s afinitou na rovnaké štyri logické CPU (0, 2, 4, 6; odlišné jadrá podľa topológie WSL). Limit 20 s zahŕňa tvorbu modelu a seedy. Prevod dát na spoločný vstup je mimo merania. Po termíne sa výpočet zastaví a číta sa najlepší kompletný uložený výsledok.

Both methods ran sequentially with affinity to the same four logical CPUs (0, 2, 4, 6; distinct core IDs in WSL topology). The 20 s budget includes model building and seeding. Common input compilation is excluded. At the deadline, solving is stopped and the best complete saved result is read.

Bez ladenia podľa výsledku

No outcome-driven tuning

Custom používa svoje štandardné nastavenie; samostatný CP-SAT používa nastavenia aplikácie. Počet workerov je 4, solver seedy sú 7, 19, 43 a poradie metód sa strieda. Refined obsahuje internú podporu CP-SAT; nejde o porovnanie s úplne nezávislým algoritmom.

Custom uses its standard settings; standalone CP-SAT uses the application's settings. Workers are set to 4, solver seeds are 7, 19, 43, and method order alternates. Refined includes internal CP-SAT assistance; this is not a comparison with a wholly independent algorithm.

Kontrola platnosti

Schedule validation

Všetkých 69 vrátených plánov bolo znovu overených voči vstupom: operácie, stroje, poradie, prekrytia, odstávky, smeny a cieľová hodnota. Dôkaz optima uviedol Refined v 23 a CP-SAT v 24 behoch. Platný plán sám osebe nie je dôkaz optima.

All 69 returned schedules were revalidated against their inputs: operations, machines, precedence, overlaps, maintenance, shifts and objective values. Refined reported an optimum proof in 23 runs and CP-SAT in 24. Feasibility alone does not establish optimality.

AMD Ryzen 7 5700X3D 8-Core Processor · WSL2 / Linux · Node 20 · OR-Tools 9.15
Source commit: 3d8efbcd1e5e991f0a06351c344e022265c4b780
Online host SHA-256: 40ee8c769e26f5fc17b2a25b844868041b9b4ac2850ad7afe3198c769695860f
Worker SHA-256: 6c98165a48f869ccb80e7c0a2374a47e926e20b997b62a9de1b69bd199f74c27

OR-Library · Job shop scheduling · Original instance data and attribution

Čo z výsledkov možno tvrdiť

What the results support

Výsledky umožňujú porovnávať kvalitu na týchto konkrétnych vstupoch pri tomto rozpočte. Nedokazujú rovnakú kvalitu na každej fabrike ani všeobecnú prevahu či zrýchlenie jedného riešiča. Tri seedy a jeden generovaný vstup na veľkosť sú obmedzená vzorka; časy pochádzajú z pracovnej stanice, nie z izolovaného výkonnostného laboratória.

The results support quality comparisons on these inputs under this budget. They do not establish parity on every factory, universal superiority or a general speedup. Three seeds and one generated input per size are a limited sample; timings come from a workstation, not an isolated performance lab.