Benchmark · 09 / 09 / 2026
Refined Custom
vs CP-SAT
V 30 pároch s platným plánom od oboch riešičov bol priemerný rozdiel makespanu Refined voči CP-SAT -0.023%. Refined našiel lepší plán v 3 pároch, rovnaký v 24 a horší v 3.
Across 30 pairs where both solvers returned a valid schedule, Refined's mean makespan difference from CP-SAT was -0.023%. Refined was better in 3 pairs, equal in 24, and worse in 3.
12 scenarios3 seeds: 7 / 19 / 4320 s deadline4 CPU / 4 workersOR-Tools 9.15
36/36
Refined · platný plán
Refined · valid schedule
33/36
CP-SAT · platný plán
CP-SAT · valid schedule
0.000%
Medián párového rozdielu makespanu
Median paired makespan difference
46 080
Operácií v najväčšej fabrike
Operations in the largest factory
Na najväčšej fabrike Refined vrátil platný plán vo všetkých troch behoch; CP-SAT v danom časovom rozpočte nevrátil kompletný výsledok. Tieto tri páry sú uvedené samostatne a nevstupujú do percentuálneho priemeru. Neznamená to, že CP-SAT túto úlohu nedokáže vyriešiť pri dlhšom limite.
On the largest factory, Refined returned a valid schedule in all three runs; CP-SAT did not return a complete result within the budget. These three pairs are reported separately and are not included in the percentage average. This does not mean CP-SAT cannot solve the case with a longer limit.
Všetky scenáre, bez výberu lepších behov
Every scenario, without selecting favorable runs
Tabuľka zobrazuje medián cieľa z troch seedov; menšie číslo pod hodnotou uvádza počet platných plánov z troch behov. Rozdiel je medián párových percent: záporné číslo znamená lepší výsledok Refined. Časy sú pozorovaný čas do návratu riešiča; maximálne zaznamenané trvanie bolo 20.295 s vrátane oneskorenia ukončenia procesu.
The table shows the median objective over three seeds; the smaller number is the count of valid schedules out of three runs. Delta is the median of paired percentages: negative means a better Refined result. Times are observed solve-return times; the longest was 20.295 s including process shutdown latency.
| ScenárScenario | Cieľ / jednotkaObjective / unit | Refined Custom median | CP-SAT median | Párový rozdielPaired delta | Čas: Refined / CP-SATTime: Refined / CP-SAT |
|---|
| FT06 · OR-Library6 machines · 6 jobs · 36 ops | Makespanunits | 553/3 | 553/3 | 0.000% | 0.525 / 0.512 s |
| FT10 · OR-Library10 machines · 10 jobs · 100 ops | Makespanunits | 9303/3 | 9303/3 | 0.000% | 2.677 / 3.292 s |
| FT20 · OR-Library5 machines · 20 jobs · 100 ops | Makespanunits | 1,1653/3 | 1,1653/3 | 0.000% | 2.629 / 1.243 s |
| LA15 · OR-Library5 machines · 20 jobs · 100 ops | Makespanunits | 1,2073/3 | 1,2073/3 | 0.000% | 1.321 / 0.616 s |
| LA25 · OR-Library10 machines · 15 jobs · 150 ops | Makespanunits | 9773/3 | 9773/3 | 0.000% | 15.179 / 15.535 s |
| LA35 · OR-Library10 machines · 30 jobs · 300 ops | Makespanunits | 1,8883/3 | 1,8883/3 | 0.000% | 6.019 / 0.741 s |
| Factory · small5 machines · 11 jobs · 36 ops | Makespanmin | 563/3 | 563/3 | 0.000% | 0.546 / 0.531 s |
| Factory · industrial32 machines · 548 jobs · 6,576 ops | Makespanmin | 2,6083/3 | 2,6073/3 | +0.038% | 20.05 / 20.094 s |
| Factory · large96 machines · 960 jobs · 14,160 ops | Makespanmin | 1,7623/3 | 1,7623/3 | 0.000% | 20.021 / 9.51 s |
| Factory · 46,080 operations128 machines · 1920 jobs · 46,080 ops | Makespanmin | 4,0153/3 | —0/3 | — | 20.251 / 20.289 s |
| Calendar · makespan32 machines · 548 jobs · 6,576 ops | Makespans | 629,3403/3 | 631,0803/3 | -0.276% | 20.018 / 16.794 s |
| Calendar · priorities32 machines · 548 jobs · 6,576 ops | Weighted tardinessweighted s | 215,138,5803/3 | 218,589,8403/3 | -1.579% | 20.011 / 18.011 s |
|---|
„units“ znamená bezrozmerné jednotky pôvodnej úlohy. Kalendárové scenáre sú v sekundách; vážené omeškanie je čas násobený prioritou. Ciele z rôznych jednotiek sa nesčítavajú.
“units” denotes the original instance's relative units. Calendar scenarios use seconds; weighted tardiness multiplies time by priority. Objectives in different units are never added together.
Priority hodnotíme samostatne
Priorities are evaluated separately
Pri váženom omeškaní na kalendárovom scenári bol priemerný párový rozdiel -1.534% v 3 porovnateľných pároch. Refined: 3 lepších, 0 rovnakých a 0 horších výsledkov. Tieto výsledky sa nezmiešavajú s makespanom.
For weighted tardiness on the calendar scenario, the mean paired difference was -1.534% across 3 comparable pairs. Refined: 3 better, 0 equal and 0 worse results. These results are not combined with makespan.
Ako prebehlo meranie
How the comparison was run
Zhodné vstupy
Identical inputs
Šesť pôvodných úloh FT06, FT10, FT20, LA15, LA25 a LA35 pochádza z OR-Library. Ďalšie štyri továrne boli vytvorené s pevným seedom 20260909. Priemyselná fabrika sa navyše testuje s kalendárom pre dva ciele: spolu 12 scenárov a 11 rozdielnych vstupných hashov.
Six original instances, FT06, FT10, FT20, LA15, LA25 and LA35, come from OR-Library. Four factories use fixed generator seed 20260909. The industrial factory is also tested with calendars under two objectives: 12 scenarios and 11 distinct input hashes.
Čas a CPU
Time and CPU
Obe metódy bežali postupne s afinitou na rovnaké štyri logické CPU (0, 2, 4, 6; odlišné jadrá podľa topológie WSL). Limit 20 s zahŕňa tvorbu modelu a seedy. Prevod dát na spoločný vstup je mimo merania. Po termíne sa výpočet zastaví a číta sa najlepší kompletný uložený výsledok.
Both methods ran sequentially with affinity to the same four logical CPUs (0, 2, 4, 6; distinct core IDs in WSL topology). The 20 s budget includes model building and seeding. Common input compilation is excluded. At the deadline, solving is stopped and the best complete saved result is read.
Bez ladenia podľa výsledku
No outcome-driven tuning
Custom používa svoje štandardné nastavenie; samostatný CP-SAT používa nastavenia aplikácie. Počet workerov je 4, solver seedy sú 7, 19, 43 a poradie metód sa strieda. Refined obsahuje internú podporu CP-SAT; nejde o porovnanie s úplne nezávislým algoritmom.
Custom uses its standard settings; standalone CP-SAT uses the application's settings. Workers are set to 4, solver seeds are 7, 19, 43, and method order alternates. Refined includes internal CP-SAT assistance; this is not a comparison with a wholly independent algorithm.
Kontrola platnosti
Schedule validation
Všetkých 69 vrátených plánov bolo znovu overených voči vstupom: operácie, stroje, poradie, prekrytia, odstávky, smeny a cieľová hodnota. Dôkaz optima uviedol Refined v 23 a CP-SAT v 24 behoch. Platný plán sám osebe nie je dôkaz optima.
All 69 returned schedules were revalidated against their inputs: operations, machines, precedence, overlaps, maintenance, shifts and objective values. Refined reported an optimum proof in 23 runs and CP-SAT in 24. Feasibility alone does not establish optimality.
AMD Ryzen 7 5700X3D 8-Core Processor · WSL2 / Linux · Node 20 · OR-Tools 9.15
Source commit: 3d8efbcd1e5e991f0a06351c344e022265c4b780
Online host SHA-256: 40ee8c769e26f5fc17b2a25b844868041b9b4ac2850ad7afe3198c769695860f
Worker SHA-256: 6c98165a48f869ccb80e7c0a2374a47e926e20b997b62a9de1b69bd199f74c27
OR-Library · Job shop scheduling · Original instance data and attribution
Čo z výsledkov možno tvrdiť
What the results support
Výsledky umožňujú porovnávať kvalitu na týchto konkrétnych vstupoch pri tomto rozpočte. Nedokazujú rovnakú kvalitu na každej fabrike ani všeobecnú prevahu či zrýchlenie jedného riešiča. Tri seedy a jeden generovaný vstup na veľkosť sú obmedzená vzorka; časy pochádzajú z pracovnej stanice, nie z izolovaného výkonnostného laboratória.
The results support quality comparisons on these inputs under this budget. They do not establish parity on every factory, universal superiority or a general speedup. Three seeds and one generated input per size are a limited sample; timings come from a workstation, not an isolated performance lab.