Porównanie uruchomień
Na tej stronie
Porównuj ukończone uruchomienia z tą samą wersją obciążenia, modelem oceny i profilem. Procent zmiany opisuje różnicę liczb, ale sam w sobie nie dowodzi efektu dostrajania.
Przed porównaniem liczb sprawdź zgodność pary uruchomień na podstawie plików wyników: w każdym z nich zapisano wersję obciążenia — stały identyfikator jego składu — oraz model scoringu, a także wersję statystyk. Porównuj te pola parami: jeśli obciążenie lub model scoringu się nie zgadzają, uruchomienia należą do różnych protokołów i ich wyniki są bezpośrednio nieporównywalne. Jak zbudowane są te identyfikatory, opisano w metodyce.
Plan eksperymentu
Dział zatytułowany „Plan eksperymentu”- Zapisz model procesora i karty graficznej, wersje Windows i sterownika. Między testami nie zmieniaj trybu zasilania i chłodzenia. Używaj tego samego zestawu programów działających w tle.
- Najpierw wykonaj co najmniej trzy testy bez zmiany ustawień. Tak zobaczysz zwykły rozrzut wyników. Do wniosku o niewielkich różnicach może być potrzebnych więcej powtórzeń.
- Zmień jedno ustawienie i powtórz testy. Jeśli potrzebny jest restart, wykonuj go również przed serią z początkowymi ustawieniami. Przed każdym uruchomieniem odczekaj taki sam czas.
- W miarę możliwości sprawdź początkowe ustawienia, potem zmienione, a następnie znowu początkowe: A → B → A. Taka kolejność pomaga oddzielić efekt dostrajania od rozgrzewania i obciążenia w tle.
- Zapisuj wszystkie wyniki. Z góry określ, które awarie czynią test nieprzydatnym do porównania, na przykład przerwanie uruchomienia. Jeśli wykluczasz test, podaj przyczynę. Niska ocena sama w sobie nie jest powodem, by go usuwać.
Utrzymuj takie same rozdzielczość ekranu oraz tryb okienkowy lub pełnoekranowy. Jeśli sprawdzasz wpływ rozdzielczości, powtórz test kilka razy przy każdej wybranej rozdzielczości.
Co brać pod uwagę
Dział zatytułowany „Co brać pod uwagę”Δ score, % = 100 × (mean_after / mean_before − 1)CV, % = 100 × sample_standard_deviation / meanPorównuj wartości średnie i rozrzut między uruchomieniami. Sprawdzaj nie tylko wynik końcowy, ale także poszczególne oceny, opóźnienia w milisekundach i szybkość wykonywania obciążeń (throughput). Dla opóźnień ujemna różnica zwykle oznacza poprawę; dla wyników dodatnia różnica oznacza wzrost oceny.
Do sprawdzenia powtarzalności licz pełne uruchomienia. Tysiące klatek w ramach jednego testu nie zastępują powtórnych testów: wszystkie pochodzą z jednej sesji i zależą od wspólnych warunków.
Co można wywnioskować
Dział zatytułowany „Co można wywnioskować”Niewielka zmiana względem zwykłego rozrzutu wymaga dodatkowych powtórzeń. Nie można ustalać uniwersalnego progu w rodzaju „wszystko powyżej 1% jest istotne” na podstawie jednej serii. Nawet statystycznie rozróżnialna różnica może być zbyt mała, by mieć znaczenie praktyczne.
Diagnostyka blokowa jest już wbudowana w wyniki: dla każdego obciążenia zapisywany jest rozrzut szybkości wykonywania według bloków, przesunięcie „pierwszy-ostatni” i trend według kroków. Pozwala to ocenić, czy różnica dwóch uruchomień przewyższa obserwowany w nich szum, jeszcze przed nowymi powtórzeniami. Wzory, według których bloki są agregowane w wyniki, są dostępne w obliczaniu wyników.
W serii ośmiu uruchomień porównywano powtórzenia i rozdzielczości na zoptymalizowanym systemie. Nie zawiera ona stanu niezoptymalizowanego i dlatego nie dowodzi korzyści z BoosterX.
Test syntetyczny pomaga badać zmiany w działaniu systemu. Aby sprawdzić korzyść dla konkretnej gry, powtórz porównanie w jej powtarzalnym scenariuszu rozgrywki.
Sprawdzone: 2026-09-20.
