Przejdź do głównej zawartości

Porównanie uruchomień

Na tej stronie

Porównuj ukończone uruchomienia z tą samą wersją obciążenia, modelem oceny i profilem. Procent zmiany opisuje różnicę liczb, ale sam w sobie nie dowodzi efektu dostrajania.

Przed porównaniem liczb sprawdź zgodność pary uruchomień na podstawie plików wyników: w każdym z nich zapisano wersję obciążenia — stały identyfikator jego składu — oraz model scoringu, a także wersję statystyk. Porównuj te pola parami: jeśli obciążenie lub model scoringu się nie zgadzają, uruchomienia należą do różnych protokołów i ich wyniki są bezpośrednio nieporównywalne. Jak zbudowane są te identyfikatory, opisano w metodyce.

  1. Zapisz model procesora i karty graficznej, wersje Windows i sterownika. Między testami nie zmieniaj trybu zasilania i chłodzenia. Używaj tego samego zestawu programów działających w tle.
  2. Najpierw wykonaj co najmniej trzy testy bez zmiany ustawień. Tak zobaczysz zwykły rozrzut wyników. Do wniosku o niewielkich różnicach może być potrzebnych więcej powtórzeń.
  3. Zmień jedno ustawienie i powtórz testy. Jeśli potrzebny jest restart, wykonuj go również przed serią z początkowymi ustawieniami. Przed każdym uruchomieniem odczekaj taki sam czas.
  4. W miarę możliwości sprawdź początkowe ustawienia, potem zmienione, a następnie znowu początkowe: A → B → A. Taka kolejność pomaga oddzielić efekt dostrajania od rozgrzewania i obciążenia w tle.
  5. Zapisuj wszystkie wyniki. Z góry określ, które awarie czynią test nieprzydatnym do porównania, na przykład przerwanie uruchomienia. Jeśli wykluczasz test, podaj przyczynę. Niska ocena sama w sobie nie jest powodem, by go usuwać.

Utrzymuj takie same rozdzielczość ekranu oraz tryb okienkowy lub pełnoekranowy. Jeśli sprawdzasz wpływ rozdzielczości, powtórz test kilka razy przy każdej wybranej rozdzielczości.

Δ score, % = 100 × (mean_after / mean_before − 1)
CV, % = 100 × sample_standard_deviation / mean

Porównuj wartości średnie i rozrzut między uruchomieniami. Sprawdzaj nie tylko wynik końcowy, ale także poszczególne oceny, opóźnienia w milisekundach i szybkość wykonywania obciążeń (throughput). Dla opóźnień ujemna różnica zwykle oznacza poprawę; dla wyników dodatnia różnica oznacza wzrost oceny.

Do sprawdzenia powtarzalności licz pełne uruchomienia. Tysiące klatek w ramach jednego testu nie zastępują powtórnych testów: wszystkie pochodzą z jednej sesji i zależą od wspólnych warunków.

Niewielka zmiana względem zwykłego rozrzutu wymaga dodatkowych powtórzeń. Nie można ustalać uniwersalnego progu w rodzaju „wszystko powyżej 1% jest istotne” na podstawie jednej serii. Nawet statystycznie rozróżnialna różnica może być zbyt mała, by mieć znaczenie praktyczne.

Diagnostyka blokowa jest już wbudowana w wyniki: dla każdego obciążenia zapisywany jest rozrzut szybkości wykonywania według bloków, przesunięcie „pierwszy-ostatni” i trend według kroków. Pozwala to ocenić, czy różnica dwóch uruchomień przewyższa obserwowany w nich szum, jeszcze przed nowymi powtórzeniami. Wzory, według których bloki są agregowane w wyniki, są dostępne w obliczaniu wyników.

W serii ośmiu uruchomień porównywano powtórzenia i rozdzielczości na zoptymalizowanym systemie. Nie zawiera ona stanu niezoptymalizowanego i dlatego nie dowodzi korzyści z BoosterX.

Test syntetyczny pomaga badać zmiany w działaniu systemu. Aby sprawdzić korzyść dla konkretnej gry, powtórz porównanie w jej powtarzalnym scenariuszu rozgrywki.

Sprawdzone: 2026-09-20.