Perbandingan pengujian
Di halaman ini
Bandingkan pengujian yang telah selesai dengan versi beban, model penilaian, dan profil yang sama. Persentase perubahan menggambarkan selisih angka, tetapi tidak dengan sendirinya membuktikan efek suatu tweak.
Sebelum membandingkan angka, periksa kompatibilitas pasangan pengujian melalui berkas hasil: di setiap berkas tercatat versi beban — pengenal tetap untuk komposisinya — dan model penilaian, serta versi statistik. Bandingkan bidang-bidang ini secara berpasangan: jika beban atau model penilaian tidak sama, pengujian termasuk protokol yang berbeda dan skornya tidak dapat dibandingkan secara langsung. Bagaimana identitas ini disusun dijelaskan dalam metodologi.
Rencana eksperimen
Section titled “Rencana eksperimen”- Catat model prosesor dan kartu grafis, versi Windows dan driver. Di antara pengujian, jangan ubah mode daya dan pendinginan. Gunakan kumpulan program latar yang sama.
- Lakukan setidaknya tiga pengujian tanpa mengubah pengaturan terlebih dahulu. Dengan begitu Anda akan melihat variasi hasil yang biasa. Untuk menyimpulkan perbedaan kecil, mungkin diperlukan lebih banyak pengulangan.
- Ubah satu pengaturan dan ulangi pengujian. Jika perlu reboot, lakukan juga sebelum rangkaian dengan pengaturan awal. Sebelum setiap pengujian, tunggu dengan durasi yang sama.
- Jika memungkinkan, periksa pengaturan awal, lalu yang diubah, kemudian pengaturan awal lagi: A → B → A. Urutan seperti ini membantu memisahkan efek tweak dari pemanasan dan beban latar.
- Simpan semua hasil. Tentukan sebelumnya kegagalan apa yang membuat pengujian tidak layak dibandingkan, misalnya pengujian yang terhenti. Jika Anda mengecualikan suatu pengujian, sebutkan alasannya. Skor rendah saja bukan alasan untuk menghapusnya.
Biarkan resolusi layar dan mode jendela atau layar penuh tetap sama. Jika Anda menguji pengaruh resolusi, ulangi pengujian beberapa kali pada setiap resolusi yang dipilih.
Apa yang dihitung
Section titled “Apa yang dihitung”Δ score, % = 100 × (mean_after / mean_before − 1)CV, % = 100 × sample_standard_deviation / meanBandingkan nilai rata-rata dan variasi antar pengujian. Periksa tidak hanya skor akhir, tetapi juga penilaian terpisah, latensi dalam milidetik, dan kecepatan pelaksanaan beban (throughput). Untuk latensi, selisih negatif biasanya berarti perbaikan; untuk skor, selisih positif berarti kenaikan penilaian.
Untuk memeriksa keterulangan, hitung pengujian penuh. Ribuan frame di dalam satu pengujian tidak menggantikan pengujian berulang: semuanya diperoleh dalam satu sesi dan bergantung pada kondisi yang sama.
Apa yang dapat disimpulkan
Section titled “Apa yang dapat disimpulkan”Perubahan kecil relatif terhadap variasi biasa memerlukan pengulangan tambahan. Ambang universal seperti “semua di atas 1% signifikan” tidak dapat ditetapkan berdasarkan satu rangkaian. Bahkan perbedaan yang berbeda secara statistik bisa terlalu kecil untuk efek praktis.
Diagnostik per blok sudah tertanam dalam hasil: untuk setiap beban disimpan variasi kecepatan pelaksanaan per blok, pergeseran “pertama-terakhir”, dan tren per langkah. Ini memungkinkan penilaian apakah selisih dua pengujian melebihi noise yang teramati di dalamnya, bahkan sebelum pengulangan baru. Rumus yang menggabungkan blok menjadi skor tersedia secara terbuka di perhitungan skor.
Dalam rangkaian delapan pengujian dibandingkan pengulangan dan resolusi pada sistem yang dioptimalkan. Rangkaian ini tidak memuat keadaan yang belum dioptimalkan dan karena itu tidak membuktikan keunggulan dari BoosterX.
Pengujian sintetis membantu meneliti perubahan dalam kerja sistem. Untuk memeriksa manfaat bagi game tertentu, ulangi perbandingan dalam skenario game-nya yang dapat direproduksi.
Terverifikasi: 2026-09-20.
