Перейти до вмісту

Методика бенчмарку

На цій сторінці

PCBenchmarkX вимірює виконання заданих CPU/GPU-сценаріїв і затримку реакції на програмний сигнал. Обсяг роботи фіксований, формули оцінювання відкриті. Повторні запуски дають змогу перевірити стійкість результату.

Ця документація стосується движка 0.5.2, навантаження phase4.6-dev-1, статистики stats-phase4.6-v1 і моделі score-model-1.2-candidate-1. У назві моделі використовується Candidate. Її нормувальні значення попередні: їх не можна вважати середніми показниками всіх комп’ютерів. Докладніше про еталон розказано в розрахунку балів.

BoosterX керує запуском окремого нативного движка, показує хід тесту та зберігає результат. На час вимірювання він призупиняє власний моніторинг обладнання й пам’яті та згортає свої вікна, потім відновлює їхній стан. Це зменшує вплив самого інтерфейсу BoosterX; зовнішні програми все одно можуть створювати навантаження.

Повторюйте тести з однією версією движка й драйвера, однаковими налаштуваннями живлення, розгону та охолодження. Закрийте зайві фонові програми. Якщо у вас ноутбук, виконуйте всі тести з під’єднаним зарядним пристроєм. Під час порівняння до і після зміни запишіть, яке саме налаштування ви змінили.

Частина запуску Задана тривалість Призначення
Прогрів 15 с Підготувати навантаження до залікових вимірювань
CPU 20 с сумарно Три блоки приблизно по 6,67 с
GPU 30 с сумарно По 10 с на Geometry, Shader і Compute, кожен у трьох блоках
Combined 30 с сумарно Три блоки по 10 с
Калібрування 10 с Підібрати складність Loaded Latency
Прогрів затримки 2 с Підготувати окремий шлях вимірювання затримки
Baseline Latency 5 с Виміряти затримку за базового навантаження
Loaded Latency 20 с Виміряти затримку за каліброваного навантаження

Переходи, підготовка ресурсів, попередні CPU-кадри та завершення додають час. Тому загальний час запуску більший за суму вимірюваних етапів: у перевіреній серії інтервали між початками сусідніх запусків в одному завантаженні становили приблизно 157–172 секунди — з урахуванням паузи між запусками; точну тривалість одного запуску з опублікованих даних визначити неможливо.

Блоки тестів продуктивності чергуються в трьох раундах. У CPU перед кожним заліковим блоком фіксований початковий стан і 512 підготовчих кадрів. Якщо швидкість роботи поступово змінюється від блоку до блоку, це відображається в діагностиці. Отримані результати при цьому не коригуються.

Профілі запуску та тривалості

Section titled “Профілі запуску та тривалості”

Движок підтримує чотири профілі: candidate, quick, extended і custom. Точні тривалості етапів:

Профіль Задача Перехід Прогрів CPU GPU Combined Калібрування Прогрів затримки Baseline Loaded
Candidate канонічний 0,5 с 15 с 20 с 30 с 30 с 10 с 2 с 5 с 20 с
Quick діагностичний 0,25 с 7,5 с 10 с 15 с 15 с 5 с 1 с 2,5 с 10 с
Extended діагностичний 1 с 30 с 40 с 60 с 60 с 20 с 4 с 10 с 40 с
Custom користувацький за вибором користувача в допустимих межах

Candidate — профіль за замовчуванням, і лише його запуски ранжуються. Quick, Extended і Custom завжди вважаються діагностичними: їх не можна змішувати з Candidate в одному порівнянні й не можна публікувати в рейтинг. У Custom можна залишити частину тестів і задати свої тривалості: залікові блоки приймають 1–180 с, переходи — 0,1–180 с, прогрів затримки — 0,5–180 с. Будь-яке перевизначення тривалості робить запуск діагностичним.

Збір без запису на диск у кожному кадрі

Section titled “Збір без запису на диск у кожному кадрі”

Вимірювання зберігаються в заздалегідь виділені блоки пам’яті. Під час збору кожного кадру програма не форматує JSON, не розширює вектор і не пише у файл. Розмір буферів розраховується заздалегідь за тривалістю тесту та очікуваною максимальною частотою записів, із запасом. У цій реалізації діє обмеження 768 МіБ.

Після завершення GPU-роботи дані об’єднуються й обробляються. Це зменшує вплив збору даних на тест, хоча сам збір теж витрачає ресурси. Щоб виміряти його вплив, потрібно окремо порівняти запуски зі збором вимірювань і без нього.

Результат містить зведені метрики. Окремий файл вихідних вимірювань дає змогу повторити статистичну обробку без нового виконання навантаження. Такий перерахунок перевіряє обчислення; для перевірки повторюваності на обладнанні потрібен новий запуск.

Якість запуску та непридатність результату

Section titled “Якість запуску та непридатність результату”

Під час кожного блоку движок оцінює якість запуску — Run Quality. Основний показник — фонове завантаження CPU, тобто все, що навантажує систему крім самого бенчмарку. Воно обчислюється за блок як різниця між завантаженням усієї системи та завантаженням процесу бенчмарку, виміряними за одними й тими самими лічильниками часу. Порогові значення для профілю Candidate: вище 20% — попередження, вище 50% — запуск визнається непридатним.

Run Quality також фіксує супутні умови: під’єднаний налагоджувач, віддалену сесію, живлення від батареї та режим економії заряду, наявність гіпервізора, втрату фокуса вікна та зміну дисплея. Гіпервізор, батарея та віддалена сесія розкриваються як попередження: самі по собі вони результат не відхиляють, але пояснюють, чому числа можуть відрізнятися від «чистого» стенда. Зміна дисплея під час залікового блоку робить запуск непридатним.

Придатний заліковий результат додатково вимагає:

  • успішного калібрування Loaded Latency — якщо підібрати складність під цільовий час не вдалося, запуск непридатний;
  • пройденої перевірки виходу GPU-навантажень — незбіг контрольної сигнатури робить запуск непридатним;
  • відсутності втрачених записів колектора — будь-яка втрата робить запуск непридатним.

Класифікація якості зберігається у файлі результату, тому «погані» умови видно постфактум, а не лише під час запуску.

Показник Сенс
Performance Відносна швидкість фіксованих навантажень
Core Latency Score Відносна оцінка внутрішньої затримки; більше балів краще
Consistency Вираженість повільного хвоста всередині запуску
PC Score Геометричне об’єднання трьох компонентів із вагами 50/30/20

Реальні затримки показуються в мілісекундах, і для них менше краще. Consistency не можна змішувати з повторюваністю PC Score між запусками. Формули та нормувальні константи відкриті в розрахунку балів.

  • Синтетичний сценарій допомагає виявляти зміни системи, але не замінює тест конкретної гри.
  • Низький міжзапусковий розкид ще не доводить точність кожної часової позначки або відсутність систематичної похибки.
  • Вісім запусків одного ПК не встановлюють розподіл результатів для всіх CPU, GPU і версій Windows.
  • Порівнюйте сумісні версії навантажень і однакові профілі. Прискорений, розширений і користувацький профілі не можна безумовно змішувати з Candidate.
  • Скасований або неповний запуск не використовуйте замість завершеного вимірювання.

Далі: навантаження, затримки та PresentMon, формули, повторюваність, порівняння запусків, рейтинг.

Перевірено: 2026-09-20.