CPU اور GPU لوڈز
На этой странице
PCBenchmarkX اپنے مصنوعی بوجھ ہر تکرار میں کام کے مقررہ حجم کے ساتھ چلاتا ہے، اس لیے ان کا مختلف سسٹمز کے درمیان موازنہ کیا جا سکتا ہے۔ ایسے ٹیسٹوں میں گیم ریکارڈنگز استعمال نہیں ہوتیں، اور حتمی اعداد «کسی مخصوص گیم میں FPS» کے برابر نہیں ہوتے۔ مکمل پیمائشی چکر طریقہ کار میں بیان کیا گیا ہے۔
اس وقت انجن 0.5.2 اور بوجھ phase4.6-dev-1 استعمال ہو رہے ہیں۔ ورژن کو ذہن میں رکھنا ضروری ہے: منظرنامے کی تبدیلی مختلف ریلیزز کے نتائج کو براہ راست ناقابلِ موازنہ بنا دیتی ہے۔
CPU: اشیاء کی نقل
Заголовок раздела «CPU: اشیاء کی نقل»CPU بلاک میں 65 536 اشیاء کوآرڈینیٹس، رفتاروں اور جھنڈوں کے ساتھ بنائی جاتی ہیں۔ ہر مرحلے پر حرکت، حدود سے ٹکراؤ اور مرئیت کا دوبارہ حساب لگایا جاتا ہے۔ مرکزی تھریڈ پہلے لگاتار 8 192 اشیاء پر کارروائی کرتا ہے، پھر باقی حصہ ورکر تھریڈز کو سونپتا ہے اور متوازی طور پر تیاری کرتا ہے۔ اس کے بعد تھریڈز ہم آہنگ ہوتے ہیں۔
ورکر تھریڈز کی تعداد اس اصول کے مطابق منتخب کی جاتی ہے:
workers = clamp(physical_cores − 1, 1, 6)اگر فزیکل کورز کی تعداد معلوم نہ ہو تو لاجیکل پروسیسرز سے تخمینہ لیا جاتا ہے۔ تھریڈز کے لیے کورز دستی طور پر مقرر نہیں کیے جاتے۔ یہ طریقہ محدود مدد کے ساتھ «ایک مرکزی» تھریڈ کے ماڈل کی نقل کرتا ہے، نہ کہ ہر کور پر مکمل متوازی رن کی۔
اشیاء کی حالت اور گزرنے کی ترتیب ڈیٹرمینسٹک ہے۔ ہر پیمائش سے پہلے CPU سیکشن کی حالت ری سیٹ ہوتی ہے اور 512 تیاری فریمز بغیر شمار انجام دیتی ہے، تاکہ پچھلے رن کی بقایا حالت سیریز میں نہ آئے۔
بوجھ کا ڈیٹرمینزم یکساں وقتِ اجرا کا مطلب نہیں: فریکوئنسیاں، درجہ حرارت، شیڈیولر اور پس منظر کے عمل اب بھی پیمائش پر اثر ڈالتے رہتے ہیں۔
GPU کے تین بوجھ
Заголовок раздела «GPU کے تین بوجھ»GPU حصہ Direct3D 12 کے ذریعے کام کرتا ہے۔ اندرونی ورکنگ ٹیکسچرز کا سائز 1920×1080 مقرر ہے، قطع نظر ونڈو اور ڈیسک ٹاپ کے سائز کے۔
| بوجھ | حسابی کام | کس چیز کو فرق کرنے میں مدد کرتا ہے |
|---|---|---|
| Geometry | منظر کی 6 ڈرائنگز، ہر ایک 9 216 انسٹینسز کے ساتھ، اور پوسٹ پروسیسنگ کے 2 پاسز | جیومیٹری کی کارروائی اور گرافیکل کام کی فراہمی |
| Shader | منظر کی 1 ڈرائنگ، پوسٹ پروسیسنگ کے 16 پاسز، شیڈر پیچیدگی کا پیرامیٹر 24 | پکسل اور ٹیکسچر بوجھ |
| Compute | گرڈ 1920×1080، گروپس 8×8، 96 تکراروں کے ساتھ عددی حسابات | کمپیوٹ شیڈر کا اجرا |
| Combined | CPU نقل اور مقررہ گرافیکل پائپ لائن | CPU، ڈرائیور اور GPU کا مشترکہ کام |
یہ الگ الگ منظرنامے ہیں جن میں کام کا حجم مختلف ہے۔ مثلاً، Compute کے 8 000 مشروط فریمز کو گیم میں 8 000 FPS کے طور پر نہیں پڑھا جا سکتا اور نہ ہی Geometry کے 800 فریمز سے براہ راست موازنہ کیا جا سکتا ہے۔ یکجا کرنے کے لیے منظرنامے کے مطابق نارملائزیشن استعمال ہوتی ہے، جو اسکور کے حساب میں بیان کی گئی ہے۔
بوجھ پورٹیبل صلاحیت کی سطح پر لکھے گئے ہیں: shader model 5.0 اور feature level 11_0 بغیر وینڈر ایکسٹینشنز کے۔ ایک ہی کوڈ مختلف نسلوں اور ویڈیو کارڈ مینوفیکچررز پر چلتا ہے، بغیر کسی مخصوص وینڈر کے لیے الگ برانچ کے۔
پیمائشوں کے بعد انجن ہر GPU بوجھ کے آؤٹ پٹ کی جانچ کرتا ہے: Geometry، Shader، Compute، Combined اور لوڈ شدہ تاخیر ٹیسٹ کے لیے ایک کنٹرول سگنیچر محفوظ ہے — نتیجے کے ایک چھوٹے ٹکڑے کی متوقع شکل۔ مکمل ہونے کے بعد پڑھا گیا ٹکڑا متوقع سے موازنہ کیا جاتا ہے؛ عدم مطابقت کا مطلب ہے کہ بوجھ غلط طریقے سے انجام پایا، اور یہ رن کو ناقابلِ استعمال بنا دیتی ہے۔ جانچ شمار شدہ پیمائشوں کے بعد کی جاتی ہے اور خود اعداد پر اثر نہیں ڈالتی۔
اس سیٹ میں ڈسک کی رفتار اور RAM کی تھروپٹ کے الگ ٹیسٹ نہیں ہیں۔ میموری اور ڈرائیور بوجھ کے اجرا پر اثر ڈالتے ہیں، تاہم بینچ مارک SSD اور RAM کے الگ تخمینے نہیں نکالتا۔
بلاکس کی تکرار
Заголовок раздела «بلاکس کی تکرار»کارکردگی کے پانچ بوجھ تین راؤنڈز میں ترتیب کی تبدیلی کے ساتھ انجام دیے جاتے ہیں:
| راؤنڈ | ترتیب |
|---|---|
| 1 | CPU → Geometry → Shader → Compute → Combined |
| 2 | Shader → Compute → Combined → CPU → Geometry |
| 3 | Combined → CPU → Geometry → Shader → Compute |
ترتیب میں ہر بوجھ کی جگہ راؤنڈ بہ راؤنڈ بدلتی ہے۔ یہ اس کے اثر کو موازنے پر کم کرتی ہے۔ وارم اپ اب بھی نتائج بدل سکتا ہے، اس لیے بلاکس کے لیے اضافی طور پر اجرا کی رفتار کا پھیلاؤ اور پہلے بلاک سے آخری بلاک تک اس کی تبدیلی محفوظ کی جاتی ہے۔
منظرنامے کی تشخیص کے لیے اس کے تین بلاکس کی تھروپٹ کا حسابی اوسط لیا جاتا ہے۔ بلاکس کا میڈین اور جیومیٹرک اوسط اضافی تشخیص کے طور پر دیکھا جا سکتا ہے، لیکن حتمی اشاریہ پھر بھی اسی اوسط پر رہتا ہے۔
کم ریزولوشن بنیادی ٹیسٹ کو کیوں آسان نہیں بناتا
Заголовок раздела «کم ریزولوشن بنیادی ٹیسٹ کو کیوں آسان نہیں بناتا»CPU، GPU اور Combined بوجھ اسکرین بفر سے باہر انجام دیے جاتے ہیں۔ ان کا کمانڈ جمع کرنے کا راستہ Present کو متحرک نہیں کرتا اور پریزنٹیشن قطار کی حد کا انتظار نہیں کرتا۔ اندرونی ٹیکسچرز 1920×1080 رہتے ہیں، چاہے ڈیسک ٹاپ 800×600 پر سوئچ کر دیا جائے۔
انٹرفیس اور تاخیر ٹیسٹ الگ آؤٹ پٹ راستے سے کام کرتے ہیں۔ اس لیے ڈیسک ٹاپ کی ریزولوشن کی تبدیلی بذات خود بوجھ کو آسان نہیں بناتی۔ پھر بھی کسی بھی ریزولوشن پر «بالکل یکساں» نتیجہ پڑھنا ممکن نہیں: آؤٹ پٹ حصے میں ڈرائیور اور سسٹم کی موجودہ حالت شامل ہوتے ہیں۔
1920×1080، 1280×768 اور 800×600 کے ساتھ عملی جانچ تکرار کے بارے میں مضمون میں دی گئی ہے۔
بیان کردہ عمل درآمد کے لیے جانچا گیا: 2026-09-20۔
