Xobinٹیلنٹ کی تشخیص اور AI بھرتی سافٹ ویئر کی تلاش کر رہے ہیں؟Xobin کو چیک کریں
← مضامین§ تکنیکی دستاویزات

Xobin سائیکومیٹرکس ٹیسٹ: قابلِ اعتماد اور توثیق کے شواہد

Xobin کے حالات کے فیصلے کے ٹیسٹ (SJT) کے پیچھے مکمل تکنیکی دستاویزات: سلوکی ماڈل، ٹیسٹ کیسے بنایا گیا، اور 2021 اور 2024 کے درمیان کیے گئے اعتبار، درستگی اور انصاف کے مطالعے۔

Xobin Research/2025/تکنیکی دستاویزات/ورژن 2.9.1

مصنف

Guruprakash Sivabalan

بانی، Xobin۔ تشخیصی سائنس، نفسیاتی توثیق، اور Xobin Capability Graph پر Xobin Research پروگرام کی قیادت کرتا ہے۔

LinkedIn →

یہ مضمون Xobin نفسیاتی ٹیسٹ (SJT) کی تکنیکی دستاویزات کی رپورٹ، ورژن 2.9.1 کا خلاصہ پیش کرتا ہے، جو 2021 اور 2024 کے درمیان کی گئی قابل اعتماد اور درستگی کے مطالعات کا احاطہ کرتا ہے۔ آئٹم کا مواد، اسکورنگ کیز اور بنیادی امیدوار کی سطح کے ڈیٹا سیٹس ملکیتی اور خفیہ رہتے ہیں؛ یہاں رپورٹ کردہ اعداد و شمار تکنیکی دستی سے حاصل کیے گئے ہیں۔

01 ·

انتظامی خلاصہ

Xobin کی صنعتی-تنظیمی (I/O) ماہر نفسیات اور نفسیاتی ماہرین کی ٹیم نے بڑے پیمانے پر بھرتی، پیشہ ورانہ تشخیص، اور قیادت کی ترقی کے لیے انٹرپرائز پیمانے پر استعمال کے لیے ایک وسیع بنیاد پر نفسیاتی تشخیص ڈیزائن کی۔

ترقی دو راستوں پر ہوئی۔ پہلے نے شخصیت کی نفسیات، قیادت کی سائنس، جذباتی ذہانت، اور تنقیدی سوچ میں موجودہ تحقیق پر مبنی ایک مربوط سلوکی ماڈل بنایا۔ دوسرے نے ایک صورتحال کے فیصلے کے ٹیسٹ (SJT) کو ڈیزائن اور درست کیا جو ان سلوکی صلاحیتوں کو درست اور مؤثر طریقے سے، عالمی ملازمتوں کے کرداروں میں متعلقہ، منصفانہ، اور پیش گوئی کی درستگی کے ساتھ ناپتا ہے۔

یہ ٹیسٹ انٹرپرائز ایچ آر ٹیموں کو بھرتی اور ترقی کے سیاق و سباق میں امیدوار کے رویے کی ایک قابل اعتماد، جامع تشخیص فراہم کرتا ہے۔ شائع شدہ تحقیق سے پتہ چلتا ہے کہ نفسیاتی ٹیسٹنگ کا استعمال کرنے والی تنظیمیں بھرتی کی کامیابی کو 40% تک بہتر بنا سکتی ہیں اور ملازمین کی برقرار رکھنے کی شرح کو 24% تک بڑھا سکتی ہیں۔ یہ فوائد کم ہونے والے ٹرن اوور کے اخراجات، زیادہ موثر ٹیموں، اور بہتر کارکردگی میں تبدیل ہوتے ہیں۔

تشخیص کی سالمیت ڈیزائن کے مرکز میں ہے۔ یہ ٹیسٹ شخصیت، سیکھنے کی چستی، قیادت، جذباتی ذہانت (EQ)، اور تنقیدی سوچ میں قائم کردہ فریم ورک کو یکجا کرتا ہے، اور حقیقی کام کے منظرنامے پیش کرتا ہے جن میں امیدوار کے فیصلے بنیادی خصوصیات اور فیصلہ سازی کے انداز کو ظاہر کرتے ہیں۔ قابلیت کے اسکیلز کی داخلی مستقل مزاجی اچھی سے بہترین (Cronbach's α ≈ 0.6–0.8) تک ہوتی ہے، ٹیسٹ-ری ٹیسٹ کے مطالعے وقت کے ساتھ مستحکم نتائج دکھاتے ہیں، اور مجبور انتخاب SJT فارمیٹ روایتی خود رپورٹنگ کے سوالناموں کی نسبت واضح طور پر جعل سازی کے لیے کم حساس ہوتا ہے۔

02 ·

عالمی اطلاق اور شعبے کی ہم آہنگی

یہ ٹیسٹ عالمی اطلاق اور بین الصنعتی اہمیت کے لیے ڈیزائن اور توثیق کیا گیا ہے۔ اسے امریکہ، یورپ، مشرق وسطی، جنوبی ایشیا، اور ایشیا پیسیفک میں مقامی بنایا گیا ہے اور معیاری بنایا گیا ہے۔ مقامی کاری میں نہ صرف 15+ زبانوں میں ترجمہ شامل ہے بلکہ منظرناموں کی ثقافتی موافقت بھی شامل ہے تاکہ سیاق و سباق کی مناسبیت اور آبادیوں کے درمیان تشریحی مساوات کو برقرار رکھا جا سکے۔

تشخیص نے درج ذیل میں عملی اثر پذیری کا مظاہرہ کیا ہے:

  • ·معلوماتی ٹیکنالوجی اور سافٹ ویئر کی ترقی
  • ·ادویات اور زندگی کی سائنسیں
  • ·بینکنگ، مالی خدمات اور انشورنس (BFSI)
  • ·تیز رفتار صارفین کی اشیاء (FMCG)
  • ·خرید و فروخت
  • ·انجینئرنگ، مینوفیکچرنگ اور بنیادی صنعتی شعبے
  • ·توانائی اور خدمات
  • ·پیشہ ورانہ اور مشاورتی خدمات
  • ·صحت کی دیکھ بھال اور ہسپتال کی انتظامیہ

ان عمودیوں کے اندر، یہ ابتدائی سطح کے کرداروں کی بڑی تعداد میں اسکریننگ، پیشہ ورانہ اور درمیانی سطح کی پوزیشنوں کے لئے سلوکی پروفائلنگ، اور انتظامی اور ایگزیکٹو ترقی کے ٹریک کے لئے قیادت کی صلاحیت کی تشخیص کے لئے استعمال کیا جاتا ہے۔ صنعت کے مخصوص بینچ مارکس اور اصول کے اعداد و شمار انفرادی اسکورز کو متعلقہ شعبے کے معیار کے خلاف تشریح کرنے کی اجازت دیتے ہیں نہ کہ ایک ہی عالمی اوسط کے خلاف۔

03 ·

نفسیاتی معیارات کے ساتھ ہم آہنگی

Xobin کی ترقی کی طریقہ کار برطانوی نفسیاتی سوسائٹی (BPS) اور بین الاقوامی ٹیسٹ کمیشن (ITC) کے پیشہ ورانہ تشخیص کے معیار کی پابندی کرتی ہے۔ آئٹم کی ترقی کا لائف سائیکل شامل تھا:

  • ·جامع قابلیت ماڈلنگ اور ملازمت کا تجزیہ
  • ·2,000 سے زائد پائلٹ آئٹمز کی ترقی، ملازمت کی سطحوں کے لحاظ سے درجہ بند
  • ·کئی مراحل کی پائلٹنگ، بشمول کلاسیکی آئٹم تجزیہ اور آئٹم جواب نظریہ (IRT) کی کیلیبریشن
  • ·آئٹم کی سطح کے تعصب، مشکل کے اشاریے اور تفریق کے پیرامیٹرز کا معائنہ
  • ·ٹیسٹ کی لمبائی اور نفسیاتی کارکردگی کو بہتر بنانے کے لیے مونٹی کارلو کی سمولیشن
  • ·ذیلی گروپ کی منصفانہ، لسانی غیر جانبداری اور آبادیات کے درمیان اسکور کی عمومی حیثیت کی تصدیق

یہ نقطہ نظر اس بات کو یقینی بناتا ہے کہ ہر صورتحال کی ترغیب اور جواب کا اختیار ایک ملازمت سے متعلق سلوکی ڈھانچے کی عکاسی کرتا ہے، آبادیوں کے درمیان مستقل طور پر کام کرتا ہے، اور خصوصیت کی تخمینہ میں معنی خیز طور پر حصہ ڈالتا ہے۔ صورتحال کے فیصلے کی اشیاء نے مشکل، امتیاز، اور تعصب کی عدم موجودگی پر اس بات کی تصدیق کے لیے باریک بینی سے پائلٹ اور تجزیات کا سامنا کیا، جس سے ایک شماریاتی طور پر مضبوط، ڈھانچہ-valid ٹول تیار ہوا جو عملے کے انتخاب میں بین الاقوامی بہترین طریقوں کے ساتھ ہم آہنگ ہے۔

04 ·

طرز عمل کا ماڈل اور فریم ورک

ماڈل شخصیت کے بڑے پانچ (OCEAN) ڈھانچے پر مبنی ہے: اوپننس، ذمہ داری، خارجیت، ہم آہنگی، اور جذباتی استحکام (نیوروٹزم الٹ)۔ یہ قیادت، جذباتی ذہانت اور تنقیدی سوچ کی تحقیق سے تصورات سے مالا مال ہے تاکہ یہ روایتی شخصیت کے ٹیسٹ سے زیادہ مکمل طور پر ورک پلیس کے رویے کو پکڑ سکے۔

سیکھنے کی چستی (لومبارڈو اور آئچنگر)

سیکھنے کی چستی نئی صلاحیتیں سیکھنے کی خواہش اور صلاحیت ہے تاکہ پہلی بار، مشکل یا مختلف حالات میں کارکردگی کا مظاہرہ کیا جا سکے۔ عملی طور پر یہ موافقت، فیڈبیک کے لیے کھلاپن، جدت، اور تیز سیکھنے میں تبدیل ہو جاتا ہے، یہ خصوصیات یہ ظاہر کرتی ہیں کہ آیا کوئی شخص متحرک ماحول میں کامیاب ہوگا، اور غیر مستحکم سیاق و سباق میں قیادت کی صلاحیت کا ایک اہم پیش گو ہے۔

قیادت (اسکولر کی تین سطحیں)

Scouller (2011) کا کہنا ہے کہ قیادت ذاتی، نجی اور عوامی سطح پر کام کرتی ہے: خود آگاہی اور خود پر قابو، ایک سے ایک بین الفردی مہارت، اور ٹیم یا تنظیمی قیادت۔ خود اعتمادی، دیانت، کوچنگ کی صلاحیت، اثر و رسوخ اور وژن جیسے خصائل ان سطحوں پر نقشہ بناتے ہیں، لہذا یہ ٹیسٹ انفرادی شراکت داروں اور مستقبل کے رہنماؤں دونوں کی ضرورت کی مہارتوں کا احاطہ کرتا ہے۔

جذباتی ذہانت (گولمین)

گولمین کا EQ فریم ورک، جو خود آگاہی، خود ضابطہ، تحریک، ہمدردی اور سماجی مہارتوں کا احاطہ کرتا ہے، دباؤ کے تحت جذبات کو منظم کرنے، ساتھیوں یا صارفین کے ساتھ ہمدردی دکھانے، اور تنازعہ کو نیویگیٹ کرنے کے بارے میں منظرناموں کے ذریعے استعمال کیا جاتا ہے۔ یہ رویے ٹیم ورک، صارف کے سامنے کام، اور قیادت کے لیے اہم ہیں، اور خالص استدلال سے آگے بین الفردی اثرات اور جذباتی خود انتظام میں پیمائش کو بڑھاتے ہیں۔

تنقیدی سوچ کی خصوصیات (Facione)

Facione et al. (1995) تنقیدی سوچ کی عادت کو ذہنی تجسس، کھلے ذہنیت، اور مسائل پر منطقی طور پر غور کرنے کی عادت کے طور پر بیان کرتے ہیں۔ یہ تجزیاتی سوچ، فیصلہ سازی کی معیار، مسئلہ حل کرنے اور خطرے کے انتظام کے طور پر ظاہر ہوتا ہے: منظرنامے یہ ظاہر کرتے ہیں کہ آیا ایک امیدوار شواہد اور منطق پر فیصلہ کرتا ہے یا جذبات اور تعصب پر، یہ ناپتے ہیں کہ لوگ دقتوں کے بارے میں کیسے سوچتے ہیں، نہ کہ صرف یہ کہ وہ دوسروں کے ساتھ کیسا سلوک کرتے ہیں۔

اضافی کام کی جگہ کی قابلیتیں

ادبیات کا جائزہ اور صنعت کی معلومات نے ان خصوصیات کی نشاندہی کی جو بڑی پانچ مکمل طور پر نہیں ڈھانپتی۔ عاجزی اور دیانت، یعنی ایمانداری، عاجزی، اور غلطیوں کا اعتراف کرنا بجائے الزام منتقل کرنے کے، HEXACO کے ایمانداری-عاجزی عنصر کے ساتھ ہم آہنگ ہیں (ایشٹن اور لی، 2007)۔ لچک اور عزم، ڈک ورتھ وغیرہ (2007) سے اخذ کردہ، جذباتی استحکام کی تکمیل کرتے ہیں جو مستقل کوشش اور ناکامیوں سے بحالی پر توجہ مرکوز کرتے ہیں۔ مجموعی طور پر ماڈل 50+ مخصوص صلاحیتوں کا احاطہ کرتا ہے، اعتماد اور تعاون کی تعمیر سے لے کر جدت اور اسٹریٹجک سوچ تک، ہر ایک اوپر دیے گئے فریم ورک میں سے ایک یا زیادہ کے ساتھ نظریاتی طور پر جڑا ہوا ہے۔

05 ·

چھ صلاحیت کے ڈومین

50+ صلاحیتوں کو اسکورنگ اور تشریح کے لیے چھ وسیع ڈومینز میں منظم کیا گیا ہے۔ اسکورز کو پہلو کی سطح پر رپورٹ کیا جاتا ہے اور ڈومین کی سطح پر جمع کیا جاتا ہے۔

ڈرائیو اور عملدرآمد

قابل اعتماد · پہل · مستقل مزاجی · معیار پر توجہ · عزم

کامیابی پر مبنی خصوصیات بڑی حد تک ذمہ داری سے متعلق ہیں، اس کے ساتھ ساتھ قیادت کی تحریک کے عزائم اور طاقت کے پہلو بھی۔ زیادہ اسکور کرنے والے قابل اعتماد، نتائج پر مرکوز اور مستقل ہیں؛ کم اسکور کرنے والے اہداف کے بارے میں زیادہ آرام دہ یا لچکدار ہیں۔ یہ دوسرے ماڈلز کے ساتھ ہم آہنگ ہے جو کام کے انداز کو کہتے ہیں: منصوبہ بند اور نظم و ضبط والا ہونا۔

ڈھلنے کی صلاحیت اور سیکھنا

لچک · تخلیقی سوچ · تجربے کے لیے کھلاپن · مسلسل سیکھنا

اوپننس اور سیکھنے کی چستی سے متعلق خصوصیات۔ زیادہ اسکور کرنے والے کھلے ذہن کے ہوتے ہیں اور نئی مہارتیں حاصل کرنے یا تبدیلی کے مطابق ڈھالنے میں تیز ہوتے ہیں؛ کم اسکور کرنے والے واقف طریقوں کو ترجیح دیتے ہیں لیکن مستقل مزاجی اور عملی توجہ پیش کرتے ہیں۔ یہ ڈومین فاسیون کی تجزیاتی تجسس کو لومبارڈو اور ایچنگر کی سیکھنے کی چستی کے ساتھ ملا دیتا ہے۔

اثر اور قیادت

حوصلہ مندی · قائل کرنے کی صلاحیت · تفویض · اسٹریٹجک وژن · عزائم

خارجیت سے متعلق پہلو اور قیادت کی خواہش۔ زیادہ اسکور کرنے والے رہنما کے طور پر ابھرتے ہیں، فیصلے کرنے اور ٹیم کی سمت کو کنٹرول کرنے میں آرام دہ ہوتے ہیں۔ کم اسکور کرنے والے ٹیم کے کھلاڑی یا انفرادی شراکت دار ہوتے ہیں جو توجہ سے بچتے ہیں۔ یہ ڈومین انتظامی اور سیلز قیادت کی صلاحیت کا اشارہ دیتا ہے، جو Scouller کی عوامی قیادت کی سطح کے مطابق ہے۔

بین الفردی اور ٹیم ورک

ہمدردی · اعتماد کی تعمیر · تنازعہ حل · مواصلات · عاجزی · سفارتکاری · تنوع اور شمولیت

اتفاق پسندی اور سماجی-جذباتی ذہانت پر مرکوز۔ زیادہ اسکور کرنے والے تعاون کرنے والے، ہمدرد اور ٹیم کے لحاظ سے ہیں، مثبت تعلقات قائم کرتے ہیں اور گروپ کے مقاصد کو خود پر ترجیح دیتے ہیں۔ کم اسکور کرنے والے زیادہ تر کام پر توجہ مرکوز یا آزاد ہو سکتے ہیں، کبھی کبھار نرمی کی قیمت پر۔ یہ تعاون، کسٹمر سروس، اور قیادت کے لیے موزوں ہونے کی نشاندہی کرتا ہے، نجی، بین الفردی سطح پر.

جذباتی لچک اور خود انتظام

تناؤ کی برداشت · مثبتیت اور امید · خود آگاہی · خواہشات پر قابو

جذباتی استحکام اور جذباتی ذہانت کے خود ضابطے کے پہلو سے ہم آہنگ ہے۔ اعلیٰ اسکور کرنے والے دباؤ میں پرسکون رہتے ہیں، ناکامیوں سے بحال ہوتے ہیں اور پرامید رہتے ہیں۔ کم اسکور کرنے والے دباؤ میں اضطراب محسوس کر سکتے ہیں لیکن جذبات کے ساتھ زیادہ شفاف ہو سکتے ہیں۔ خاص طور پر اعلیٰ دباؤ کے کرداروں اور ذاتی سطح پر قیادت کے لیے اہم ہے۔

تنقیدی سوچ اور فیصلہ سازی

فیصلے کا معیار · فیصلہ · شواہد کے لیے کھلاپن · خطرے کا انتظام · اخلاقی استدلال

شخصیت کی تشخیصات میں غیر معمولی، یہ ڈومین مسئلہ حل کرنے میں علمی-سلوکی رجحانات کا اندازہ لگاتا ہے بغیر کہ یہ ایک خالص قابلیت کا ٹیسٹ ہو۔ زیادہ اسکور کرنے والے تجارتی فوائد کا وزن کرتے ہیں، طویل مدتی نتائج پر غور کرتے ہیں اور شواہد کی بنیاد پر فیصلہ کرتے ہیں؛ کم اسکور کرنے والے بدیہی یا جلدی فیصلہ کرتے ہیں، جو سادہ کاموں پر موثر ہے اور پیچیدہ کاموں پر خطرناک ہے۔

ماڈل کو تدریجی طور پر بنایا گیا: Xobin کے I/O ماہر نفسیات نے بڑے پانچ کے ڈھانچے سے شروع کیا، پھر جذباتی ذہانت، سیکھنے کی چستی اور حقیقی قیادت کے تصورات کو اس پر نقشہ بنایا یا گروپ کیا تاکہ کچھ بھی اہم نہ رہ جائے: عاجزی اور ہمدردی کو بین الشخصی میں، عزم اور طاقت کو اثر و رسوخ اور قیادت میں گروپ کیا۔ ماہر کے فیصلے اور عنصر تجزیاتی تحقیق نے ایک ماڈل تیار کیا جو علمی، بین الشخصی، قیادت، موافقت اور ذاتی محرک کے شعبوں کا احاطہ کرتا ہے جو ملازمت کی کارکردگی اور صلاحیت کی پیش گوئی کرتا ہے۔

06 ·

تشخیص کی طریقہ کار

یہ ٹیسٹ ایک صورتحال کے فیصلے کے فارمیٹ کا استعمال کرتا ہے جس میں ایک ipsative، مجبور انتخاب کا جواب ڈیزائن ہوتا ہے، جسے درستگی، جعل سازی کے خلاف مزاحمت، اور عالمی، اعلی خطرے کے استعمال کے لیے موزوں بنانے کے لیے منتخب کیا گیا ہے۔

حالاتی فیصلہ سازی کا فارمیٹ۔ ہر آئٹم ایک مختصر، حقیقت پسندانہ کام کی جگہ کے منظر نامے کو پیش کرتا ہے جو ایک چیلنج، تنازعہ یا کام کی وضاحت کرتا ہے، جو اہم واقعات اور مختلف صنعتوں میں موضوع کے ماہر کی معلومات سے بنایا گیا ہے۔ ممکنہ اقدامات کا ایک سیٹ اس کے بعد آتا ہے۔ مثال کے طور پر، ایک پروجیکٹ کی رکاوٹ جہاں اختیارات میں کام سنبھالنا اور دوبارہ مختص کرنا، خاموشی سے مسائل حل کرنا، یا ٹیم سے رائے لینا شامل ہیں۔ یہاں کوئی واضح صحیح یا غلط جواب نہیں ہیں؛ ہر اختیار ایک مختلف صلاحیت کا اظہار کرتا ہے۔ امیدوار اختیارات کو سب سے زیادہ سے کم ممکنہ طور پر درجہ بند کرتے ہیں، یا اپنے پسندیدہ اور ناپسندیدہ عمل کا انتخاب کرتے ہیں۔ یہ شکل اعلیٰ چہرے کی درستگی اور مشغولیت فراہم کرتی ہے، اور مضبوط معیار کی درستگی: تحقیق کے کئی دہائیوں نے اوسط SJT کی درستگی کو تقریباً 0.20–0.30 کے ارد گرد رکھا۔ اہم بات یہ ہے کہ شخصیت کی پیمائش کرنے والے SJTs خصوصیات اور ملازمت کے نتائج کے ساتھ مربوط ہوتے ہیں جبکہ جان بوجھ کر جعل سازی کے لیے بہت کم حساس ہوتے ہیں، کیونکہ وہ خصوصیات کو سیاق و سباق میں لنگر انداز کرتے ہیں بجائے اس کے کہ ان کے بارے میں براہ راست پوچھیں۔

لمبائی اور شکل۔ معیاری ٹیسٹ تقریباً 40 منظرنامہ پر مبنی اشیاء پر مشتمل ہے جو 50+ صلاحیتوں کا احاطہ کرتا ہے۔ ہر منظرنامہ تین سے چار اختیارات پیش کرتا ہے اور ایک سے دو منٹ لیتا ہے، جس سے کل ٹیسٹنگ کا وقت تقریباً 45–50 منٹ ہوتا ہے۔ لمبائی مونٹی کارلو سمولیشن کے ذریعے طے کی گئی: وسیع پیمانے پر اندرونی مستقل مزاجی قابل قبول سطحوں (α > 0.70) کو تقریباً 20 منظرناموں پر عبور کرتی ہے اور 40 پر اپنے زیادہ سے زیادہ قریب پہنچتی ہے۔

شکل 1. مونٹی کارلو سمولیشن: ٹیسٹ کی لمبائی بمقابلہ اعتبار
SJT آئٹمز کی تعدادمُشَابہت کی قابل اعتمادیت (α)
50.28
100.46
150.59
200.68
250.73
300.77
350.80
400.82
450.83
500.84

قابل اعتماد زیادہ منظرناموں کے ساتھ بڑھتا ہے اور تقریباً 40 اشیاء کے قریب 0.82–0.85 پر پلیٹوں پر آتا ہے۔ Xobin نے اعلیٰ قابل اعتماد کو محفوظ رکھنے کے لیے ~40 اشیاء کا انتخاب کیا جبکہ ٹیسٹ کو مؤثر رکھا۔

انتظامیہ اور سیکیورٹی۔ یہ ٹیسٹ آن لائن اور بغیر نگرانی کے منعقد کیا جاتا ہے، جدید دور کی دور دراز بھرتی کو تسلیم کرتے ہوئے۔ سوالات اور اختیارات کا ترتیب ہر امیدوار کے لیے بے ترتیب ہوتا ہے؛ ایک بڑی اشیاء کی پول جواب کے اشتراک کو روکتی ہے؛ اور AI کے ذریعے ٹائم اسٹیمپ اور ٹیلی میٹری کا تجزیہ کیا جاتا ہے تاکہ دھوکہ دہی یا اشیاء کی پیشگی معلومات جیسے غیر معمولی پیٹرن کا پتہ لگایا جا سکے۔ ایڈاپٹیو آئٹم انتخاب کا مطلب ہے کہ دو امیدوار شاذ و نادر ہی ایک ہی منظرناموں کا سیٹ دیکھتے ہیں۔ یہ پلیٹ فارم موبائل دوستانہ اور قابل رسائی ہے، جس میں چیک ہیں جو تیز اندازے کی حوصلہ شکنی کرتے ہیں۔

اسکور کی رپورٹنگ۔ رپورٹس ہر وسیع شعبے میں امیدوار کی پروفائل بناتی ہیں اور 50 پہلوؤں میں طاقتوں اور ممکنہ خدشات کو اجاگر کرتی ہیں، ایک کاروباری طرز کی شکل میں جو گراف کو بیانیے کے ساتھ ملا دیتی ہے۔ ایک امیدوار کو ایڈاپٹ ایبلٹی اور سیکھنے اور بین الشخصی میں اعلیٰ پڑھا جا سکتا ہے، تنقیدی سوچ میں معتدل اور ڈرائیو اور عمل درآمد میں کم، تشریحی متن کے ساتھ جو وضاحت کرتا ہے کہ یہ پروفائل کام پر کیسے ظاہر ہوتا ہے۔ اسکورز کو متعلقہ معیارات (عالمی، صنعت، یا ملازمت کی سطح) کے ساتھ بینچ مارک کیا جا سکتا ہے، اور نظام خطرے میں موجود اسکورز کو نشان زد کرتا ہے جہاں مستقل مزاجی کی جانچ سے اس امیدوار کے جوابات کے لیے کم قابل اعتماد کی تجویز ملتی ہے۔

ہر ڈیزائن کا فیصلہ، کام کے منظرناموں سے لے کر مجبور انتخاب تک اور AI اسکورنگ تک، پروجیکٹ کے آغاز پر طے کردہ چار رہنما اصولوں کی خدمت کرتا ہے: تشخیص کو قابل اعتماد اور درست ہونا چاہیے، جعل سازی اور تاثر کے انتظام کے خلاف مزاحم ہونا چاہیے، عالمی طور پر قابل اطلاق ہونا چاہیے، اور آن لائن مؤثر اور محفوظ ہونا چاہیے۔

07 ·

ٹیسٹ کی ترقی کا عمل

ترقی صلاحیت کی تعریف سے لے کر آئٹم لکھنے، پائلٹنگ اور آئٹم تجزیہ تک ہوئی، جس کی رہنمائی BPS/ITC ہدایات اور APA معیارات نے کی۔

  1. مرحلہ 01قابلیت ماڈل کی وضاحت کرنا. An extensive literature review of personality and competency models, covering Big Five taxonomies, emotional intelligence models and others, was combined with interviews of corporate HR partners, leadership coaches and hiring managers across industries. Hundreds of candidate behavioural descriptors were distilled, using theory (mapping to models such as DeYoung's ten aspects of the Five Factor Model) and expert sorting, into the final six domains and roughly 50 competencies. Each was defined with behavioural examples for item writers: "Builds Trust", for instance, was defined as being honest, keeping commitments and fostering psychological safety.
  2. مرحلہ 02آئٹم لکھنا۔ I/O نفسیات دانوں اور موضوع کے ماہرین نے اہم واقعہ کی تکنیک کا استعمال کیا، ہر قابلیت کے لیے مؤثر اور غیر مؤثر رویے کے حقیقی واقعات جمع کیے۔ فیصلہ سازی کے معیار کے لیے، ایک واقعہ میں ایک ٹیم محدود ڈیٹا پر دو حکمت عملیوں کے درمیان انتخاب کر سکتی ہے، جس میں چار ممکنہ اقدامات ہیں جو ہر ایک مختلف خصوصیت کی عکاسی کرتے ہیں: تجزیاتی غور، بے صبری، دوسروں کی طرف رجوع کرنا، وغیرہ۔ آپشنز کا جائزہ لیا گیا تاکہ سماجی خواہشات متوازن ہوں، کیونکہ ہر ایک کے فوائد اور نقصانات ہیں جن کو ایک معقول شخص پسند کر سکتا ہے، اور اشیاء کو قیادت کی مشکل کی سطحوں کے ذریعے داخلے پر لکھا گیا۔ 2,000 سے زیادہ ابتدائی اشیاء تیار کی گئیں، ہر سطح پر ہر قابلیت کے لیے کم از کم تین سے پانچ منظرنامے کے ساتھ۔ مواد کو تعصب کے لیے جانچا گیا، جامع زبان اور عمومی سیاق و سباق کا استعمال کرتے ہوئے (ثقافتی طور پر مخصوص ناموں کے بجائے ایک خیالی "ACME Corp.")، پھر دو لسانی ماہرین کے ذریعہ ترجمہ کیا گیا جس میں معنی کی مساوات کی تصدیق کے لیے آگے اور پیچھے ترجمہ شامل تھا۔
  3. مرحلہ 03پائلٹ ٹیسٹنگ۔ ایک پائلٹ N = 400 شرکاء کے ساتھ چلایا گیا، ہر ایک چار ملازمت کی سطحوں پر 100: ابتدائی سطح، جونیئر (ایک سے تین سال)، درمیانی سطح، اور سینئر۔ نمونہ متنوع تھا، رضاکارانہ درخواست دہندگان اور مختلف صنعتوں کے ملازمین سے لیا گیا۔ شرکاء نے SJT کی ایک طویل شکل لی، تقریباً 1.5 گھنٹے، ساتھ ہی بیرونی اقدامات جیسے کہ ایک بڑی پانچ کی انوینٹری اور بعد میں ہم آہنگی کی توثیق کے لیے ایک ذہنی ٹیسٹ۔ پھر نفسیاتی ماہرین نے صنف اور ثقافت کے لحاظ سے اشیاء کی مشکل، اشیاء کی تفریق، اور مختلف اشیاء کی فعالیت (DIF) کا تجزیہ کیا، کلاسیکی ٹیسٹ تھیوری اور IRT کا استعمال کرتے ہوئے۔ ایسی اشیاء جو بہت آسان تھیں، تفریق کرنے میں ناکام رہیں، یا غیر وضاحتی آبادیاتی اختلافات دکھائیں، انہیں نظر ثانی یا ہٹا دیا گیا۔ ایک ایسی شے جو بعد کے اوقات میں کام کی سماجی سرگرمی کے بارے میں تھی، جس کا جواب بزرگ اور نوجوان کارکنوں نے زندگی کے مرحلے کے بجائے خصوصیت کی وجوہات کے لیے مختلف دیا، وہ قسم کی شے ہے جو عمر کے تعصب سے بچنے کے لیے کاٹی گئی۔ تقریباً 50% اشیاء کو برقرار رکھا گیا یا تبدیل کیا گیا، تقریباً 1,000 اعلیٰ معیار کے منظرناموں کا ایک صاف بینک چھوڑتے ہوئے، ہر صلاحیت کے ہر سطح پر آٹھ سے دس ٹھوس اشیاء کو نشانہ بناتے ہوئے۔
  4. مرحلہ 04اسکورنگ ماڈل کی کیلیبریشن۔ ہر آپشن کو ان خصوصیات کے لیے کوڈ کیا گیا جو یہ ظاہر کرتا ہے: ایک ایسا آپشن منتخب کرنا جو اعلیٰ ایڈاپٹ ایبلٹی کی عکاسی کرتا ہو، "سب سے زیادہ ممکن" اسکور کو بڑھاتا ہے، جبکہ کم ایڈاپٹ ایبلٹی کے آپشن کا انتخاب اس کو کم کرتا ہے۔ زبردستی انتخاب کی ساخت نے ایک کثیر جہتی IRT ماڈل کی ضرورت کی جس میں ہر آپشن متعلقہ جہتوں پر مشکل اور تفریق کے پیرامیٹرز رکھتا ہے، جس کا تخمینہ تھر اسٹون اور بریڈلی-ٹیری طرز کے طریقوں سے تقابلی ڈیٹا کے لیے لگایا گیا۔ نتیجے میں آنے والا الگورڈم انتخاب کے پیٹرن کو خصوصیت کے تخمینوں میں تبدیل کرتا ہے، اور اسے بیرونی طور پر جمع کردہ بڑی پانچ اسکورز کے خلاف درست کیا گیا: SJT بین الشخصی اسکور تقریباً r = 0.5 کے ساتھ ایک اتفاقی سوالنامے کے ساتھ مربوط تھا، جس میں کم آئٹم وزن کی ایڈجسٹمنٹ کی گئی تاکہ ہم آہنگ درستگی کو زیادہ سے زیادہ کیا جا سکے۔
  5. مرحلہ 05قابل اعتماد تجزیہ. ہر اسکیل کے لیے داخلی مطابقت کا حساب لگایا گیا، جو کہ جوڑے کے جوابات پر مبنی کرونباخ کا الفا استعمال کرتے ہوئے، جیسا کہ مجبور انتخاب کے فارمیٹس کی ضرورت ہوتی ہے۔ پائلٹ نے تقریباً 0.78 کا میڈین α دکھایا، جس میں زیادہ تر اسکیل 0.75 سے اوپر تھے۔ چند کمزور اسکیل، جیسے تخلیقی پہلو جو ابتدائی طور پر تقریباً 0.65 پر تھا، اضافی یا بہتر آئٹمز کے ساتھ مضبوط کیے گئے۔ ہدف α ≥ 0.70 تھا تمام وسیع شعبوں اور زیادہ تر تنگ پہلوؤں کے لیے۔
  6. مرحلہ 06حتمی اسمبلی اور معیاری سازی۔ Operational forms were assembled from the refined bank, with multiple forms allowing rotation and job-level tailoring. Each form covers all six domains and their facets across several items, balancing shorter and longer scenarios and mixing cognitively heavy items with straightforward ones to limit fatigue. Parallel forms were equated through common items so scoring is consistent regardless of the form received; adaptive selection effectively chooses among these equated forms based on inputs such as job level. A normative sample of more than 5,000 test takers, collected across regions and industries during the first year of operation, supports percentile ranks, stanines and stens for global and industry-specific interpretation. An independent panel of psychometric experts audited content for bias and reviewed the validity evidence for sufficiency; their feedback was incorporated into the final technical manual.
جدول 1. داخلی مستقل مزاجی (کرونباخ کا α) کے لحاظ سے، پائلٹ نمونہ، N = 400
اہلیت کا شعبہکرونباخ کا α
ڈرائیو اور عملدرآمد0.84
ڈھلنے کی صلاحیت اور سیکھنا0.80
اثر اور قیادت0.78
بین الفردی اور ٹیم ورک0.81
جذباتی لچک0.76
تنقیدی سوچ0.75

تمام ڈومینز عام 0.70 کی حد سے تجاوز کرتے ہیں۔ پہلو کی سطح کے الفا کچھ کم ہیں (0.6–0.7 ان تنگ ترین خصوصیات کے لیے جن میں کم سے کم اشیاء ہیں)، جو متوقع اور قابل قبول ہے کیونکہ پہلو بنیادی استعمال کے لیے وسیع تر ڈومینز میں جمع ہوتے ہیں۔

اخلاقی اور منصفانہ استعمال ایک عزم تھا: پائلٹ امیدواروں کو معلومات فراہم کی گئیں، براہ راست ٹیسٹ میں باخبر رضامندی اور ڈیٹا کی رازداری کے نوٹس شامل ہیں، اور کلائنٹ کے ایچ آر ٹیموں کو درست تشریح پر تربیت دی جاتی ہے تاکہ کسی ایک اسکور کو فیصلے میں زیادہ وزن نہ دیا جائے۔

08 ·

قابل اعتماد ثبوت

نیچے دی گئی شواہد ابتدائی توثیق کے نمونے (پائلٹ اور پیروی، N ≈ 400)، مجموعی عملیاتی ڈیٹا (N ≈ 5,000+) اور کلائنٹ تنظیموں کے ساتھ ہدف شدہ توثیق کے مطالعے سے حاصل کی گئی ہیں۔

داخلی مطابقت۔ 5,000 ٹیسٹ لینے والوں کے نمونے میں، چھ وسیع ڈومینز کے لیے کوایفیشنٹ الفا 0.75 سے 0.88 کے درمیان ہے جس کا اوسط تقریباً 0.82 ہے، جو اس بات کی تصدیق کرتا ہے کہ ہر ڈومین میں اشیاء ہم جنس ہیں۔ امیدوار جو ایک منظر نامے میں اعلیٰ ڈرائیو دکھاتے ہیں وہ دوسروں میں بھی ایسا ہی کرتے ہیں۔ یہ الفا عام طور پر رپورٹ کردہ Likert-scale شخصیت کے اقدامات کے لیے (تقریباً 0.75–0.85) کے برابر یا اس سے زیادہ ہیں، خاص طور پر اس بات کو مدنظر رکھتے ہوئے کہ SJT کثیر جہتی ہے۔

جدول 2. پیمائش کی معیاری غلطی (SEM) کے لحاظ سے، 0–100 اسکور اسکیل
اہلیت کا شعبہSEM (نقاط)
ڈرائیو اور عملدرآمد6.0
ڈھلنے کی صلاحیت اور سیکھنا6.7
اثر اور قیادت7.0
بین الفردی اور ٹیم ورک6.5
جذباتی لچک7.3
تنقیدی سوچ7.5

SEM تقریباً ایک تہائی سے ایک آدھے اسکور کے معیاری انحراف کے برابر ہیں۔ ایک جذباتی لچک کا اسکور 70 کا 68% حقیقی اسکور کے 63 اور 77 کے درمیان ہونے کا امکان ہے۔ تنقیدی سوچ پر تھوڑا زیادہ SEM کم اشیاء اور زیادہ متنوع مواد کی عکاسی کرتا ہے؛ رپورٹس میں اعلیٰ خطرے کے استعمال کے لیے اعتماد کے بینڈ شامل ہیں۔

ٹیسٹ-دوبارہ ٹیسٹ کی قابل اعتمادیت. ایک کلائنٹ تنظیم میں 120 ملازمین کے ایک نمونے نے چھ ماہ کے وقفے سے دو بار ٹیسٹ لیا۔ مجموعی مجموعے کے لیے دوبارہ ٹیسٹ کا تعلق r = 0.81 تھا؛ شعبے کی سطح پر دوبارہ ٹیسٹ کی قابل اعتمادیت 0.72 سے 0.79 تک تھی۔ 50 شرکاء کے ساتھ دو سے تین ہفتوں کا مختصر وقفہ دوبارہ ٹیسٹ r ≈ 0.85 دیا، جو بہت کم عارضی غلطی کی نشاندہی کرتا ہے۔ اس لیے افراد کی درجہ بندی کا آرڈر مستقل رہتا ہے، اور اسکور میں تبدیلیاں زیادہ تر حقیقی ترقی کی عکاسی کرنے کا امکان رکھتی ہیں نہ کہ شور، جو اس وقت اہم ہوتا ہے جب ٹیسٹ کو ترقی سے پہلے اور بعد میں استعمال کیا جائے۔

اسکورنگ کی مستقل مزاجی۔ اسکورنگ مکمل طور پر خودکار ہے، لہذا رینکنگ میں اختلاف ایک عنصر نہیں ہے۔ ایک چیک کے طور پر، دو ماہر نفسیات نے 50 جواب پروٹوکول کے لیے مضمر خصوصیت کی سطح کا آزادانہ طور پر اندازہ لگایا؛ ان کے فیصلے خودکار اسکور کے ساتھ 0.9 سے اوپر ہم آہنگ تھے، جو اس بات کی تصدیق کرتا ہے کہ اسکورنگ کے قواعد نظریاتی طور پر درست اور انسانی استدلال کے ذریعہ دوبارہ پیدا کیے جا سکتے ہیں۔

اجتماعی بمقابلہ پروفائل. ایک مجموعی "مجموعی سلوکی مطابقت" اسکور، شعبوں کا اوسط یا پہلا بنیادی جزو، α ≈ 0.90 پر انتہائی قابل اعتماد ہے اور سلوکی اثراندازی کا ایک عمومی عنصر پکڑتا ہے۔ تاہم، Xobin صارفین کو ایک سادہ کردہ واحد نمبر کے بجائے شعبے کے اسکور کی پروفائل پڑھنے کی ترغیب دیتا ہے؛ ہر شعبہ اپنی جگہ پر تشریح کرنے کے لیے کافی قابل اعتماد ہے۔

آئٹم بینک اور متوازی شکلیں۔ IRT معلومات کی فعالیتیں تصدیق کرتی ہیں کہ 40 آئٹمز کی لمبائی خصوصیت کی حد میں کافی درستگی فراہم کرتی ہے۔ 20 آئٹمز کا ورژن کم قابل اعتماد (≈ 0.65–0.70) پر فوری اسکریننگ کے لیے استعمال کیا جا سکتا ہے؛ 60 آئٹمز کا ورژن صرف معمولی طور پر قابل اعتماد کو بڑھاتا ہے (≈ 0.87) قبل اس کے کہ کم ہونے والے فوائد ہوں۔ آئٹم بینک کے دو بے ترتیب تفویض کردہ نصف کے اسکور درستگی کے بعد تقریباً 0.9 پر ہم آہنگ ہوتے ہیں، لہذا کوئی بھی دی گئی شکل مکمل بینک کی نمائندگی کرتی ہے۔

مل کر، داخلی مستقل مزاجی اور دوبارہ ٹیسٹ کی استحکام صنعت کے معیار پر پورا اترتے ہیں یا انہیں تجاوز کرتے ہیں۔ شخصیت پر مبنی SJTs پر تحقیق دو سے تین ہفتوں کے دوبارہ ٹیسٹ کے کوفیئنٹس 0.6–0.7 کی حد میں رپورٹ کرتی ہے؛ Xobin کے چھ ماہ کے اعداد و شمار تقریباً 0.75 مضبوط ہیں۔ کیونکہ یہ شکل سماجی طور پر مطلوبہ جواب کو کم کرتی ہے، یہ تخمینے ممکنہ طور پر محتاط ہیں.

09 ·

درستگی کا ثبوت

مواد کی درستگی. اہلیتیں ادب اور ملازم کی رائے سے شناخت کی گئیں جو بہت سے کرداروں میں ملازمت کی کامیابی کے لیے اہم ہیں، اور ہر منظر نامہ ایک حقیقی صورتحال میں جڑا ہوا ہے جس میں امیدواروں اور SMEs کے لیے چہرے کی صداقت ہے۔ I/O ماہر نفسیات اور بھرتی کے منیجرز نے ہر آئٹم کا جائزہ لیا تاکہ یہ تصدیق کی جا سکے کہ منظر نامے ممکنہ اور اہم ہیں، اور کہ جواب کے اختیارات ہدف کی اہلیتوں سے جڑے ہوئے مؤثر اور غیر مؤثر اقدامات کی ایک رینج میں پھیلے ہوئے ہیں۔ چونکہ ماڈل میں بڑی پانچ، EQ اور تنقیدی سوچ کو یکجا کیا گیا ہے، کوئی بھی بڑا علاقہ (کام، لوگ، علمی، موافقت) چھوڑا نہیں گیا: ہر بڑی پانچ کا عنصر متعدد آئٹمز کے ساتھ نقشہ بناتا ہے، اور ہر گولمین EQ جزو کے پاس منظر نامے ہیں جو اسے ابھارتے ہیں۔ کلائنٹ کی رائے کہ منظر نامے "روزمرہ کی حقیقتوں کی عکاسی کرتے ہیں" اور کہ رپورٹس "ایسی زبان استعمال کرتی ہیں جو ہمارے قیادت کے ماڈلز سے میل کھاتی ہے" اسی نتیجے کی حمایت کرتی ہے.

تعمیراتی درستگی: عنصر کا ڈھانچہ. Exploratory factor analysis on a large sample extracted six factors explaining a substantial share of variance, with loadings matching the intended design.

جدول 3. مثال کے طور پر عوامل کے لوڈنگ، ورمی میکس گھومائی گئی EFA (N = 2,000)
اہلیت (پہلو)ڈرائیوڈھالنا۔اثربین الفردی۔لچکتنقیدی سوچ.
پہل (ڈرائیو)0.790.100.150.050.020.08
معیار پر توجہ (چلانا)0.750.080.050.100.090.12
لچک (ایڈاپٹ ایبلٹی)0.050.770.100.060.040.20
تخلیقی سوچ0.040.730.080.000.050.25
قائل کرنے کی صلاحیت (اثر)0.100.060.760.120.000.05
دوسروں کی قیادت کرنا (قیادت)0.180.050.820.090.030.02
ہمدردی (بین الشخصی)0.000.020.100.740.150.05
اعتماد بناتا ہے (بین الفردی)0.110.000.050.720.100.03
تناؤ کی برداشت (لچک)0.090.050.000.100.690.20
امید (لچک)0.060.100.000.080.710.00
تحلیلی سوچ (تنقیدی سوچ.)0.050.220.000.000.100.80
فیصلے کا معیار (تنقیدی سوچ.)0.100.180.050.000.050.78

ہر صلاحیت اپنے نظریاتی عنصر پر سب سے زیادہ بوجھ ڈالتی ہے، عام طور پر کم کراس لوڈنگ کے ساتھ؛ تجزیاتی سوچ کی توقع کی گئی ثانوی بوجھ کو ایڈاپٹ ایبلٹی پر ظاہر کرتی ہے، کیونکہ نئے خیالات کے لیے کھلا پن تجزیاتی ذہنیت کے ساتھ اوورلیپ کرتا ہے۔ ایک تصدیقی عنصر کے تجزیے نے چھ عنصر کے ماڈل کے لیے اچھا فٹ دکھایا، اور ایک اعلیٰ درجے کا عمومی عنصر ابھرتا ہے جس میں شعبے کے بوجھ تقریباً 0.6–0.7 کے ارد گرد ہوتے ہیں، جو ایک عمومی سلوکی موزونیت کے عنصر کے ساتھ ہم آہنگ ہے جبکہ مختلف عوامل مضبوط رہتے ہیں۔

ہم آہنگ درستگی. ایک معیاری بڑی پانچ انوینٹری کے خلاف جو ایک پائلٹ ذیلی سیٹ میں دی گئی: بین الشخصی اور ٹیم ورک کا تعلق r = 0.65 ہے Agreeableness کے ساتھ؛ جذباتی لچک r = 0.70 ہے الٹ نیوروٹزم کے ساتھ؛ ڈرائیو اور عمل درآمد r = 0.55 ہے ذمہ داری کے ساتھ؛ ڈھلنے کی صلاحیت اور سیکھنا r = 0.60 ہے کھلے پن کے ساتھ؛ اثر و رسوخ اور قیادت r = 0.50 ہے خارجیت کے ساتھ، تمام اہم p < .001 پر۔ تنقیدی سوچ کا تعلق معتدل (r ≈ 0.30) ہے ایک علمی صلاحیت کے ٹیسٹ کے ساتھ: اہم، لیکن اتنا زیادہ نہیں کہ یہ تجویز کرے کہ ٹیسٹ خالص صلاحیت کی پیمائش کرتا ہے نہ کہ مزاج کی۔ تنظیمی نمونوں میں، SJT اثر و رسوخ کے اسکور تقریباً 0.4 کے ساتھ سپروائزر کی قیادت کی صلاحیت کی درجہ بندی کے ساتھ منسلک ہیں، اور SJT ڈھلنے کی صلاحیت تقریباً 0.45 کے ساتھ تبدیلی کے لیے کھلے پن کی ہم مرتبہ درجہ بندی کے ساتھ۔

تفریقی درستگی۔ ایسے شعبے جو مختلف ہونے چاہئیں، مختلف ہیں: بین الشخصی بمقابلہ تنقیدی سوچ کا تعلق تقریباً 0.2 ہے، ڈرائیو بمقابلہ بین الشخصی کا تعلق تقریباً 0.1 ہے۔ یہ ٹیسٹ خصوصیات کو ممتاز کرتا ہے بجائے اس کے کہ ایک غیر ممتاز اچھے/برے پیمانے کو پیدا کرے۔ اسکورز سوشل ڈیزائرابیلیٹی اسکیل کے ساتھ قریباً صفر (r ≈ 0.05) کے ساتھ مربوط ہیں، براہ راست ثبوت کہ زبردستی انتخاب کا ڈیزائن تاثر کے انتظام کی مزاحمت کرتا ہے، روایتی خود رپورٹوں کے برعکس۔

معیاری متعلقہ درستگی. Xobin نے ایک درجن سے زیادہ کلائنٹ تنظیموں کے ساتھ توثیق کے مطالعے مرتب کیے ہیں جو پیشگی بھرتی SJT اسکورز کو بعد کی ملازمت کی کارکردگی، تربیتی کامیابی اور دیگر نتائج سے جوڑتے ہیں۔ دس کا خلاصہ نیچے دیا گیا ہے۔

جدول 4. معیار کی درستگی: SJT اسکور کا ملازمت کی کارکردگی کے ساتھ تعلق (N ≈ 100 فی کردار)
کرداردرستگی کا کوفیئینٹ (r)
سافٹ ویئر انجینئر (IT)0.23
ٹیم لیڈ (آئی ٹی)0.30
بینک ٹیلر (BFSI)0.20
مالی مشیر (BFSI)0.28
سیلز نمائندہ (FMCG)0.25
سیلز منیجر (FMCG)0.35
لیب ٹیکنیشن (فارما)0.22
پروڈکٹ منیجر (فارما)0.31
پلانٹ سپروائزر (توانائی)0.27
نرس (صحت کی دیکھ بھال)0.24

کوفیجنٹس تقریباً 0.20 سے 0.35 تک ہوتے ہیں، جو شخصیت سے متعلق پیش گوئی کرنے والوں کے لیے عام ہیں اور تمام p < .05 یا اس سے بہتر پر اہم ہیں، IT، BFSI، FMCG، فارما، توانائی اور صحت کی دیکھ بھال میں.

یہ کوفیئینٹس کا مطلب ہے کہ یہ ٹیسٹ اکیلا تقریباً 6–12% ملازمت کی کارکردگی میں تغیر کی وضاحت کرتا ہے، جو ایک واحد سلوکی تشخیص کے لیے ایک اہم شراکت ہے۔ سیلز مینیجر (FMCG) نے سہ ماہی ہدف کی تکمیل کے خلاف r = 0.35 حاصل کیا، جبکہ زیادہ اثر و رسوخ اور ڈرائیو اسکور بہتر سیلز کے نتائج کی پیش گوئی کرتے ہیں۔ ٹیم لیڈ (IT) نے سپروائزری کارکردگی کی درجہ بندی کے خلاف r = 0.30 حاصل کیا۔ یہاں تک کہ سب سے کم کوفیئنٹ، 0.20 بینک ٹیلر کے لیے، قیمت رکھتا ہے: اس کردار کی کارکردگی بڑی حد تک غلطی کی شرحوں اور پابندیوں پر ماپی گئی، جس کی پیش گوئی SJT کے اندر ضمیر کی جاتی ہے۔ SJT کو علمی ٹیسٹوں یا ساختی انٹرویوز کے ساتھ ملانا مجموعی پیش گوئی کی طاقت کو مزید بڑھاتا ہے، اور درستیاں آبادیاتی گروپوں کے درمیان تعصب کے ثبوت کے بغیر برقرار رہتی ہیں۔

اہلیت سے نتیجے کے روابط. ایک بین الاقوامی کال سینٹر میں، بین الفردی اور ٹیم ورک کے اسکور نے سروس نمائندوں کے لیے صارف کی اطمینان کا اندازہ r ≈ 0.30 پر لگایا۔ ایک مشاورتی کمپنی میں، تنقیدی سوچ اور موافقت نے ہر ایک نے ہم مرتبہ کی درجہ بندی کردہ پروجیکٹ کی تکمیل کے معیار کا اندازہ r ≈ 0.25 پر لگایا۔ ایک انتظامی تربیتی پروگرام میں، جنہیں آخر کار ترقی دی گئی ان کے ابتدائی ڈرائیو اور عملدرآمد اور قیادت کے اسکور (d ≈ 0.5) نمایاں طور پر زیادہ تھے، جو اس بات کا ثبوت ہے کہ یہ ٹیسٹ مستقبل کے رہنماؤں کی جلد شناخت کر سکتا ہے۔

ہم وقتی درستگی. ایک فارماسیوٹیکل سیلز ٹیم (N = 80) کے ساتھ، SJT کا کل اسکور سپروائزر کی مجموعی کارکردگی کی درجہ بندی کے ساتھ r = 0.29 سے مربوط تھا، اور اثر و رسوخ اور قیادت کا r = 0.40 سے مربوط تھا جو ڈاکٹروں کو قائل کرنے اور کوٹہ حاصل کرنے کے لئے ملازمت کے مخصوص درجہ بندی کے ساتھ۔ ایک مینوفیکچرنگ پلانٹ (N = 60 سپروائزرز) میں، جذباتی لچک تناؤ سے متعلق چھٹی کے دنوں کے ساتھ منفی طور پر مربوط تھی (r = −0.25).

اضافی درستگی۔ ایک ریٹیل ایسوسی ایٹ کے نمونے میں، ایک علمی ٹیسٹ نے سیلز کی کارکردگی کا اندازہ r ≈ 0.20 پر لگایا اور SJT نے r ≈ 0.22 پر؛ ریگریشن میں مل کر انہوں نے R ≈ 0.30 تک پہنچا، جس میں SJT نے تقریباً 0.10 کا منفرد اضافہ کیا۔ SJT ایک عمومی شخصیت کی انوینٹری میں بھی اضافہ کرتا ہے، کیونکہ دو لوگ جن کی خصوصیت کے اسکور مشابہ ہوتے ہیں وہ ان خصوصیات کو حالات میں کتنی مؤثر طریقے سے لاگو کرتے ہیں میں مختلف ہو سکتے ہیں، جو کہ صورتحال کی فیصلہ سازی کا علم ہے۔ کلائنٹس رپورٹ کرتے ہیں کہ SJT کو دوسرے تشخیصات کے ساتھ ملانا بھرتی کے معیار کو علمی ٹیسٹنگ کے مقابلے میں قابل پیمائش طور پر بہتر بناتا ہے۔

10 ·

انصاف اور تعصب کا تجزیہ

ذیلی گروپ کے فرق. اسکور کی تقسیم کو بڑے نمونے میں جنس اور بڑے نسلی گروپ کے لحاظ سے موازنہ کیا گیا۔ اختلافات معمولی تھے: مرد اور خواتین امیدواروں کے مجموعی اسکور پر تقریباً برابر اوسط تھی (0.1 SD سے کم)۔ چند پہلوؤں میں چھوٹے اختلافات نظر آئے، خواتین بین الفردی میں معمولی طور پر زیادہ اور مرد تنقیدی سوچ میں معمولی طور پر زیادہ تھے، لیکن اثرات d ≈ 0.2 یا اس سے کم تھے اور نمونوں میں غیر مستقل تھے، لہذا یہ ٹیسٹ کی جانبداری کی نشاندہی نہیں کرتے۔ DIF تجزیہ نے آئٹم کی سطح پر یہ پایا کہ کوئی آئٹم مختلف آبادیاتی گروپ کے ذریعہ مختلف جواب نہیں دیا گیا جب کہ خصوصیت کی سطح کو کنٹرول کیا گیا۔ ملک کے اختلافات بھی چھوٹے تھے اور بنیادی طور پر معلوم ثقافتی سطح کی خصوصیت کے اختلافات کی وضاحت کی گئی، اور ہر مقامی زبان کے ورژن کی معنوی مساوات کے لیے جانچ کی گئی۔

معیارات کی تعمیل. یہ ٹیسٹ EEO کے اصولوں اور ISO 10667 کے مطابق تیار کیا گیا تھا۔ منفی اثر کے تناسب کی نگرانی کی جاتی ہے؛ بڑے نفاذ میں، جب SJT کو ایک رکاوٹ کے طور پر استعمال کیا جاتا ہے تو جنس اور نسل کے لحاظ سے انتخاب کی شرح ہر معاملے میں چار پانچویں قاعدے کے اندر رہی ہے۔ ایک کلائنٹ نے غیر ساختہ انٹرویو کو SJT سے تبدیل کیا اور پایا کہ اس نے موضوعی تعصب کو کم کیا اور ترقی پذیر امیدواروں کی تنوع کو بہتر بنایا۔

امیدوار کے ردعمل. ٹیسٹ لینے والوں کے سروے مثبت ردعمل کی رپورٹ کرتے ہیں: زیادہ تر نے منظرناموں کو ملازمت سے متعلق پایا اور اپنی طاقتیں ظاہر کرنے کے قابل محسوس کیا۔ امیدوار جو خالی مجبور انتخاب کے سوالناموں کو عجیب سمجھتے ہیں وہ انہیں منظرنامے کے اندر دلچسپ پاتے ہیں۔ مکمل ہونے کی شرح 95% سے تجاوز کرتی ہے، جو یہ ظاہر کرتی ہے کہ لمبائی اور مواد غیر نگرانی والے سیٹنگ میں قابل قبول ہیں.

11 ·

نتائج اور افادیت

کلائنٹ تنظیموں نے دستاویزی طور پر کم ٹرن اوور کا مشاہدہ کیا ہے، جن میں سے ایک نے نئے ملازمین کے ٹرن اوور میں 30% کمی دیکھی جب SJT کو بھرتی میں شامل کیا گیا، ساتھ ہی منتخب کردہ افراد میں بہتر کارکردگی اور اسکریننگ میں وقت کی بچت۔ ایک کمپنی نے SJT کا استعمال کرتے ہوئے اپنی درخواست دہندگان کی تعداد کو ابتدائی طور پر آدھا کر دیا، پھر بھی 95% ان لوگوں کو جو آخری انٹرویو کے لیے مدعو کیا گیا تھا، بھرتی کے منیجرز نے موزوں یا انتہائی موزوں قرار دیا، جو یہ ظاہر کرتا ہے کہ ٹیسٹ نے کمزور امیدواروں کو مؤثر طریقے سے فلٹر کیا نہ کہ بے ترتیب.

12 ·

نتیجہ

Xobin نفسیاتی ٹیسٹ اس چیز کی پیمائش کرتا ہے جس کی یہ پیمائش کرنا چاہتا ہے، اس کا مواد درکار ملازمت کے رویوں کی درست نمائندگی کرتا ہے، اور یہ کرداروں اور صنعتوں میں معنی خیز کارکردگی کے معیار کی پیش گوئی کرتا ہے۔ داخلی مستقل مزاجی اچھی سے بہترین ہے، دوبارہ ٹیسٹ کی استحکام زیادہ ہے، چھ عنصر کا ڈھانچہ دونوں تحقیقی اور تصدیقی تجزیے کے تحت برقرار رہتا ہے، اور جبری انتخاب کا ڈیزائن اسکورز کو بنیادی طور پر سماجی خواہش کے ساتھ غیر مربوط رکھتا ہے۔ انصاف کے تجزیے میں کوئی منفی اثر اور کوئی نشان زدہ آئٹم تعصب نہیں دکھاتا۔

This is the evidence base behind every behavioural score Xobin reports, the same standard of validation Xobin Research applies to the Xobin Capability Graph and to the wider skills work. Teams that want the same rigour in their own hiring can use it directly through Xobin.

13 ·

حوالے

  • ·Ashton, M. C., & Lee, K. (2007). Empirical, theoretical, and practical advantages of the HEXACO model of personality structure.
  • ·Duckworth, A. L., Peterson, C., Matthews, M. D., & Kelly, D. R. (2007). Grit: Perseverance and passion for long-term goals.
  • ·Facione, P. A., Sánchez, C. A., Facione, N. C., & Gainen, J. (1995). The disposition toward critical thinking.
  • ·Goleman, D. (1998). Working with Emotional Intelligence.
  • ·Lombardo, M. M., & Eichinger, R. W. (2000). High potentials as high learners.
  • ·Scouller, J. (2011). The Three Levels of Leadership: How to Develop Your Leadership Presence, Knowhow and Skill.
  • ·DeYoung, C. G., Quilty, L. C., & Peterson, J. B. (2007). Between facets and domains: Ten aspects of the Big Five.
  • ·Situational judgment test literature on criterion validity and resistance to faking, which informed the design of Xobin's SJT format.
  • ·British Psychological Society (BPS) and International Test Commission (ITC) guidelines for occupational test development; APA Standards for Educational and Psychological Testing; ISO 10667.

کیا آپ مکمل تکنیکی دستی، اصول، یا کردار کے مخصوص تصدیق کے مطالعے کی خواہش رکھتے ہیں؟

Xobin Research HR، قانونی، اور خریداری کی ٹیموں کے ساتھ تفصیلی دستاویزات کا تبادلہ کرتا ہے جو تشخیص کا جائزہ لیتے ہیں۔

رابطہ کریں →
§ اکثر پوچھے جانے والے سوالات

اکثر پوچھے جانے والے سوالات

What kind of test is the Xobin psychometric assessment?

It is a situational judgment test (SJT). Each item presents a realistic workplace scenario with several plausible actions, and candidates rank those actions, which lets the test infer behavioural traits in context rather than asking about them directly.

How reliable is the test?

Internal consistency for the six broad domains runs from 0.75 to 0.88 with a median near 0.82, and the overall composite shows a six-month test-retest correlation of r = 0.81. Full figures, including standard errors of measurement, are documented in this article.

Is the test checked for bias?

Yes. Items are screened for differential item functioning by gender and culture during piloting and in production, and subgroup score differences are monitored. Items that show consistent bias are revised or retired.
§ لیبارٹری سے

تحقیقی ٹیم سے رابطہ کریں۔

یہاں بیان کردہ طریقہ کار وہ ہے جو ہر Xobin تشخیص اور AI انٹرویو کے اندر چلتا ہے، تاکہ بھرتی کی ٹیمیں شواہد کی بنیاد پر ٹیلنٹ کے فیصلے کر سکیں، نہ کہ جبلت پر۔ Xobin دیکھیں.