مواد پر جائیں

بینچ مارکس

AMD کی کارکردگی۔ ایمانداری سے پیمائش کی۔

ہمارا بینچ مارک طریقہ کار، میٹرکس جو ہم ٹریک کرتے ہیں، ہم جن زبانوں کی جانچ کرتے ہیں، اور جن حدود کو ہم تسلیم کرتے ہیں۔ جہاں ہمارے پاس آپ کی طرح ٹریفک پر ماپا جانے والا کوئی اعداد و شمار نہیں ہے، ہم ایک کا حوالہ دینے کے بجائے ایسا کہتے ہیں۔

مختصر جواب

DialerBee بینچ مارکس کیا پیمائش کرتے ہیں؟ وہ AI AMD درستگی کی پیمائش کرتے ہیں: ماڈل کال آڈیو کے پہلے 3 سیکنڈ کے ریئل ٹائم ٹرانسکرپٹ کو ایک لائیو انسان یا جواب دینے والی مشین کے طور پر درجہ بندی کرتا ہے، اور ہم اسے 11 زبانوں، کیریئر کے ماحول اور مہم کی اقسام میں بینچ مارک کرتے ہیں۔ زمینی سچائی ایجنٹ کی اوور رائیڈز سے آتی ہے، جہاں ایک ایجنٹ جو درجہ بندی سے متفق نہیں ہوتا اسے ایک کلک میں جھنڈا لگاتا ہے، اور تشخیص ایک بار کے لیب ٹیسٹ کے بجائے مسلسل ہوتا ہے۔ پانچ میٹرکس کو ٹریک کیا جاتا ہے: درستگی، غلط مثبت شرح، غلط منفی شرح، پتہ لگانے میں تاخیر، اور ایجنٹ اوور رائڈ کی شرح۔ شائع شدہ اعداد و شمار اندرونی پائلٹوں سے آتے ہیں اور منتخب پائلٹ حالات میں ہوتے ہیں۔ جہاں ہمارے پاس آپ کی طرح ٹریفک پر ماپا جانے والا کوئی اعداد و شمار نہیں ہے، ہم ایک کا حوالہ دینے کے بجائے ایسا کہتے ہیں۔

کیا ہم بینچ مارک

AMD کی درستگی تمام زبانوں میں

DialerBee کا AI AMD کال آڈیو کے پہلے 3 سیکنڈز پر ٹرانسکرپٹ کی درجہ بندی کا استعمال کرتا ہے تاکہ یہ معلوم کیا جا سکے کہ آیا انسان یا جواب دینے والی مشین نے اسے اٹھایا ہے۔ ہم حقیقی دنیا کی درستگی کی پیمائش کرنے کے لیے متعدد زبانوں، کیریئر کے ماحول اور مہم کی اقسام میں اس نظام کو بینچ مارک کرتے ہیں۔

وینڈرز کے برعکس جو لیب کنڈیشن کی درستگی کی اطلاع دیتے ہیں، ہمارے بینچ مارکس پروڈکشن ڈیٹا کو تمام شور، کیریئر کی تغیرات، اور علاقائی فرقوں کے ساتھ ظاہر کرتے ہیں جو حقیقی آؤٹ باؤنڈ مہمات کے ساتھ آتے ہیں۔

طریقہ کار

ہم کیسے درستگی کی پیمائش کریں

نقل کی درجہ بندی

AMD ماڈل آڈیو کے پہلے 3 سیکنڈ کے ریئل ٹائم ٹرانسکرپٹ کی درجہ بندی کرتا ہے۔ یہ الفاظ اور جملے پڑھتا ہے، نہ کہ آڈیو ویوفارمز یا بیپ پیٹرن۔

ایجنٹ زمینی سچائی کے طور پر اوور رائڈ

جب ایجنٹ AMD کی درجہ بندی سے متفق نہیں ہوتے، تو وہ اسے ایک کلک کے ساتھ جھنڈا لگاتے ہیں۔ یہ اوور رائیڈز درستگی کی پیمائش کے لیے زمینی سچائی کے لیبل کے طور پر کام کرتے ہیں۔

مسلسل تشخیص

بینچ مارکس ایک بار کے ٹیسٹ نہیں ہیں۔ ہم تمام پروڈکشن مہموں میں ایجنٹ کو اوور رائیڈ کرنے کے سلسلے کے خلاف مسلسل درستگی کا جائزہ لیتے ہیں۔

میٹرکس کو ٹریک کیا گیا۔

پانچ میٹرکس وہ معاملہ

درستگی

تمام کالوں میں مجموعی طور پر درست درجہ بندی کی شرح۔

غلط مثبت شرح

انسانی کالوں کو غلط طریقے سے مشینوں کے طور پر درجہ بندی کیا گیا ہے۔

جھوٹی منفی شرح

مشین کالز کو غلط طریقے سے انسان کے طور پر درجہ بندی کیا گیا ہے۔

پتہ لگانے میں تاخیر

کال پک اپ سے لے کر AMD کی درجہ بندی کے فیصلے تک کا وقت۔

ایجنٹ اوور رائیڈ ریٹ

کالوں کا فیصد جہاں ایجنٹ AMD فیصلے کو درست کرتے ہیں۔

بینچ مارک کا خلاصہ

اندرونی پائلٹس سے عوامی خلاصہ

ہمارے اندرونی پائلٹس کی طرف سے فی زبان، فی کیریئر اور فی خطہ کے اعداد و شمار درخواست پر دستیاب ہیں۔

میٹرک عوامی خلاصہ نوٹس
کالز کا جائزہ لیا گیا۔ 10,000-50,000 رینج داخلی پائلٹ مہموں میں
تاریخ کی حد Q1–Q2 2026 نیا پائلٹ ڈیٹا دستیاب ہونے کے ساتھ ہی اپ ڈیٹ ہو گیا۔
زبانوں کا تجربہ کیا گیا۔ 9 EN, AR, ES, FR, IT, DE, TR, HI, UR
علاقوں کا تجربہ کیا گیا۔ مینا، یورپ، شمالی امریکہ کیریئر مکس علاقے کے لحاظ سے مختلف ہوتا ہے۔
مہم کی اقسام کلیکشنز، بی پی او، سیلز، انشورنس جہاں ممکن ہو نتائج کو تقسیم کیا گیا۔
AMD جھوٹی مثبت شرح منتخب پائلٹس میں 3% سے کم انسان کو غلط طریقے سے مشین کے طور پر درجہ بندی کیا گیا۔
AMD جھوٹی منفی شرح منتخب پائلٹس میں 5% سے کم مشین کو غلط طریقے سے انسان کے طور پر درجہ بندی کیا گیا ہے۔
درمیانی پتہ لگانے میں تاخیر ذیلی 1 سیکنڈ AMD فیصلے تک اٹھاؤ
P90 کا پتہ لگانے میں تاخیر 1.5 سیکنڈ سے کم AMD فیصلے تک اٹھاؤ
ایجنٹ اوور رائیڈ ریٹ 2–5% رینج پائلٹ مہموں میں دستی اصلاح کی شرح
رابطہ کی شرح لفٹ 4x بمقابلہ دستی ڈائلنگ تک پائلٹ ورک فلو میں؛ نتائج مختلف ہوتے ہیں
بیکار وقت میں کمی 30–45% رینج منتخب پائلٹ مہموں میں

اندرونی پائلٹ بینچ مارکس کی بنیاد پر۔ مہم کی قسم، فہرست کے معیار، کیریئر، علاقہ، زبان، پیسنگ کنفیگریشن، اور ایجنٹ ورک فلو کے لحاظ سے نتائج مختلف ہوتے ہیں۔ فی زبان اور فی کیریئر کا رویہ کافی مختلف ہوتا ہے کہ ہم اسے پائلٹ کے دوران آپ کے روٹس پر ایک اوسط شائع کرنے کے بجائے اس کی پیمائش کریں گے جو آپ کی نظر سے مماثل نہیں ہوگی۔

زبانوں کا تجربہ کیا گیا۔

گیارہ زبانیں، حقیقی پائلٹ ڈیٹا

EN

English

AR

عربی

ES

ہسپانوی

FR

فرانسیسی

IT

اطالوی

DE

جرمن

TR

ترکی

HI

ہندی

UR

اردو

عربی معیارات میں گلف، لیونٹائن، اور مصری بولی کی مختلف قسمیں شامل ہیں۔ ہندی اور اردو بینچ مارکس میں علاقائی مختلف کوریج شامل ہیں۔ ہر زبان کو کیریئر کے ساتھ مخصوص اور علاقے کے لحاظ سے مخصوص خرابیوں کے ساتھ آزادانہ طور پر بینچ مارک کیا جاتا ہے۔

حدود

کیا معیارات آپ کو نہیں بتا سکتا

کیریئر کے لحاظ سے نتائج مختلف ہوتے ہیں۔ مختلف کیریئرز مختلف صوتی میل پیغامات، آڈیو کوالٹی، اور کنکشن ٹائمنگ تیار کرتے ہیں۔

مہم کی قسم کے لحاظ سے نتائج مختلف ہوتے ہیں۔ مجموعوں کی مہمات میں فروخت یا سروے کی مہموں سے مختلف پک اپ پیٹرن ہوتے ہیں۔

علاقے کے لحاظ سے نتائج مختلف ہوتے ہیں۔ صوتی میل مبارکباد کے انداز، کیریئر کا بنیادی ڈھانچہ، اور نیٹ ورک کے حالات بازاروں میں مختلف ہوتے ہیں۔

فہرست کے معیار کے لحاظ سے نتائج مختلف ہوتے ہیں۔ باسی نمبر، غلط نمبر، اور منقطع لائنیں AMD کی کارکردگی کو مختلف طریقے سے متاثر کرتی ہیں۔

بینچ مارکس مجموعی کارکردگی کی عکاسی کرتے ہیں۔ انفرادی مہم کے نتائج رپورٹ کردہ اوسط سے زیادہ یا کم ہو سکتے ہیں۔

درخواست پر مکمل داخلی پائلٹ بینچ مارک ڈیٹا

این ڈی اے کے تحت اہل امکانات کے لیے فی زبان کی درستگی کے جدولوں، کیریئر کے لیے مخصوص خرابیوں، اور تاریخی رجحان کے اعداد و شمار کے ساتھ اندرونی پائلٹ بینچ مارک رپورٹس دستیاب ہیں۔ رسائی کی درخواست کرنے کے لیے ہماری ٹیم سے رابطہ کریں۔

بینچ مارک ڈیٹا کی درخواست کریں۔

ایک ڈیمو بک کریں اور ہم آپ کی زبان، علاقے اور مہم کی قسم سے متعلق تفصیلی AMD بینچ مارک کے نتائج کا اشتراک کریں گے۔

← مکمل سائٹ انگریزی میں دیکھیں