تخطَّ إلى المحتوى
نانو للذكاء الاصطناعي
زمن الاستجابة (زمن أول رمز والرد في أقل من ثانية)
voice ai

زمن الاستجابة (زمن أول رمز والرد في أقل من ثانية)

زمن الاستجابة في الذكاء الاصطناعي الحواري هو التأخير بين انتهاء المستخدم من الكلام وبدء النظام في الرد. وزمن أول رمز (TTFT) هو حصة النموذج من هذا التأخير؛ وفي الوكلاء الصوتيين يجب أن تبقى الدورة الكاملة قرب ثانية واحدة لتبدو طبيعية.

للدور الصوتي الواحد عدة مراحل، وكل منها يضيف تأخيراً: اكتشاف أن المتصل توقف عن الكلام، وتفريغ الصوت، وإرسال النص والسياق إلى النموذج اللغوي، وانتظار أول رمز منه، وتوليد البقية، وتحويل النص إلى كلام، وبث ذلك الصوت عبر شبكة الهاتف. يقيس زمن أول رمز انتظار النموذج فقط، ولهذا قد يقدّم مزود رقماً مبهراً له ومع ذلك يسلّم مكالمة بطيئة. الرقم الذي يهم المتصل هو الفجوة الكاملة من كلمته الأخيرة إلى أول صوت من الرد، مُقاسة على خط هاتف حقيقي لا في عرض على المتصفح.

في الحديث البشري، صمت يزيد عن ثانية تقريباً يُفهم على أنه ارتباك أو انقطاع في الخط، وفي مكالمة هاتفية في السعودية أو مصر سيقول المتصل 'ألو؟' ويبدأ في تكرار كلامه، فيتصادم ذلك مع رد الوكيل المتأخر. ويتفاقم زمن الاستجابة مع العربية: قد يكون التعرف على الكلام باللهجة أبطأ منه بالإنجليزية، والمقدمات المهذبة الطويلة تدفع صوتاً أكثر عبر المسار. والبث في كل مرحلة (التفريغ أثناء كلام المتصل، وبدء النطق قبل أن ينهي النموذج الكتابة) هو ما ينزل بالدورة الكاملة إلى أقل من ثانية، مع استضافة المسار قريباً من منطقة الاتصالات.

بُنيت الوكلاء الصوتيون العرب من Nano AI للرد في أقل من ثانية عبر أرقام الهاتف الحالية، وتُراقب بعد الإطلاق لأن زمن الاستجابة ينحرف مع تغيّر النماذج وحركة المكالمات ومسارات الاتصال. عند اختبار أي مزود لا تسأل عن رقم زمن أول رمز؛ اتصل برقم التجربة من جوال في مدينتك، وعدّ الصمت بعد كل جملة تقولها، واسأل ماذا يقيسون في الإنتاج وماذا يحدث عندما يبطئ مزود النموذج.

تبحث عن استشارة مخصصة؟

دعنا نساعدك في فهم وتطبيق هذه التقنيات بما يتناسب مع متطلبات وأهداف شركتك.

احجز مكالمة استكشافية
تواصل عبر واتساب