Puntos de referencia

Rendimiento de AMD. Medido con honestidad.

Nuestra metodología de evaluación comparativa, las métricas que monitorizamos, los idiomas que analizamos y las limitaciones que reconocemos. Los datos completos están disponibles bajo un acuerdo de confidencialidad.

Lo que evaluamos

Precisión de AMD en todos los idiomas

La IA AMD de DialerBee utiliza la clasificación de transcripciones de los primeros 3 segundos del audio de la llamada para determinar si la contestó una persona o un contestador automático. Evaluamos este sistema en varios idiomas, entornos de operadores y tipos de campañas para medir su precisión en situaciones reales.

A diferencia de los proveedores que informan sobre la precisión en condiciones de laboratorio, nuestros puntos de referencia reflejan datos de producción con todo el ruido, la variabilidad de los operadores y las diferencias regionales que conllevan las campañas salientes reales.

Metodología

Cómo lo hacemos precisión de la medición

Clasificación de transcripciones

El modelo AMD clasifica una transcripción en tiempo real de los primeros 3 segundos de audio. Lee palabras y frases, no formas de onda de audio ni patrones de pitidos.

Anulación del agente como verdad fundamental

Cuando los agentes no están de acuerdo con la clasificación AMD, la marcan con un solo clic. Estas anulaciones sirven como etiquetas de referencia para medir la precisión.

Evaluación continua

Los puntos de referencia no son pruebas puntuales. Evaluamos continuamente la precisión comparándola con el flujo de anulaciones de agentes en todas las campañas de producción.

Métricas rastreadas

Cinco métricas ese asunto

Exactitud

Tasa de clasificación correcta general en todas las llamadas.

Tasa de falsos positivos

Llamadas humanas clasificadas erróneamente como realizadas por máquinas.

Tasa de falsos negativos

Llamadas de máquinas clasificadas erróneamente como humanas.

Latencia de detección

Tiempo transcurrido desde que se recibe la llamada hasta que se toma la decisión de clasificación de la AMD.

Tasa de anulación del agente

Porcentaje de llamadas en las que los agentes corrigen la decisión de AMD.

Resumen de referencia

Resumen público de los pilotos internos

Los prospectos calificados podrán acceder a datos detallados por idioma, operador y región, sujetos a un acuerdo de confidencialidad.

Métrico Resumen público Notas
Llamadas evaluadas Rango de 10.000 a 50.000 En todas las campañas piloto internas
Rango de fechas Primer y segundo trimestre de 2026 Actualizado a medida que se disponga de nuevos datos piloto.
Idiomas probados 9 EN, AR, ES, FR, IT, DE, TR, HI, UR
Regiones analizadas Oriente Medio y Norte de África, Europa, Norteamérica La combinación de operadores varía según la región.
Tipos de campaña Cobranzas, BPO, ventas, seguros Resultados segmentados siempre que sea posible.
Tasa de falsos positivos de AMD Por debajo del 3% en pilotos seleccionados Un ser humano fue clasificado erróneamente como máquina.
Tasa de falsos negativos de AMD Por debajo del 5% en pilotos seleccionados Máquina clasificada erróneamente como humana
Latencia de detección mediana Menos de 1 segundo Decisión de Recogida de AMD
latencia de detección P90 Menos de 1,5 segundos Decisión de Recogida de AMD
tasa de anulación del agente rango del 2 al 5% Tasa de corrección manual en campañas piloto
Elevación de la tasa de contacto Hasta 4 veces más rápido que la marcación manual. En flujos de trabajo piloto, los resultados varían.
Reducción del tiempo de inactividad Rango del 30 al 45% En campañas piloto seleccionadas

Basado en pruebas piloto internas. Los resultados varían según el tipo de campaña, la calidad de la lista, el operador, la región, el idioma, la configuración del ritmo de comunicación y el flujo de trabajo del agente. Los desgloses completos por idioma y por operador están disponibles bajo acuerdo de confidencialidad.

Idiomas evaluados

Nueve idiomas, datos reales de pilotos

EN

Inglés

AR

árabe

ES

Español

FR

Francés

IT

italiano

DE

Alemán

TR

turco

HI

hindi

UR

Urdu

Los parámetros de referencia del árabe incluyen variantes dialectales del Golfo Pérsico, el Levante y Egipto. Los parámetros de referencia del hindi y el urdu incluyen la cobertura de variantes regionales. Cada idioma se evalúa de forma independiente con desgloses específicos para cada operador y región.

Limitaciones

¿Qué puntos de referencia? no puedo decírtelo

Los resultados varían según el operador. Cada operador ofrece diferentes mensajes de bienvenida en el buzón de voz, calidad de audio y tiempos de conexión.

Los resultados varían según el tipo de campaña. Las campañas de cobro tienen patrones de respuesta diferentes a las campañas de ventas o encuestas.

Los resultados varían según la región. Los estilos de saludo del buzón de voz, la infraestructura del operador y las condiciones de la red difieren entre los distintos mercados.

Los resultados varían según la calidad de la lista. Los números obsoletos, los números incorrectos y las líneas desconectadas afectan el rendimiento de AMD de manera diferente.

Los indicadores de referencia reflejan el rendimiento global. Los resultados de cada campaña pueden ser superiores o inferiores a los promedios publicados.

Los datos de referencia completos están disponibles bajo acuerdo de confidencialidad.

Los informes comparativos detallados, que incluyen tablas de precisión por idioma, desgloses específicos por operador y datos históricos de tendencias, están disponibles para clientes potenciales cualificados bajo un acuerdo de confidencialidad. Póngase en contacto con nuestro equipo para solicitar acceso.

Solicitar datos de referencia

Reserva una demostración y compartiremos resultados detallados de las pruebas de rendimiento de AMD, adaptados a tu idioma, región y tipo de campaña.

View full site in English →