Benchmarks

AMD-Leistung. Ehrlich gemessen.

Unsere Benchmark-Methodik, die von uns erfassten Kennzahlen, die von uns getesteten Sprachen und die von uns anerkannten Einschränkungen. Vollständige Daten sind unter Geheimhaltungsvereinbarung erhältlich.

Was wir vergleichen

AMD-Genauigkeit über verschiedene Sprachen hinweg

Die KI-gestützte AMD-Technologie von DialerBee analysiert die ersten drei Sekunden des Anrufsignals, um festzustellen, ob ein Mensch oder ein Anrufbeantworter den Anruf entgegengenommen hat. Wir testen dieses System in verschiedenen Sprachen, Netzbetreiberumgebungen und Kampagnentypen, um die Genauigkeit im realen Einsatz zu messen.

Im Gegensatz zu Anbietern, die über Genauigkeit unter Laborbedingungen berichten, spiegeln unsere Benchmarks Produktionsdaten mit all dem Rauschen, der Variabilität der Transportunternehmen und den regionalen Unterschieden wider, die bei realen Outbound-Kampagnen auftreten.

Methodik

Wie wir Messgenauigkeit

Transkriptklassifizierung

Das AMD-Modell klassifiziert ein Echtzeit-Transkript der ersten 3 Sekunden eines Audiosignals. Es liest Wörter und Phrasen, nicht Audiowellenformen oder Pieptöne.

Agentenüberschreibung als Grundwahrheit

Wenn Agenten mit der AMD-Klassifizierung nicht einverstanden sind, markieren sie diese mit einem Klick. Diese Überschreibungen dienen als Referenzwerte zur Messung der Genauigkeit.

Kontinuierliche Bewertung

Benchmarks sind keine einmaligen Tests. Wir bewerten kontinuierlich die Genauigkeit anhand der zahlreichen Agentenüberschreibungen in allen Produktionskampagnen.

Erfasste Kennzahlen

Fünf Kennzahlen das ist wichtig

Genauigkeit

Gesamtquote korrekter Klassifizierungen über alle Anrufe hinweg.

Falsch-Positiv-Rate

Menschliche Anrufe wurden fälschlicherweise als Anrufe von Maschinen eingestuft.

Falsch-Negativ-Rate

Maschinenanrufe wurden fälschlicherweise als menschliche Anrufe klassifiziert.

Erkennungslatenz

Zeitspanne von der Anrufannahme bis zur AMD-Klassifizierungsentscheidung.

Agenten-Überschreibungsrate

Prozentsatz der Anrufe, bei denen die Agenten die AMD-Entscheidung korrigieren.

Benchmark-Zusammenfassung

Öffentliche Zusammenfassung aus internen Pilotprojekten

Detaillierte Daten nach Sprache, Anbieter und Region sind für qualifizierte Interessenten unter Geheimhaltungsvereinbarung erhältlich.

Metrisch Öffentliche Zusammenfassung Anmerkungen
Anrufe ausgewertet Bereich 10.000–50.000 Im Rahmen interner Pilotkampagnen
Datumsbereich 1.–2. Quartal 2026 Aktualisiert, sobald neue Pilotdaten verfügbar sind
getestete Sprachen 9 EN, AR, ES, FR, IT, DE, TR, HI, UR
getestete Regionen MENA, Europa, Nordamerika Die Zusammensetzung der Träger variiert je nach Region.
Kampagnentypen Inkasso, BPO, Vertrieb, Versicherung Ergebnisse, soweit möglich, segmentiert.
AMD-Falsch-Positiv-Rate Unter 3 % in ausgewählten Pilotprojekten Mensch fälschlicherweise als Maschine eingestuft
AMD-Falsch-Negativrate Unter 5 % in ausgewählten Pilotprojekten Maschine fälschlicherweise als Mensch eingestuft
Mittlere Erkennungslatenz Unter 1 Sekunde Übernahme der AMD-Entscheidung
P90-Erkennungslatenz Unter 1,5 Sekunden Übernahme der AMD-Entscheidung
Agentenüberschreibungsrate Bereich 2–5 % Manuelle Korrekturrate in Pilotkampagnen
Kontaktratenerhöhung Bis zu 4-fache Geschwindigkeit im Vergleich zur manuellen Wahl In Pilot-Workflows variieren die Ergebnisse.
Leerlaufzeitreduzierung 30–45% Bereich In ausgewählten Pilotkampagnen

Basierend auf internen Pilotstudien. Die Ergebnisse variieren je nach Kampagnentyp, Listenqualität, Anbieter, Region, Sprache, Tempokonfiguration und Agenten-Workflow. Detaillierte Aufschlüsselungen nach Sprache und Anbieter sind unter Geheimhaltungsvereinbarung erhältlich.

Getestete Sprachen

Neun Sprachen, reale Pilotdaten

EN

Englisch

AR

Arabisch

ES

Spanisch

FR

Französisch

IT

Italienisch

DE

Deutsch

TR

Türkisch

HI

Hindi

UR

Urdu

Die arabischen Benchmarks umfassen Golf-, Levante- und ägyptische Dialektvarianten. Die Hindi- und Urdu-Benchmarks decken regionale Varianten ab. Jede Sprache wird separat mit anbieter- und regionsspezifischen Aufschlüsselungen analysiert.

Einschränkungen

Welche Benchmarks Ich kann es dir nicht sagen

Die Ergebnisse variieren je nach Anbieter. Unterschiedliche Anbieter bieten unterschiedliche Voicemail-Begrüßungen, Audioqualität und Verbindungszeiten.

Die Ergebnisse variieren je nach Kampagnentyp. Inkassokampagnen weisen andere Abholmuster auf als Verkaufs- oder Umfragekampagnen.

Die Ergebnisse variieren je nach Region. Voicemail-Begrüßungsstile, Netzinfrastruktur und Netzwerkbedingungen unterscheiden sich von Markt zu Markt.

Die Ergebnisse variieren je nach Qualität der Datenliste. Veraltete, falsche und unterbrochene Datenreihen beeinträchtigen die AMD-Leistung unterschiedlich.

Die Benchmarks spiegeln die Gesamtleistung wider. Die Ergebnisse einzelner Kampagnen können über oder unter den angegebenen Durchschnittswerten liegen.

Vollständige Benchmark-Daten sind unter Geheimhaltungsvereinbarung erhältlich.

Detaillierte Benchmark-Berichte mit sprachspezifischen Genauigkeitstabellen, anbieterspezifischen Aufschlüsselungen und historischen Trenddaten sind für qualifizierte Interessenten unter Einhaltung einer Vertraulichkeitsvereinbarung erhältlich. Kontaktieren Sie unser Team, um Zugang zu erhalten.

Benchmark-Daten anfordern

Buchen Sie eine Demo und wir senden Ihnen detaillierte AMD-Benchmark-Ergebnisse, die auf Ihre Sprache, Region und Ihren Kampagnentyp zugeschnitten sind.

View full site in English →