Zum Inhalt springen

Benchmarks

AMD-Leistung. Ehrlich gemessen.

Unsere Benchmark-Methodik, die von uns erfassten Kennzahlen, die von uns getesteten Sprachen und die von uns anerkannten Einschränkungen. Wenn uns keine vergleichbaren Daten zu Ihrem Traffic vorliegen, geben wir dies an, anstatt eine Zahl zu nennen.

Kurze Antwort

Was messen die DialerBee-Benchmarks? Sie messen die Genauigkeit der KI- AMD: Das Modell klassifiziert die ersten drei Sekunden eines Anrufs in Echtzeit als Anrufer oder Anrufbeantworter. Wir vergleichen diese Genauigkeit in elf Sprachen, Netzbetreiberumgebungen und Kampagnentypen. Die Referenzwerte basieren auf Agentenkorrekturen: Ein Agent, der mit einer Klassifizierung nicht einverstanden ist, markiert diese mit einem Klick. Die Evaluierung erfolgt kontinuierlich und nicht nur in einem einmaligen Labortest. Fünf Kennzahlen werden erfasst: Genauigkeit, Falsch-Positiv-Rate, Falsch-Negativ-Rate, Erkennungsverzögerung und Korrekturrate durch Agenten. Die veröffentlichten Zahlen stammen aus internen Pilotprojekten und gelten nur unter ausgewählten Bedingungen. Falls uns keine vergleichbaren Daten für Ihr Datenaufkommen vorliegen, geben wir dies an, anstatt einen Wert zu nennen.

Was wir vergleichen

AMD-Genauigkeit über verschiedene Sprachen hinweg

Die KI-gestützte AMD-Technologie von DialerBee analysiert die ersten drei Sekunden des Anrufsignals, um festzustellen, ob ein Mensch oder ein Anrufbeantworter den Anruf entgegengenommen hat. Wir testen dieses System in verschiedenen Sprachen, Netzbetreiberumgebungen und Kampagnentypen, um die Genauigkeit im realen Einsatz zu messen.

Im Gegensatz zu Anbietern, die über Genauigkeit unter Laborbedingungen berichten, spiegeln unsere Benchmarks Produktionsdaten mit all dem Rauschen, der Variabilität der Transportunternehmen und den regionalen Unterschieden wider, die bei realen Outbound-Kampagnen auftreten.

Methodik

Wie wir Messgenauigkeit

Transkriptklassifizierung

Das AMD-Modell klassifiziert ein Echtzeit-Transkript der ersten 3 Sekunden eines Audiosignals. Es liest Wörter und Phrasen, nicht Audiowellenformen oder Pieptöne.

Agentenüberschreibung als Grundwahrheit

Wenn Agenten mit der AMD-Klassifizierung nicht einverstanden sind, markieren sie diese mit einem Klick. Diese Überschreibungen dienen als Referenzwerte zur Messung der Genauigkeit.

Kontinuierliche Bewertung

Benchmarks sind keine einmaligen Tests. Wir bewerten kontinuierlich die Genauigkeit anhand der zahlreichen Agentenüberschreibungen in allen Produktionskampagnen.

Erfasste Kennzahlen

Fünf Kennzahlen das ist wichtig

Genauigkeit

Gesamtquote korrekter Klassifizierungen über alle Anrufe hinweg.

Falsch-Positiv-Rate

Menschliche Anrufe wurden fälschlicherweise als Anrufe von Maschinen eingestuft.

Falsch-Negativ-Rate

Maschinenanrufe wurden fälschlicherweise als menschliche Anrufe klassifiziert.

Erkennungslatenz

Zeitspanne von der Anrufannahme bis zur AMD-Klassifizierungsentscheidung.

Agenten-Überschreibungsrate

Prozentsatz der Anrufe, bei denen die Agenten die AMD-Entscheidung korrigieren.

Benchmark-Zusammenfassung

Öffentliche Zusammenfassung aus internen Pilotprojekten

Detaillierte Zahlen nach Sprache, Fluggesellschaft und Region aus unseren internen Pilotprojekten sind auf Anfrage erhältlich.

Metrisch Öffentliche Zusammenfassung Anmerkungen
Anrufe ausgewertet Bereich 10.000–50.000 Im Rahmen interner Pilotkampagnen
Datumsbereich 1.–2. Quartal 2026 Aktualisiert, sobald neue Pilotdaten verfügbar sind
getestete Sprachen 9 EN, AR, ES, FR, IT, DE, TR, HI, UR
getestete Regionen MENA, Europa, Nordamerika Die Zusammensetzung der Träger variiert je nach Region.
Kampagnentypen Inkasso, BPO, Vertrieb, Versicherung Ergebnisse, soweit möglich, segmentiert.
AMD-Falsch-Positiv-Rate Unter 3 % in ausgewählten Pilotprojekten Mensch fälschlicherweise als Maschine eingestuft
AMD-Falsch-Negativrate Unter 5 % in ausgewählten Pilotprojekten Maschine fälschlicherweise als Mensch eingestuft
Mittlere Erkennungslatenz Unter 1 Sekunde Übernahme der AMD-Entscheidung
P90-Erkennungslatenz Unter 1,5 Sekunden Übernahme der AMD-Entscheidung
Agentenüberschreibungsrate Bereich 2–5 % Manuelle Korrekturrate in Pilotkampagnen
Kontaktratenerhöhung Bis zu 4-fache Geschwindigkeit im Vergleich zur manuellen Wahl In Pilot-Workflows variieren die Ergebnisse.
Leerlaufzeitreduzierung 30–45% Bereich In ausgewählten Pilotkampagnen

Basierend auf internen Pilotstudien. Die Ergebnisse variieren je nach Kampagnentyp, Listenqualität, Anbieter, Region, Sprache, Tempokonfiguration und Agenten-Workflow. Das Verhalten variiert je nach Sprache und Anbieter so stark, dass wir es lieber im Rahmen einer Pilotstudie auf Ihren Routen messen, anstatt einen Durchschnittswert zu veröffentlichen, der nicht Ihren tatsächlichen Ergebnissen entspricht.

Getestete Sprachen

Elf Sprachen, reale Pilotdaten

EN

Englisch

AR

Arabisch

ES

Spanisch

FR

Französisch

IT

Italienisch

DE

Deutsch

TR

Türkisch

HI

Hindi

UR

Urdu

Die arabischen Benchmarks umfassen Golf-, Levante- und ägyptische Dialektvarianten. Die Hindi- und Urdu-Benchmarks decken regionale Varianten ab. Jede Sprache wird separat mit anbieter- und regionsspezifischen Aufschlüsselungen analysiert.

Einschränkungen

Welche Benchmarks Ich kann es dir nicht sagen

Die Ergebnisse variieren je nach Anbieter. Unterschiedliche Anbieter bieten unterschiedliche Voicemail-Begrüßungen, Audioqualität und Verbindungszeiten.

Die Ergebnisse variieren je nach Kampagnentyp. Inkassokampagnen weisen andere Abholmuster auf als Verkaufs- oder Umfragekampagnen.

Die Ergebnisse variieren je nach Region. Voicemail-Begrüßungsstile, Netzinfrastruktur und Netzwerkbedingungen unterscheiden sich von Markt zu Markt.

Die Ergebnisse variieren je nach Qualität der Datenliste. Veraltete, falsche und unterbrochene Datenreihen beeinträchtigen die AMD-Leistung unterschiedlich.

Die Benchmarks spiegeln die Gesamtleistung wider. Die Ergebnisse einzelner Kampagnen können über oder unter den angegebenen Durchschnittswerten liegen.

Vollständige interne Pilot-Benchmark-Daten auf Anfrage

Interne Pilotstudien mit Benchmark-Berichten, inklusive sprachspezifischer Genauigkeitstabellen, detaillierten Aufschlüsselungen nach Mobilfunkanbietern und historischen Trenddaten, sind für qualifizierte Interessenten unter Einhaltung einer Vertraulichkeitsvereinbarung (NDA) verfügbar. Kontaktieren Sie unser Team, um Zugang zu erhalten.

Benchmark-Daten anfordern

Buchen Sie eine Demo und wir senden Ihnen detaillierte AMD-Benchmark-Ergebnisse, die auf Ihre Sprache, Region und Ihren Kampagnentyp zugeschnitten sind.

Vollständige Website auf Englisch ansehen →