Benchmarks
AMD-Leistung. Ehrlich gemessen.
Unsere Benchmark-Methodik, die von uns erfassten Kennzahlen, die von uns getesteten Sprachen und die von uns anerkannten Einschränkungen. Vollständige Daten sind unter Geheimhaltungsvereinbarung erhältlich.
Was wir vergleichen
AMD-Genauigkeit über verschiedene Sprachen hinweg
Die KI-gestützte AMD-Technologie von DialerBee analysiert die ersten drei Sekunden des Anrufsignals, um festzustellen, ob ein Mensch oder ein Anrufbeantworter den Anruf entgegengenommen hat. Wir testen dieses System in verschiedenen Sprachen, Netzbetreiberumgebungen und Kampagnentypen, um die Genauigkeit im realen Einsatz zu messen.
Im Gegensatz zu Anbietern, die über Genauigkeit unter Laborbedingungen berichten, spiegeln unsere Benchmarks Produktionsdaten mit all dem Rauschen, der Variabilität der Transportunternehmen und den regionalen Unterschieden wider, die bei realen Outbound-Kampagnen auftreten.
Methodik
Wie wir Messgenauigkeit
Transkriptklassifizierung
Das AMD-Modell klassifiziert ein Echtzeit-Transkript der ersten 3 Sekunden eines Audiosignals. Es liest Wörter und Phrasen, nicht Audiowellenformen oder Pieptöne.
Agentenüberschreibung als Grundwahrheit
Wenn Agenten mit der AMD-Klassifizierung nicht einverstanden sind, markieren sie diese mit einem Klick. Diese Überschreibungen dienen als Referenzwerte zur Messung der Genauigkeit.
Kontinuierliche Bewertung
Benchmarks sind keine einmaligen Tests. Wir bewerten kontinuierlich die Genauigkeit anhand der zahlreichen Agentenüberschreibungen in allen Produktionskampagnen.
Erfasste Kennzahlen
Fünf Kennzahlen das ist wichtig
Genauigkeit
Gesamtquote korrekter Klassifizierungen über alle Anrufe hinweg.
Falsch-Positiv-Rate
Menschliche Anrufe wurden fälschlicherweise als Anrufe von Maschinen eingestuft.
Falsch-Negativ-Rate
Maschinenanrufe wurden fälschlicherweise als menschliche Anrufe klassifiziert.
Erkennungslatenz
Zeitspanne von der Anrufannahme bis zur AMD-Klassifizierungsentscheidung.
Agenten-Überschreibungsrate
Prozentsatz der Anrufe, bei denen die Agenten die AMD-Entscheidung korrigieren.
Benchmark-Zusammenfassung
Öffentliche Zusammenfassung aus internen Pilotprojekten
Detaillierte Daten nach Sprache, Anbieter und Region sind für qualifizierte Interessenten unter Geheimhaltungsvereinbarung erhältlich.
| Metrisch | Öffentliche Zusammenfassung | Anmerkungen |
|---|---|---|
| Anrufe ausgewertet | Bereich 10.000–50.000 | Im Rahmen interner Pilotkampagnen |
| Datumsbereich | 1.–2. Quartal 2026 | Aktualisiert, sobald neue Pilotdaten verfügbar sind |
| getestete Sprachen | 9 | EN, AR, ES, FR, IT, DE, TR, HI, UR |
| getestete Regionen | MENA, Europa, Nordamerika | Die Zusammensetzung der Träger variiert je nach Region. |
| Kampagnentypen | Inkasso, BPO, Vertrieb, Versicherung | Ergebnisse, soweit möglich, segmentiert. |
| AMD-Falsch-Positiv-Rate | Unter 3 % in ausgewählten Pilotprojekten | Mensch fälschlicherweise als Maschine eingestuft |
| AMD-Falsch-Negativrate | Unter 5 % in ausgewählten Pilotprojekten | Maschine fälschlicherweise als Mensch eingestuft |
| Mittlere Erkennungslatenz | Unter 1 Sekunde | Übernahme der AMD-Entscheidung |
| P90-Erkennungslatenz | Unter 1,5 Sekunden | Übernahme der AMD-Entscheidung |
| Agentenüberschreibungsrate | Bereich 2–5 % | Manuelle Korrekturrate in Pilotkampagnen |
| Kontaktratenerhöhung | Bis zu 4-fache Geschwindigkeit im Vergleich zur manuellen Wahl | In Pilot-Workflows variieren die Ergebnisse. |
| Leerlaufzeitreduzierung | 30–45% Bereich | In ausgewählten Pilotkampagnen |
Basierend auf internen Pilotstudien. Die Ergebnisse variieren je nach Kampagnentyp, Listenqualität, Anbieter, Region, Sprache, Tempokonfiguration und Agenten-Workflow. Detaillierte Aufschlüsselungen nach Sprache und Anbieter sind unter Geheimhaltungsvereinbarung erhältlich.
Getestete Sprachen
Neun Sprachen, reale Pilotdaten
EN
Englisch
AR
Arabisch
ES
Spanisch
FR
Französisch
IT
Italienisch
DE
Deutsch
TR
Türkisch
HI
Hindi
UR
Urdu
Die arabischen Benchmarks umfassen Golf-, Levante- und ägyptische Dialektvarianten. Die Hindi- und Urdu-Benchmarks decken regionale Varianten ab. Jede Sprache wird separat mit anbieter- und regionsspezifischen Aufschlüsselungen analysiert.
Einschränkungen
Welche Benchmarks Ich kann es dir nicht sagen
Die Ergebnisse variieren je nach Anbieter. Unterschiedliche Anbieter bieten unterschiedliche Voicemail-Begrüßungen, Audioqualität und Verbindungszeiten.
Die Ergebnisse variieren je nach Kampagnentyp. Inkassokampagnen weisen andere Abholmuster auf als Verkaufs- oder Umfragekampagnen.
Die Ergebnisse variieren je nach Region. Voicemail-Begrüßungsstile, Netzinfrastruktur und Netzwerkbedingungen unterscheiden sich von Markt zu Markt.
Die Ergebnisse variieren je nach Qualität der Datenliste. Veraltete, falsche und unterbrochene Datenreihen beeinträchtigen die AMD-Leistung unterschiedlich.
Die Benchmarks spiegeln die Gesamtleistung wider. Die Ergebnisse einzelner Kampagnen können über oder unter den angegebenen Durchschnittswerten liegen.
Vollständige Benchmark-Daten sind unter Geheimhaltungsvereinbarung erhältlich.
Detaillierte Benchmark-Berichte mit sprachspezifischen Genauigkeitstabellen, anbieterspezifischen Aufschlüsselungen und historischen Trenddaten sind für qualifizierte Interessenten unter Einhaltung einer Vertraulichkeitsvereinbarung erhältlich. Kontaktieren Sie unser Team, um Zugang zu erhalten.
Benchmark-Daten anfordern
Buchen Sie eine Demo und wir senden Ihnen detaillierte AMD-Benchmark-Ergebnisse, die auf Ihre Sprache, Region und Ihren Kampagnentyp zugeschnitten sind.