Benchmarks
AMD-Leistung. Ehrlich gemessen.
Unsere Benchmark-Methodik, die von uns erfassten Kennzahlen, die von uns getesteten Sprachen und die von uns anerkannten Einschränkungen. Wenn uns keine vergleichbaren Daten zu Ihrem Traffic vorliegen, geben wir dies an, anstatt eine Zahl zu nennen.
Kurze Antwort
Was messen die DialerBee-Benchmarks? Sie messen die Genauigkeit der KI- AMD: Das Modell klassifiziert die ersten drei Sekunden eines Anrufs in Echtzeit als Anrufer oder Anrufbeantworter. Wir vergleichen diese Genauigkeit in elf Sprachen, Netzbetreiberumgebungen und Kampagnentypen. Die Referenzwerte basieren auf Agentenkorrekturen: Ein Agent, der mit einer Klassifizierung nicht einverstanden ist, markiert diese mit einem Klick. Die Evaluierung erfolgt kontinuierlich und nicht nur in einem einmaligen Labortest. Fünf Kennzahlen werden erfasst: Genauigkeit, Falsch-Positiv-Rate, Falsch-Negativ-Rate, Erkennungsverzögerung und Korrekturrate durch Agenten. Die veröffentlichten Zahlen stammen aus internen Pilotprojekten und gelten nur unter ausgewählten Bedingungen. Falls uns keine vergleichbaren Daten für Ihr Datenaufkommen vorliegen, geben wir dies an, anstatt einen Wert zu nennen.
Was wir vergleichen
AMD-Genauigkeit über verschiedene Sprachen hinweg
Die KI-gestützte AMD-Technologie von DialerBee analysiert die ersten drei Sekunden des Anrufsignals, um festzustellen, ob ein Mensch oder ein Anrufbeantworter den Anruf entgegengenommen hat. Wir testen dieses System in verschiedenen Sprachen, Netzbetreiberumgebungen und Kampagnentypen, um die Genauigkeit im realen Einsatz zu messen.
Im Gegensatz zu Anbietern, die über Genauigkeit unter Laborbedingungen berichten, spiegeln unsere Benchmarks Produktionsdaten mit all dem Rauschen, der Variabilität der Transportunternehmen und den regionalen Unterschieden wider, die bei realen Outbound-Kampagnen auftreten.
Methodik
Wie wir Messgenauigkeit
Transkriptklassifizierung
Das AMD-Modell klassifiziert ein Echtzeit-Transkript der ersten 3 Sekunden eines Audiosignals. Es liest Wörter und Phrasen, nicht Audiowellenformen oder Pieptöne.
Agentenüberschreibung als Grundwahrheit
Wenn Agenten mit der AMD-Klassifizierung nicht einverstanden sind, markieren sie diese mit einem Klick. Diese Überschreibungen dienen als Referenzwerte zur Messung der Genauigkeit.
Kontinuierliche Bewertung
Benchmarks sind keine einmaligen Tests. Wir bewerten kontinuierlich die Genauigkeit anhand der zahlreichen Agentenüberschreibungen in allen Produktionskampagnen.
Erfasste Kennzahlen
Fünf Kennzahlen das ist wichtig
Genauigkeit
Gesamtquote korrekter Klassifizierungen über alle Anrufe hinweg.
Falsch-Positiv-Rate
Menschliche Anrufe wurden fälschlicherweise als Anrufe von Maschinen eingestuft.
Falsch-Negativ-Rate
Maschinenanrufe wurden fälschlicherweise als menschliche Anrufe klassifiziert.
Erkennungslatenz
Zeitspanne von der Anrufannahme bis zur AMD-Klassifizierungsentscheidung.
Agenten-Überschreibungsrate
Prozentsatz der Anrufe, bei denen die Agenten die AMD-Entscheidung korrigieren.
Benchmark-Zusammenfassung
Öffentliche Zusammenfassung aus internen Pilotprojekten
Detaillierte Zahlen nach Sprache, Fluggesellschaft und Region aus unseren internen Pilotprojekten sind auf Anfrage erhältlich.
| Metrisch | Öffentliche Zusammenfassung | Anmerkungen |
|---|---|---|
| Anrufe ausgewertet | Bereich 10.000–50.000 | Im Rahmen interner Pilotkampagnen |
| Datumsbereich | 1.–2. Quartal 2026 | Aktualisiert, sobald neue Pilotdaten verfügbar sind |
| getestete Sprachen | 9 | EN, AR, ES, FR, IT, DE, TR, HI, UR |
| getestete Regionen | MENA, Europa, Nordamerika | Die Zusammensetzung der Träger variiert je nach Region. |
| Kampagnentypen | Inkasso, BPO, Vertrieb, Versicherung | Ergebnisse, soweit möglich, segmentiert. |
| AMD-Falsch-Positiv-Rate | Unter 3 % in ausgewählten Pilotprojekten | Mensch fälschlicherweise als Maschine eingestuft |
| AMD-Falsch-Negativrate | Unter 5 % in ausgewählten Pilotprojekten | Maschine fälschlicherweise als Mensch eingestuft |
| Mittlere Erkennungslatenz | Unter 1 Sekunde | Übernahme der AMD-Entscheidung |
| P90-Erkennungslatenz | Unter 1,5 Sekunden | Übernahme der AMD-Entscheidung |
| Agentenüberschreibungsrate | Bereich 2–5 % | Manuelle Korrekturrate in Pilotkampagnen |
| Kontaktratenerhöhung | Bis zu 4-fache Geschwindigkeit im Vergleich zur manuellen Wahl | In Pilot-Workflows variieren die Ergebnisse. |
| Leerlaufzeitreduzierung | 30–45% Bereich | In ausgewählten Pilotkampagnen |
Basierend auf internen Pilotstudien. Die Ergebnisse variieren je nach Kampagnentyp, Listenqualität, Anbieter, Region, Sprache, Tempokonfiguration und Agenten-Workflow. Das Verhalten variiert je nach Sprache und Anbieter so stark, dass wir es lieber im Rahmen einer Pilotstudie auf Ihren Routen messen, anstatt einen Durchschnittswert zu veröffentlichen, der nicht Ihren tatsächlichen Ergebnissen entspricht.
Getestete Sprachen
Elf Sprachen, reale Pilotdaten
EN
Englisch
AR
Arabisch
ES
Spanisch
FR
Französisch
IT
Italienisch
DE
Deutsch
TR
Türkisch
HI
Hindi
UR
Urdu
Die arabischen Benchmarks umfassen Golf-, Levante- und ägyptische Dialektvarianten. Die Hindi- und Urdu-Benchmarks decken regionale Varianten ab. Jede Sprache wird separat mit anbieter- und regionsspezifischen Aufschlüsselungen analysiert.
Einschränkungen
Welche Benchmarks Ich kann es dir nicht sagen
Die Ergebnisse variieren je nach Anbieter. Unterschiedliche Anbieter bieten unterschiedliche Voicemail-Begrüßungen, Audioqualität und Verbindungszeiten.
Die Ergebnisse variieren je nach Kampagnentyp. Inkassokampagnen weisen andere Abholmuster auf als Verkaufs- oder Umfragekampagnen.
Die Ergebnisse variieren je nach Region. Voicemail-Begrüßungsstile, Netzinfrastruktur und Netzwerkbedingungen unterscheiden sich von Markt zu Markt.
Die Ergebnisse variieren je nach Qualität der Datenliste. Veraltete, falsche und unterbrochene Datenreihen beeinträchtigen die AMD-Leistung unterschiedlich.
Die Benchmarks spiegeln die Gesamtleistung wider. Die Ergebnisse einzelner Kampagnen können über oder unter den angegebenen Durchschnittswerten liegen.
Vollständige interne Pilot-Benchmark-Daten auf Anfrage
Interne Pilotstudien mit Benchmark-Berichten, inklusive sprachspezifischer Genauigkeitstabellen, detaillierten Aufschlüsselungen nach Mobilfunkanbietern und historischen Trenddaten, sind für qualifizierte Interessenten unter Einhaltung einer Vertraulichkeitsvereinbarung (NDA) verfügbar. Kontaktieren Sie unser Team, um Zugang zu erhalten.
Benchmark-Daten anfordern
Buchen Sie eine Demo und wir senden Ihnen detaillierte AMD-Benchmark-Ergebnisse, die auf Ihre Sprache, Region und Ihren Kampagnentyp zugeschnitten sind.