Pilotergebnisse · Interpretation korrigiert 6. September 2026
Drei Testkategorien. Eine begrenzte Pilotstudie.
Die gleichen 20 sauberen synthetischen Vorrichtungen, dreimal pro Spur auf einem M1 Max MacBook Pro mit Yaps 2.3.2129 dekodiert. Core ML Parakeet und Whisper Base sind Modellkonfigurationen innerhalb von Yaps, keine Konkurrenzprodukte.
01 · Aggregierter Datensatz
Erkennung mit lokaler Bereinigung, gemeinsam gemessen.
Yaps synthetischer Fixture-Replay-Pilot. Niedrigere WER-, Löschraten- und Latenzwerte weisen auf weniger Fehler oder eine kürzere Verarbeitungszeit innerhalb dieses genauen Lauf-Setups hin;Es handelt sich nicht um Produktrankings.
Yaps Output Lane
Rolle
Läuft
Wörter, mit Wiederholungen
Mikro WER
Löschrate
Mittlere Verarbeitung
p95-Verarbeitung
Maximale Verarbeitung
Core ML Parakeet + lokale Bereinigung
Bereinigung auf
60
1,473
3.46%
0.41%
1,124 ms
2,807 ms
2,958 ms
Core ML Parakeet, Bereinigung aus
Bereinigt
60
1,473
3.67%
0.20%
250 ms
722 ms
1,863 ms
Whisper Base, Bereinigung von
Bereinigt
60
1,473
6.52%
0.41%
844 ms
1,669 ms
2,189 ms
Die Verarbeitungszeit umfasst Erkennung, Pipeline-Abschluss und lokale Bereinigung, wenn aktiviert. Ausgenommen sind die anfängliche Laufzeitkonstruktion, das Laden von Fixtures, die Live-Aufzeichnung, das Versenden von Verknüpfungen und das Einfügen von Cursorn. Alle Bahnen bewerten die endgültige Ausgabe des Bewerters. Aufräumspuren können weiterhin Vokabular- und Formatierungsänderungen vornehmen.
Latency verwendet 60 gleichgewichtete Dekodierproben pro Spur und lineare R-7-Quantile. Die 20 Spiele enthalten 491 Referenzwortpositionen pro Durchgang, die im 1.473 Wörter umfassenden Nenner dreimal gezählt werden. Wiederholungen sind keine eigenständigen Äußerungen. Qualitätsschwellenfehler bleiben enthalten: 3 mit aktivierter Core ML-Bereinigung, 3 mit deaktivierter Core ML-Bereinigung und 6 mit Whisper.
„Mikro“ bedeutet, dass die Anzahl der Bearbeitungsvorgänge und Referenzwörter vor der Berechnung jeder Rate summiert wurden. Es handelt sich nicht um den Makrodurchschnitt der Prozentsätze pro Clip.
02 · Eingeschränkte Lektüre
Was diese drei Reihen unterstützen können.
Bereinigt
Passende Bereinigungskonfigurationen
Whisper Base mit ausgeschalteter Bereinigung hatte in diesem abgestimmten Pilotprojekt eine um 2,85 Prozentpunkte höhere WER, eine um 0,20 Punkte höhere Löschungsrate, einen um 595 ms höheren Median und einen um 947 ms höheren p95 als Core ML Parakeet mit ausgeschalteter Bereinigung läuft.
Bereinigungsfähige Spur
Erkennung und Bereinigung zusammen
Die für die Bereinigung aktivierte Spur Core ML umfasst eine lokale semantische Bereinigung. Sein Median von 1.124 ms und p95 von 2.807 ms beschreiben die gemeinsame Erkennung und Finalisierung vor dem Einfügen in eine andere Anwendung.
Was hat funktioniert?
Veröffentlichungspipeline
Der Sanitizer behielt Zählungen und Latenz bei, während Transkripte, Referenzen, Eingabeaufforderungen und Anwendungskontext ausgeschlossen wurden. Die Integrität öffentlicher Dateien wird mit SHA-256-Digests aufgezeichnet.
Was bleibt
Benchmark-Beweise
Menschliche Sprache, mehrere Akzente und Sprachen, Live-Mikrofonerfassung, kontrollierte thermische Ordnung, Netzwerkbeobachtung, mehr Geräte und Systeme von Drittanbietern sind weiterhin erforderlich.
03 · Explizite Ausschlüsse
Was dieser Pilot nicht zeigt.
Vergleichbare Leistung mit jedem anderen Produkt.
Leistung bei menschlicher Sprache, Akzenten oder mehrsprachiger Sprache.
Live-Mikrofon, Denoise, Silence-Gate, First-Word- oder Tail-Flush-Verhalten.
Kalt-gegen-Warm-Leistung unter einem kontrollierten thermischen Protokoll.
Offline- oder Datenschutzverhalten, ermittelt durch Netzwerkbeobachtung.
Eine allgemeine Behauptung, dass eine rohe oder bereinigte Konfiguration besser ist.
Der Korpus, die Gerätematrix, die Reihenfolge und das thermische Verfahren wurden nicht vorregistriert. Diese Beobachtungen beschreiben diese sequentiellen Läufe auf diesem Korpus, diesem Gerät, dieser Softwareversion und diesem Datum.