Zum Inhalt springen

Stand des privaten Diktats · 2026

Messen, was beim Diktieren ausgelassen wird.

Genauigkeit, Löschungen, Latenz und beobachtbares Netzwerkverhalten aller Sprachtools auf dem Gerät. Wir veröffentlichen neben den Zahlen auch die Methode, die Grenzwerte und die bereinigten Daten.

01 · Pilotergebnisse

Die ersten Zahlen, im Vollbild.

Bei aktivierter lokaler Bereinigung verzeichnete das Pilotprojekt eine mittlere Verarbeitungszeit von 1.124 ms und eine Wortfehlerrate von 3,46 %. Dieselben 20 sauberen synthetischen Vorrichtungen wurden dreimal pro Spur auf einem M1 Max MacBook Pro mit Yaps 2.3.2129 dekodiert. Niedrigere Fehler- und Latenzwerte sind in diesem genauen Setup besser. Dabei handelt es sich um Yaps-Konfigurationen, nicht um Konkurrenzprodukte.

Vorrichtungen
20
Läufe pro Spur
60
Wörter, mit Wiederholungen
1,473
Sprachursprung
Synthetik
Testgerät
1
Fehleraggregation
Mikro
Bereinigung auf60 läuft

Core ML Parakeet + lokale Bereinigung

Mikro WER
3.46%
Löschrate
0.41%
Mittlere Verarbeitung
1,124 ms
p95-Verarbeitung
2,807 ms
Maximale Verarbeitung
2,958 ms
Bereinigt60 läuft

Core ML Parakeet, Bereinigung aus

Mikro WER
3.67%
Löschrate
0.20%
Mittlere Verarbeitung
250 ms
p95-Verarbeitung
722 ms
Maximale Verarbeitung
1,863 ms
Bereinigt60 läuft

Whisper Base, Bereinigung von

Mikro WER
6.52%
Löschrate
0.41%
Mittlere Verarbeitung
844 ms
p95-Verarbeitung
1,669 ms
Maximale Verarbeitung
2,189 ms

Die Verarbeitungszeit umfasst Erkennung, Pipeline-Abschluss und lokale Bereinigung, wenn aktiviert. Ausgenommen sind die anfängliche Laufzeitkonstruktion, das Laden von Fixtures, die Live-Aufzeichnung, das Versenden von Verknüpfungen und das Einfügen von Cursorn. Alle Bahnen bewerten die endgültige Ausgabe des Bewerters. Aufräumspuren können weiterhin Vokabular- und Formatierungsänderungen vornehmen.

Latency verwendet 60 gleichgewichtete Dekodierproben pro Spur und lineare R-7-Quantile. Die 20 Spiele enthalten 491 Referenzwortpositionen pro Durchgang, die im 1.473 Wörter umfassenden Nenner dreimal gezählt werden. Wiederholungen sind keine eigenständigen Äußerungen. Qualitätsschwellenfehler bleiben enthalten: 3 mit aktivierter Core ML-Bereinigung, 3 mit deaktivierter Core ML-Bereinigung und 6 mit Whisper.

Dolmetschen korrigiert am 6. September 2026. Die ursprünglichen Zahlen bleiben unverändert. Lesen Sie die Beweisprüfung, externe Referenzen, verbleibende Einschränkungen und Reproduktionshinweise.

Was dieser Pilot unterstützt

Eine angepasste Bereinigung Beobachtung.

In diesen Läufen war Whisper Base mit ausgeschalteter Bereinigung um 2,85 Prozentpunkte höher WER, 0,20 Punkte höhere Löschrate, ein 595 ms höherer Median und ein 947 ms höherer p95 als Core ML Parakeet mit deaktivierter Bereinigung.

Was es nicht unterstützt

Ein allgemeiner Produkt- oder Datenschutzanspruch.

Der Pilot schließt menschliche Sprache, Akzente, mehrsprachige Sprache, Live-Mikrofonerfassung, kontrollierte thermische Ordnung, Netzwerkbeobachtung, zusätzliche Geräte und Produkte von Drittanbietern aus.

02 · Produktebene

Ein Model ist kein Diktiererlebnis.

Warum Yaps in den Bericht gehört

Das Herunterladen von Modellgewichten ist der einfache Teil. Ein nützliches Diktiersystem muss Audio zuverlässig erfassen, die richtige Laufzeit wählen, Sprache für dieses Modell vorbereiten, unvollständige Ausgaben erkennen, die Absicht des Benutzers bewahren und das Ergebnis überall dort platzieren, wo er arbeitet.

. Yaps verwandelt leistungsfähige lokale Sprachmodelle in ein einziges privates Tool, das Benutzer in ihren alltäglichen Apps verwenden können, ohne selbst Modellserver, Skripte, Audio-Pipelines oder Exportschritte zusammenzustellen.
01

Erfassen

Eine Tastenkombination oder eine mobile Tastatur startet eine private Aufnahme, ohne den Benutzer in ein separates Transkriptionstool zu verschieben.

02

Vorbereiten

Yaps wendet vor der Erkennung Spracherkennung, Stillebehandlung und geräteförmige Audiovorbereitung an.

03

Route

Die App wählt eine installierte lokale Engine für das Gerät, die Sprache, die Qualitätseinstellung und die verfügbare Hardware aus.

04

Erkennen Sie den Datensatz

Parakeet , Cohere , Whisper oder eine spezielle Route wandelt das vorbereitete Audio in Kandidatentext um.

05

Wache

Vollständigkeitsprüfungen, Rettungspfade, Vokabularbehandlung und lokale Bereinigung schützen das gelieferte Ergebnis.

06

Deliver

Der fertige Text wird am Cursor oder in den mobilen Tastatur-Workflow übernommen und ist sofort einsatzbereit.

Dieser Produktkontext erklärt, warum der Bericht zwischen Bereinigungseinstellungen und der gemessenen Leistungsstufe unterscheidet. Es ist kein Beweis dafür, dass Yaps das Beste ist, und es macht die Produktpositionierung nicht zu einem Benchmark-Ergebnis.

03 · Breitere Evidenz

Das Forschungsprogramm ist bereits größer als ein Pilotprojekt.

Diese Begleitstudien verwendeten unterschiedliche Geräte, Korpora, Metriken und Testprotokolle. Ihre Zahlen erklären aktuelle Produktentscheidungen, dürfen aber nicht in einer einzigen Rangliste zusammengefasst werden.

Apple Silicon · mehrsprachigVerwandte Studie

Cohere ändert die Routing-Konversation.

Bei einem umfassenderen M1 Max-Bake-off wurden 144 synthetische Clips in 24 Sprachen und 65 menschliche FLEURS-Clips in 13 Sprachen verwendet. Bei der übereinstimmenden 20-Clip-Menschenuntergruppe, die von Cohere und jedem Modell geteilt wurde, verzeichnete Cohere 4,2 % geprüfte WER gegenüber 12,0 % für MLX Parakeet.

Cohere WER
4.2%
MLX Parakeet
12.0%
Passende menschliche Clips
20
Cohere unterstützt einen engeren Sprachsatz und erfordert eine erwartete Sprache. Fünf Clips pro Sprache bleiben ein richtungsweisender Beweis und kein allgemeingültiger Qualitätsanspruch.
Windows 11 · CohereVerwandte Studie

Höhere mehrsprachige Zuverlässigkeit mit Latenzkosten.

Auf einem Ryzen 7 5700U Windows-Laptop führten Cohere und ONNX Parakeet dieselben 70 menschlichen FLEURS-Clips in 14 Sprachen aus. Cohere hat 70 nicht leere Transkripte zurückgegeben;Parakeet erzielte einen Wert von 61. Cohere gewann 12 von 14 automatisierten Sprachvergleichen, erreichte jedoch einen Durchschnitt von 3,654 Sekunden pro Clip gegenüber 1,394 Sekunden für Parakeet.

Cohere nicht leer
70/70
Parakeet non-empty
61/70
Cohere bedeutet
3.654 s
Die Sprachbewertungen bleiben richtungsabhängig, bis jeder Unterschied ungleich Null vollständig manuell beurteilt wird. Die bereinigten Reihen sind noch nicht Teil dieser öffentlichen Veröffentlichung.
Android · Arabische VorschauVerwandte Studie

Die Gerätegeschwindigkeit kann nachlassen, während die Korpusabdeckung immer noch fehlschlägt.

Ein arabisches FastConformer-Rudel lief auf einem Pixel 10 Pro. Mit Ausnahme eines ungültigen Referenzpaares ergaben 39 FLEURS-Clips 9,8 % WER und 4,1 % CER, mit einem Median von 624 ms und einem p95 von 984 ms. Ein breiteres, sauberes und verrauschtes MASC-Segment auf der Mac-CPU erzielte später 22,5 % WER, sodass die Route weiterhin in der Vorschau bleibt und nicht zu einem allgemeinen arabischen Anspruch wird.

Gültige Clips
39
Mediane Dekodierung
624 ms
p95-Dekodierung
984 ms
Das Telefonergebnis umfasst gelesene Sprache, nicht den spontanen MSA- und Dialektgebrauch. Das breitere MASC-Ergebnis ist der Grund dafür, dass die App die Route explizit mit der Bezeichnung „Vorschau“ behält.
04 · Plattformabdeckung

Zeigen Sie die Lücken, anstatt sie zu verbergen.

macOS · Apple Silicon

Veröffentlichter Pilot

Aktuelle ErkenntnisseDer aktuelle 20-Spiele-Pilot plus ein separates mehrsprachiges Modell-Bake-off mit 144 synthetischen und 65 menschlichen Spielern.

Nächstes BeweistorFügen Sie spontane Sprache, weitere Mac-Generationen, kontrollierte Wärmeordnung und Live-Mikrofonaufnahme hinzu.

Windows · x64

Verwandte Beweise

Aktuelle ErkenntnisseEine separate menschliche FLEURS-Validierung mit 70 Clips und 14 Sprachen verglich Cohere und ONNX Parakeet unter Windows 11.

Nächstes BeweistorVeröffentlichen Sie bereinigte Zeilen unter dem eingefrorenen Protokoll und fügen Sie weniger Speicher und zusätzliche GPU-Klassen hinzu.

Android · ARM64

Verwandte Beweise

Aktuelle ErkenntnisseBei einem Test des Pixel 10 Pro wurde ein arabisches FastConformer-Paket getestet und der echte Tastaturpfad getestet.

Nächstes BeweistorFügen Sie spontane Dialektsprache, mehr Telefonebenen, englische Routenparität, Batterie und Messungen für die dauerhafte Nutzung hinzu.

Linux · x64

Forschungslücke

Aktuelle ErkenntnisseYaps ist unter Linux verfügbar, dieser Bericht enthält jedoch keinen nativen Linux-Genauigkeits- oder Latenzlauf in Berichtsqualität.

Nächstes Beweistoraus. Führen Sie die native Ubuntu-Fixture-Wiedergabe, das Diktieren installierter Pakete, CPU- und Vulkan-Pfade, X11 und Wayland aus.

iOS · ARM64

Forschungslücke

Aktuelle ErkenntnisseYaps ist für iOS verfügbar, dieser Bericht enthält jedoch noch keinen iPhone-Geräte-Benchmark.

Nächstes BeweistorMessen Sie die tatsächliche Tastaturausdehnung, das Laden des Modells, den Speicherdruck, den Energieverbrauch und die End-to-End-Commit-Latenz.

05 · Forschungsfrage

Ein flüssiges Transkript kann immer noch falsch sein.

01

Genauigkeit

Wie viele Referenzwörter werden nach der deterministischen Normalisierung ersetzt, eingefügt oder gelöscht?

02

Stilles Löschen

Verliert ein Transkript ganze Wörter oder Sätze und klingt dennoch flüssig genug, um einer kurzen Durchsicht zu entgehen?

03

Reaktionsfähigkeit

Wie lange dauert die Verarbeitung in einer Verteilung, nicht nur im schnellsten Einzellauf?

04

Netzwerkverhalten

Welche Verbindungen und Nutzlasten werden während eines definierten Workflows beobachtet, wobei die Grenzen der Paketbeobachtung klar angegeben sind?

06 · Publikationsdesign

Beweise, die Sie bis zu ihrer Quelle verfolgen können.

Der Pilot unterscheidet semantische Bereinigungseinstellungen, bewertet die endgültige Evaluator-Ausgabe, meldet Ersetzungen, Einfügungen und Löschungen unabhängig und hält private Sprachinhalte außerhalb der öffentlichen Veröffentlichung. Vergleichbare Systeme empfangen die gleichen Audiobytes, sofern ihre Schnittstellen dies zulassen; Inkompatible Fangwege gehören in klar getrennte Schichten.

01Eingefrorener öffentlicher oder genehmigter Korpus
02Deklariertes System, Modell und Gerät
03Wiederholte Läufe mit beibehaltenen Fehlern
04Word-Level S / I / D-Ausrichtung
05Inhaltsfreie öffentliche Zeilen und Aggregate
07 · Lesen Sie den Datensatz

Überprüfen Sie die Methode und jede öffentliche Zeile.

Stand des privaten Diktats 2026Methodenversion 0.1.0Nur PilotnachweiseEntworfen und veröffentlicht von Yaps