Rezultate pilot · interpretare corectată 6 septembrie 2026
Trei categorii de teste. Un studiu pilot limitat.
Aceleași 20 de dispozitive sintetice curate, decodate de trei ori pe bandă pe un M1 Max MacBook Pro folosind Yaps 2.3.2129. Core ML Parakeet și Whisper Base sunt configurații de model în interiorul Yaps, nu produse concurente.
01 · Înregistrare agregată
Recunoaștere cu curățare locală, măsurate împreună.
Yaps pilot de redare a montajului sintetic. Valorile mai mici de WER, rată de ștergere și latență indică mai puține erori sau un timp de procesare mai scurt în această configurație exactă de rulare; ele nu sunt clasamente de produs.
Calea de ieșire Yaps
Rol
Rulează
Cuvinte, cu repetări
Micro WER
Rata de ștergere
Prelucrare mediană
p95 procesare
Procesare maximă
Core ML Parakeet + curățare locală
Curățare pe
60
1,473
3.46%
0.41%
1,124 ms
2,807 ms
2,958 ms
Core ML Parakeet, curățare dezactivată
Curățare dezactivată
60
1,473
3.67%
0.20%
250 ms
722 ms
1,863 ms
Whisper Base, curățare
Curățare dezactivată
60
1,473
6.52%
0.41%
844 ms
1,669 ms
2,189 ms
Timpul de procesare include recunoașterea, finalizarea conductei și curățarea locală atunci când este activată. Exclude construcția inițială a timpului de rulare, încărcarea dispozitivului, înregistrarea live, trimiterea comenzilor rapide și inserarea cursorului. Toate benzile au punctat rezultatul final al evaluatorului; benzile de curățare pot aplica în continuare modificări de vocabular și formatare.
Latența utilizează 60 de eșantioane de decodificare egal ponderate pe bandă și cuantile liniare R-7. Cele 20 de meciuri conțin 491 de poziții de cuvinte de referință per trecere, numărate de trei ori la numitorul de 1.473 de cuvinte. Repetările nu sunt enunțuri independente. Eșecurile de prag de calitate rămân incluse: 3 cu Core ML curățare activată, 3 cu Core ML curățare dezactivată și 6 cu Whisper.
„Micro” înseamnă că numărul de operațiuni de editare și cuvintele de referință au fost însumate înainte de calcularea fiecărei rate. Nu este media macro a procentajelor per clip.
02 · Lectură limitată
Ce pot susține aceste trei rânduri.
Curățare dezactivată
Configurații de curățare potrivite
Whisper Base cu curățare dezactivată a avut cu 2,85 de puncte procentuale mai mare WER, o rată de ștergere cu 0,20 de puncte mai mare, o medie cu 595 ms mai mare și un p95 cu 947 ms mai mare decât Core ML Core ML Parakeet rulat cu Core ML pilot.
Bandă activată pentru curățare
Recunoaștere și curățare împreună
Banda activată pentru curățare Core ML include curățarea semantică locală. Mediana sa de 1.124 ms și p95 de 2.807 ms descriu recunoașterea și finalizarea împreună, înainte de inserarea într-o altă aplicație.
Ce a funcționat
Flux de publicare
Sanitizatorul a reținut numerele și latența, excluzând transcripturile, referințele, indicațiile și contextul aplicației. Integritatea fișierelor publice este înregistrată cu digesturi SHA-256.
Ce rămâne
Dovezi de referință
Discursul uman, multiple accente și limbi, captarea live de microfon, controlul ordinii termice, observarea rețelei, mai multe dispozitive și sisteme terțe sunt încă necesare.
03 · Excluderi explicite
Ce nu arată acest pilot.
Performanță comparativă față de orice alt produs.
Performanța în ceea ce privește vorbirea umană, accentele sau vorbirea multilingvă.
Microfon live, reducere a zgomotului, prag de tăcere, primul cuvânt sau comportament la sfârșitul frazei.
Performanță la rece versus cald sub un protocol termic controlat.
Comportament offline sau de confidențialitate stabilit prin observarea rețelei.
O afirmație generală că o configurație brută sau curățată este mai bună.
Corpusul, matricea dispozitivului, ordinea și procedura termică nu au fost preregistrate. Aceste observații descriu aceste rulări secvențiale, pe acest corpus, dispozitiv, versiune de software și dată.