Hoppa till innehållet

Status för privat diktering · 2026

Mät vad diktering utelämnar.

Noggrannhet, raderingar, latens och observerbart nätverksbeteende över talverktyg på enheten.Vi publicerar metoden, gränserna och de sanerade uppgifterna bredvid siffrorna.

01 · Pilotresultat

De första siffrorna, i full vy.

Med lokal rensning aktiverad registrerade piloten en medianbearbetningstid på 1 124 ms och 3,46 % ordfelfrekvens. Samma 20 rena syntetiska fixturer avkodades tre gånger per körfält på en M1 Max MacBook Pro med Yaps 2.3.2129. Lägre fel- och latensvärden är bättre inom denna exakta inställning. Dessa är Yaps konfigurationer, inte konkurrerande produkter.

Armaturer
20
Kör per körfält
60
Ord, med upprepningar
1,473
Talets ursprung
Syntetisk
Testenhet
1
Felaggregering
Mikro
Rensning på60 körs

Core ML Parakeet + lokal rensning

Mikro WER
3.46%
Raderingshastighet
0.41%
Medianbearbetning
1,124 ms
p95-bearbetning
2,807 ms
Maximal bearbetning
2,958 ms
Rengöring av60 körs

Core ML Parakeet, städning av

Mikro WER
3.67%
Raderingshastighet
0.20%
Medianbearbetning
250 ms
p95-bearbetning
722 ms
Maximal bearbetning
1,863 ms
Rengöring av60 körs

Whisper Base, städning av

Mikro WER
6.52%
Raderingshastighet
0.41%
Medianbearbetning
844 ms
p95-bearbetning
1,669 ms
Maximal bearbetning
2,189 ms

Behandlingstiden inkluderar igenkänning, slutförande av pipeline och lokal rensning när aktiverat. Det utesluter initial runtime-konstruktion, fixturladdning, liveinspelning, genvägsutskick och markörinsättning. Alla banor ger slutliga utvärderingsresultat; Rensningsbanor kan fortfarande tillämpa ordförråd och formateringsändringar.

Latensen använder 60 lika viktade avkodningsprov per körfält och R-7 linjära kvantiler. De 20 matcherna innehåller 491 referensordspositioner per pass, räknade tre gånger i nämnaren på 1 473 ord. Upprepningar är inte självständiga yttranden. Kvalitetströskelfel förblir inkluderade: 3 med Core ML rensning på, 3 med Core ML rensning av och 6 med Whisper.

Tolkning korrigerad 6 september 2026. Originalnummer är oförändrade. Läs bevisgranskningen, externa referenser, återstående begränsningar och reproduktionsinstruktioner.

Vad denna pilot stöder

En matchad observation för upprensning.

I dessa körningar hade Whisper Base med rensning av 2,85 procentenheter högre WER poäng, 0,20 m högre raderingsfrekvens och 9,20 m, 5 media 947 ms högre p95 än Core ML Parakeet med rengöring av.

Vad det inte kan stödja

En allmän produkt eller sekretessanspråk.

Piloten utesluter mänskligt tal, accenter, flerspråkigt tal, direkt mikrofonupptagning, kontrollerad termisk ordning, nätverksobservation, ytterligare enheter och tredjepartsprodukter.

02 · Produktlager

En modell är inte en dikteringsupplevelse.

Varför Yaps hör hemma i rapporten

Att ladda ner modellvikter är den enkla delen. Ett användbart dikteringssystem måste kunna fånga ljud pålitligt, välja rätt körmiljö, förbereda tal för den modellen, upptäcka ofullständig output, bevara användarens avsikt och placera resultatet där användaren arbetar.

Yaps omvandlar kapabla lokala talmodeller till ett enda privat verktyg som människor kan använda i sina vardagliga appar, utan att själva behöva sätta ihop modellservrar, skript, ljudpipelines eller exportsteg.
01

Fånga

En genväg eller ett mobilt tangentbord startar en privat inspelning utan att flytta användaren till ett separat transkriptionsverktyg.

02

Förbereda

Yaps tillämpar taligenkänning, hantering av tystnad och ljudförberedelse i enhetens form innan igenkänning.

03

Rutt

Appen väljer en installerad lokal motor för enheten, språk, kvalitetsinställning och tillgänglig hårdvara.

04

Känna igen

Parakeet, Cohere, Whisper eller en specialistrutt omvandlar det förberedda ljudet till kandidattext.

05

Vakt

Fullständighetskontroller, räddningsvägar, ordförrådshantering och lokal rensning skyddar det levererade resultatet.

06

Leverera

Den färdiga texten fastställs vid markören eller i mobilens tangentbordsflöde, redo att användas omedelbart.

Denna produktkontext förklarar varför rapporten särskiljer rensningsinställningar och det uppmätta slutsteget. Det är inte bevis för att Yaps är bäst, och det gör inte produktpositionering till ett benchmarkresultat.

03 · Vidare bevis

Forskningsprogrammet är redan större än en pilot.

Dessa kompletterande studier använde olika enheter, korpusar, måttstockar och testprotokoll. Deras siffror förklarar nuvarande produktbeslut, men de får inte kombineras till en enda topplista.

Apple Silicon · flerspråkigRelaterad studie

Cohere ändrar routingkonversationen.

En bredare M1 Max bake-off använde 144 syntetiska klipp på 24 språk och 65 mänskliga FLEURS-klipp på 13 språk.På den matchade mänskliga delmängden med 20 klipp som delas av Cohere och varje modell, registrerade Cohere 4,2 % granskad WER mot 12,0 % för MLX Parakeet.

Cohere WER
4.2%
MLX Parakeet
12.0%
Matchade mänskliga klipp
20
Cohere stöder en smalare språkuppsättning och kräver ett förväntat språk.Fem klipp per språk förblir vägledande bevis, inte ett universellt kvalitetspåstående.
Windows 11 · CohereRelaterad studie

Högre flerspråkig pålitlighet, med en latenskostnad.

På en Ryzen 7 5700U Windows-laptop körde Cohere och ONNX Parakeet samma 70 mänskliga FLEURS-klipp på 14 språk. Cohere returnerade 70 icke-tomma transkript; Parakeet returnerade 61. Cohere vann 12 av 14 automatiska språkjämförelser, men genomsnittade 3,654 sekunder per klipp jämfört med 1,394 sekunder för Parakeet.

Cohere icke-tom
70/70
Parakeet icke-tomt
61/70
Cohere betyder
3,654 s
Språkbetygen förblir vägledande tills varje icke-noll skillnad har fått fullständig manuell prövning. De rensade raderna är ännu inte en del av denna offentliga version.
Android · Arabiska förhandsvisningRelaterad studie

Enhetens hastighet kan passera medan korpustäckningen fortfarande misslyckas.

Ett arabiskt FastConformer-paket körde på en Pixel 10 Pro. Exklusive ett ogiltigt referenspar producerade 39 FLEURS klipp 9,8 % WER och 4,1 % CER, med en median på 624 ms och 984 ms p95. En bredare ren och bullrig MASC skiva på Mac CPU fick senare 22,5 % WER, så rutten förblir Preview snarare än att bli ett allmänt arabiskt påstående.

Giltiga klipp
39
Medianavkodning
624 ms
p95 avkoda
984 ms
Telefonresultatet täcker inläst tal, inte spontant MSA och dialaktanvändning. Det bredare MASC-resultatet är anledningen till att appen behåller rutten uttryckligen märkt som Förhandsgranskning.
04 · Plattformstäckning

Visa luckorna istället för att dölja dem.

macOS · Apple Silicon

Publicerad pilot

Aktuella bevisDen nuvarande pilotstudien med 20-fixturer, plus en separat 144-syntetisk och 65-mänsklig flerspråkig modelljämförelse.

Nästa bevisgateLägg till spontant tal, fler Mac-generationer, kontrollerad termisk ordning och levande mikrofonfångst.

Windows · x64

Relaterad bevisning

Aktuella bevisEn separat 70-klipp, 14-språkig mänsklig FLEURS-validering jämförde Cohere och ONNX Parakeet på Windows 11.

Nästa bevisgatePublicera rensade rader under det frusna protokollet och lägg till klasser för lägre minnesanvändning och ytterligare GPU:er.

Android · ARM64

Relaterad bevisning

Aktuella bevisEn Pixel 10 Pro-utvärdering mätte ett arabiskt FastConformer-paket och utövade den verkliga tangentbordsbanan.

Nästa bevisgateLägg till spontant dialekttal, fler telefonnivåer, engelsk ruttparitet, batteri och mätningar för ihållande användning.

Linux · x64

Forskningslucka

Aktuella bevisYaps finns tillgängligt på Linux, men denna rapport innehåller ingen rapportklassad körning av native Linux-precision eller latens.

Nästa bevisgateKör inhemsk Ubuntu-testuppspelning, installerat-paket diktamen, CPU och Vulkan-vägar, X11 och Wayland.

iOS · ARM64

Forskningslucka

Aktuella bevisYaps finns tillgängligt på iOS, men denna rapport inkluderar ännu inte ett benchmark för iPhone-enheter.

Nästa bevisgateMät det verkliga tangentbordsförlängningen, modellinläsning, minnesbelastning, energianvändning och end-to-end-latens vid commit.

05 · Forskningsfråga

En flytande transkription kan fortfarande vara fel.

01

Noggrannhet

Hur många referensord ersätts, infogas eller tas bort efter deterministisk normalisering?

02

Tyst borttagning

Förlorar en utskrift hela ord eller fraser samtidigt som den låter tillräckligt flytande för att undvika en snabb recension?

03

Responsivitet

Hur lång tid tar bearbetningen över en distribution, inte bara i det snabbaste enskilda körningen?

04

Nätverksbeteende

Vilka anslutningar och paketobserverade data ses under ett definierat arbetsflöde, med gränserna för paketobservation tydligt angivna?

06 · Publikationsdesign

Bevis som du kan spåra tillbaka till dess källa.

Piloten särskiljer semantiska rensningsinställningar, poängsätter slutlig utvärderare, rapporterar ersättningar, infogningar och borttagningar oberoende och håller privat talinnehåll utanför den offentliga versionen. Jämförbara system tar emot samma ljudbyte där deras gränssnitt tillåter det; inkompatibla fångstvägar hör hemma i tydligt separerade skikt.

01Fryst offentligt eller godkänt korpus
02Deklarerat system, modell och enhet
03Upprepade körningar med misslyckanden som bevaras
04Word-nivå S/I/D-inriktning
05Innehållsfria offentliga rader och aggregat
· Läs posten 07

Inspektera metoden och varje offentlig rad.

Status för privat diktering 2026Metodversion 0.1.0Endast pilotbevisDesignad och publicerad av Yaps