Ponovljiv korpus
Javna licencirana govorica in soglašene skripte, ki uporabljajo iste avdio bite, kjer je podprto, za ločevanje prepoznavanja in naknadne obdelave.
Metodologija · različica 0.1.0
Protokol v stilu predhodne registracije za enako preglednost ugodnih in neugodnih izidov. Trenutna izdaja je še pilot; ta pravila določajo prehod za prihodnji referenčni standard.
Vsak sistem je nabor: javna različica izdelka, različica operacijskega sistema, revizija motorja ali modela, nastavitve, ki vplivajo na prepoznavanje in čiščenje, razred naprave in pot zajema. Rezultati iz različnih naborov se nikoli tiho ne združujejo.
Če izdelek ne more sprejeti istega zvočnega toka, se to poroča v ločeni plasti. Zajem zvoka z živim mikrofonom ni predstavljen kot neposredno primerljiv z predvajanjem datoteke.
| Platforma | Osnovni razred | Trenutna razred | Namen |
|---|---|---|---|
| macOS | Vnos Apple Silicon | Trenutni Apple Silicon | Lokalni razpon namizja |
| Windows | Glavni tok x86 prenosnik | Trenutni zmogljivostni prenosnik | razlike med CPU in GPU |
| Android | Podprte naprave srednjega razreda | Trenutni paradni model | Mobilna različica |
Javna licencirana govorica in soglašene skripte, ki uporabljajo iste avdio bite, kjer je podprto, za ločevanje prepoznavanja in naknadne obdelave.
Umerjeno predvajanje skozi dokumentirane sobe in mikrofone za razkrivanje vedenja odpravljanja šuma, predhodnega predvajanja, tišinskega vratca in izteka.
Novopristopljeni govorci berejo vnaprej prijavljene pozive. Zajeti zasebni podporni materiali nikoli niso vključeni v javni korpus.
Jezik, regionalne različice, trajanje, hrup, pogoji v prostoru, imena, številke, tehnični izrazi, premori in izgovorjene popravke.
Word stopnja napake se izračuna kot zamenjave plus vstavitve plus črtanja, deljeno z referenčnimi besedami. Študija poroča tudi o vsaki operaciji posebej, ker lahko en sam tekoči prepis skrije manjkajočo frazo.
Združene stopnje so micro-word-weighted: število operacij in referenčne besede se seštejejo, preden se izračuna hitrost. Latenca objavi število vzorcev, srednjo vrednost, p95 in maksimum. Zaključen pilot ima mešano toplotno stanje; nadzorovani hladni in topli testi ter dostava v živo UI ostajajo prihodnja merjenja.
Čas obdelave vključuje prepoznavanje, dokončanje cevovoda in lokalno čiščenje, ko je omogočeno. Izključuje začetno konstrukcijo izvajalnega časa, nalaganje napeljave, snemanje v živo, pošiljanje bližnjic in vstavljanje kazalca. Vse steze točkujejo končni rezultat ocenjevalca; pasovi za čiščenje lahko še vedno uporabljajo spremembe besedišča in oblikovanja.
Latenca uporablja 60 enako uteženih vzorcev dekodiranja po pasu in R-7 linearnih kvantilov. 20 opornikov vsebuje 491 referenčnih besednih mest na prehod, štetih trikrat v imenovalcu 1.473 besed. Ponavljanja niso neodvisni izreki. Neuspehi zaradi mejnih vrednosti kakovosti so še vedno vključeni: 3 s čiščenjem Core ML vklopljenim, 3 s čiščenjem Core ML izklopljenim in 6 s Whisper.
Interpretacija popravljena 6. septembra 2026. Originalne številke ostajajo nespremenjene. Preberite revizijo dokazov, zunanje reference, preostale omejitve in navodila za reprodukcijo.
Protokol beleži, ali potek dela po nastavitvi dokonča delo brez povezave, opažene destinacije in bajte ter ali so bili opaženi avdio ali besedilni prenosi, ki zapuščajo napravo. Zajem paketov ima slepe točke, zato je obrambno trditev: »V tem testu ni bil opažen noben avdio/ besedilni prenos.« Nikoli ne trdite »da nikoli nič ne zapusti.«
Trenutno orodje za testiranje večinoma preizkuša transkriptno cev po zajemu. Ne predvaja v celoti posnetega zvoka skozi živ mikrofon, zato zajemanje s pretiranimi vrhovi, artefakti odstranjevanja šuma, predhodno predvajanje, blokiranje tišine in izpraznitev konca zahtevajo instrumentacijo faze B.
Opazovanje mreže ne more dokazati odsotnosti šifrirane vsebine ali napovedovati prihodnje vedenje. Javni korpus ne more predstavljati vsakega naglasa, invalidnosti, mikrofona, prostora ali spontanega načina govora. Vsak rezultat je povezan z določeno različico in datumom.