Resultados do piloto · interpretação corrigida em 6 de setembro de 2026
Três categorias de teste. Um estudo piloto limitado.
Os mesmos 20 acessórios sintéticos limpos, decodificados três vezes por pista em um M1 Max MacBook Pro usando Yaps 2.3.2129. Core ML Parakeet e Whisper Base são configurações de modelo dentro de Yaps, e não produtos concorrentes.
01 · Registro agregado
Reconhecimento com limpeza local, medido em conjunto.
Piloto de replay de fixture sintético Yaps. Valores mais baixos de WER, taxa de exclusão e latência indicam menos erros ou tempo de processamento mais curto nesta configuração de execução exata;eles não são classificações de produtos.
Yaps on Nick é lançado
Papel
Corre
Palavras, com repetições
Micro WER
Taxa de exclusão
Processamento de mediana
processamento p95
Processamento máximo
Core ML Parakeet + limpeza local
Limpeza em
60
1,473
3.46%
0.41%
1,124 ms
2,807 ms
2,958 ms
Core ML Parakeet, limpeza off
Limpeza desativada
60
1,473
3.67%
0.20%
250 ms
722 ms
1,863 ms
Whisper Base, limpeza de
Limpeza desativada
60
1,473
6.52%
0.41%
844 ms
1,669 ms
2,189 ms
O tempo de processamento inclui reconhecimento, finalização do pipeline e limpeza local quando habilitado. Exclui a construção inicial do tempo de execução, carregamento de fixtures, gravação ao vivo, envio de atalhos e inserção de cursor. Todas as pistas pontuam o resultado final do avaliador; As pistas de limpeza ainda podem aplicar alterações de vocabulário e formatação.
A latência usa 60 amostras de decodificação igualmente ponderadas por pista e quantis lineares R-7. Os 20 equipamentos contêm 491 posições de palavras de referência por passagem, contadas três vezes no denominador de 1.473 palavras. As repetições não são declarações independentes. As falhas no limite de qualidade permanecem incluídas: 3 com Core ML limpeza ativada, 3 com Core ML limpeza desativada e 6 com Whisper.
“Micro” significa que as contagens de operações de edição e palavras de referência foram somadas antes do cálculo de cada taxa. Não é a média macro das porcentagens por clipe.
02 · Leitura limitada
O que essas três linhas podem suportar.
Limpeza desativada
Configurações de limpeza e desativação correspondentes
Whisper Base com limpeza desativada teve 2,85 pontos percentuais maior WER, taxa de exclusão 0,20 pontos maior, uma mediana 595 ms maior e um p95 947 ms maior que Core ML Parakeet com limpeza desativada nestas correspondências o piloto corre.
Faixa habilitada para limpeza
Reconhecimento e limpeza juntos
A via habilitada para limpeza Core ML inclui limpeza semântica local. Sua mediana de 1.124 ms e 2.807 ms p95 descrevem o reconhecimento e a finalização juntos, antes da inserção em outro aplicativo.
O que funcionou
Pipeline de publicação
O sanitizer reteve contagens e latência enquanto exclui transcrições, referências, prompts e contexto do aplicativo. A integridade do arquivo público é registrada com resumos SHA-256.
O que permanece
Evidência de referência
Fala humana, múltiplos sotaques e idiomas, captura de microfone ao vivo, ordem térmica controlada, observação de rede, mais dispositivos e sistemas de terceiros ainda são necessários.
03 · Exclusões explícitas
O que este piloto não mostra.
Desempenho comparativo com qualquer outro produto.
Desempenho na fala humana, sotaques ou fala multilíngue.
Microfone ao vivo, remoção de ruído, porta de silêncio, primeira palavra ou comportamento de descarga traseira.
Desempenho frio versus quente sob um protocolo térmico controlado.
Comportamento offline ou de privacidade estabelecido por meio de observação de rede.
Uma afirmação geral de que uma configuração bruta ou limpa é melhor.
O corpus, a matriz do dispositivo, a ordem e o procedimento térmico não foram pré-registrados. Essas observações descrevem essas execuções sequenciais neste corpus, dispositivo, versão do software e data.