콘텐츠로 건너뛰기
무료 도구Yaps 작성

31에서 텍스트 음성 변환 languages.

4가지 음성, 31개 언어, 한 번 다운로드하면 탭 내에서 실행되는 하나의 모델입니다. 텍스트를 붙여넣거나 문서를 놓습니다. 로드할 곳이 없기 때문에 로드한 항목이 업로드되지 않습니다.

귀하의 컴퓨터에서 실행됩니다. · Yaps 앱이 사용하는 것과 동일한 엔진

목소리 시작

음성모든 목소리는 모든 언어를 읽습니다.
31 언어, 하나의 모델
120 / 600

읽을 문서를 드롭하세요

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX — 이 기기에서 처리됨

음성은 BigScience Open RAIL-M 라이선스에 따라 Supertonic 3, © Supertone Inc.에서 생성됩니다. 상업적인 사용은 허용하지만 동의 없이 실제 사람을 가장하는 등 귀하가 생성한 내용의 일부 사용을 제한합니다. 약관 보기.

이 도구 정보

브라우저 내 텍스트 음성 변환이 실제로 의미하는 것

대부분의 텍스트 음성 변환 사이트는 형식입니다.입력하면 단어가 서버로 이동하고, 그곳의 모델이 오디오를 만들고, 파일이 다시 돌아옵니다.브라우저 내 텍스트 음성 변환은 중간 단계를 제거합니다.대신 모델이 한 번만 전송되고 브라우저가 이를 실행합니다.

이 페이지는 Yaps 데스크톱 앱과 동일한 음성 엔진인 Supertonic 3을 사용합니다. 약 145MB이며 페이지를 처음 열 때 일반 다운로드로 도착합니다. 브라우저가 이를 캐시합니다. 그 이후의 모든 클립은 자체 프로세서에서 만들어지므로 대기열, 크레딧 카운터, 계정이 없습니다.

브라우저가 말할 수 있는 몇 가지 방법이 있으며 서로 동일하지 않습니다. 내장된 Web Speech API는 운영 체제에 있는 모든 음성을 차용하므로 동일한 페이지가 Mac과 기존 Android 휴대폰에서 다르게 들립니다. 클라우드 API는 일관되게 들리지만 붙여넣은 모든 내용을 읽습니다. 작은 로컬 모델이 둘 사이에 위치합니다. 모든 곳에 하나의 음성이 있고 텍스트는 그대로 유지됩니다.

개인 텍스트 음성 변환: 업로드 없음, 가입 없음, API 키 없음

상자에 붙여 넣거나 문서에서 로드하는 것은 아무것도 컴퓨터에서 떠나지 않습니다. 그것은 믿음을 가져야 하는 약속이 아니라 페이지가 만들어지는 방식입니다. 텍스트 수신을 기다리는 엔드포인트가 없습니다.

약 10초 안에 확인하실 수 있습니다. 음성이 다운로드되면 Wi-Fi를 끄고 어쨌든 클립을 생성하세요. 당신의 텍스트가 아무데도 가지 않았기 때문에 그것은 여전히 ​​​​말합니다. 더 나은 방법은 모델이 캐시된 후에 연결을 끄는 것입니다. 도구가 계속 말합니다.

동일한 구조가 일반적인 마찰을 제거합니다. 스크립트를 테스트하는 동안 계정, 이메일 주소, API 키, 무료 등급이 적용되지 않습니다. 우리는 단어당 추론 비용을 지불하지 않으므로 측정할 것이 없습니다.

텍스트가 귀하의 것이 아닐 때 가장 중요합니다. NDA, 클리닉 스크립트, 내부 교육 자료, 미발표 제품명, 원고의 한 장을 복사합니다. 사람들이 어디에 도착할지 생각하지 않고 무료 도구에 붙여넣는 것들이 바로 그것입니다.

하나의 모델에서 31개 언어로 텍스트 음성 변환

언어를 선택하고 네 가지 음성 중 하나를 선택하면 읽혀집니다. 스페인어, 독일어, 이탈리아어, 폴란드어, 네덜란드어, 터키어, 한국어, 일본어, 아랍어, 힌디어, 베트남어 외 20개 이상, 모두 동일한 145MB 파일에 있습니다.

이렇게 작은 모델에서는 흔치 않은 일입니다. 대부분의 로컬 엔진에는 철자를 발음으로 바꾸는 별도의 구성 요소인 각 언어에 대한 음소 변환기가 필요하므로 모든 새로운 언어는 또 다른 사전을 배송하는 것을 의미합니다. 이것이 다른 브라우저 내 도구가 영어로만 제공되거나 영어에 몇 가지 추가 기능이 추가된 이유입니다. Supertonic은 철자를 직접 사용하여 발음을 계산하므로 하나의 가중치 세트가 많은 부분을 포괄합니다.

전체 목록: 영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어, 폴란드어, 러시아어, 우크라이나어, 체코어, 슬로바키아어, 슬로베니아어, 크로아티아어, 불가리아어, 루마니아어, 헝가리어, 그리스어, 스웨덴어, 덴마크어, 핀란드어, 에스토니아어, 라트비아어, 리투아니아어, 터키어, 아랍어, 힌디어, 인도네시아어, 베트남어, 한국어, 일본어.

품질은 31개 언어 모두에서 동일하지 않습니다. 영어와 더 큰 유럽 언어가 가장 강력합니다. 읽기는 텍스트에 따라 달라지므로 텍스트와 일치하도록 언어 선택기를 설정하세요.

브라우저에서 텍스트를 WAV 파일로 변환하는 방법

1. 텍스트를 붙여넣거나 입력하거나 PDF, EPUB, TXT, Markdown, HTML, RTF 또는 DOCX 파일을 리더에 놓습니다. 가져온 문서는 장치에서 구문 분석됩니다. 한 회당 600자로 제한되며 이는 대략 짧은 문단 또는 20초 분량의 연설입니다.

2. 텍스트의 언어를 선택하세요. 이는 철자를 읽는 방식을 변경하므로 보이는 것보다 더 중요합니다.

3. 음성을 선택하세요. 여기에는 Nora, Luna, Watson 및 Keld의 네 가지가 있습니다. 네 명 모두 31개 언어를 모두 읽었습니다.

4. 발언 버튼을 누르세요. 처음 방문하면 145MB 엔진이 먼저 다운로드되고 진행률 표시줄이 표시됩니다. 그 후에는 기다리지 않습니다.

5. 다운로드를 눌러 WAV 파일을 44.1kHz로 저장합니다.

생성은 실시간보다 빠르게 진행되며, 전체 구절을 기다리지 않고 첫 번째 문장부터 재생이 시작되므로 거의 즉시 음성을 들을 수 있습니다. 다른 테이크를 원할 경우 텍스트를 편집하고 다시 실행하세요. 실행 사이에는 아무 것도 저장되지 않으며 다른 사람의 작업 뒤에 대기하는 것도 없습니다.

첫 번째 다운로드 후 오프라인 텍스트 음성 변환

모델이 브라우저 캐시에 있으면 도구에 더 이상 인터넷이 필요하지 않습니다. 페이지를 로드하고 터널이나 비행기로 이동해도 여전히 오디오가 생성됩니다. 이는 우리가 추가한 기능이 아니라 로컬로 실행하는 데 따른 부작용입니다.

비용은 145MB 다운로드에 대한 비용입니다. 1분 미만의 괜찮은 연결 상태에서; 테더링된 모바일 데이터에서는 더 나은 데이터를 기다릴 가치가 있습니다. 브라우저는 캐시를 보관할 기간을 결정하므로 사이트 데이터를 지우면 다시 가져옵니다.

WebAssembly에서 실행되므로 그래픽 카드가 필요하지 않으며 확장이나 설치가 필요하지 않습니다. Chrome, Edge, Firefox 및 Safari의 최신 버전은 모두 데스크톱과 휴대폰에서 작동합니다. 145MB 모델은 말하는 동안 메모리에 앉아 있어야 하기 때문에 구형이거나 메모리가 부족한 휴대폰은 속도가 느려집니다.

텍스트를 업로드하는 텍스트 음성 변환 사이트와 비교하는 방법

주류 무료 사이트는 수백 가지 음성과 수백 가지 언어를 광고합니다. 데이터 센터가 작업을 수행하고 있기 때문에 가능합니다. 거래는 일반적으로 가입, 일일 단어 대문자, 워터마크 또는 바쁜 시간의 대기열, 그리고 나중에 텍스트에 어떤 일이 발생하는지 알아내기 위해 읽어야 하는 개인 정보 보호 정책과 함께 스크립트가 그들에게 전송된다는 것입니다.

이 페이지는 반대 모양입니다. 4개의 목소리, 한 번에 600자, 그리고 첫 방문에 대한 기다림. 교환: 계정도 없고, 실행 횟수에 대한 제한도 없고, 어디든 단어를 보내는 것도 없으며, 연결이 꺼진 상태에서도 계속 작동합니다.

다른 로컬 브라우저 내 도구에 비해 비교가 더 직접적입니다. 대부분은 Kokoro를 실행합니다. Kokoro는 더 큰 다운로드이며 브라우저 형식에서는 일반적으로 영어로만 제공됩니다. Supertonic은 크기가 대략 절반이며 동일한 가중치에서 31개 언어를 읽습니다.

상업적 사용을 위한 무료 텍스트 음성 변환 및 라이센스에서 요구하는 내용

오디오를 상업적으로 사용할 수 있습니다. Yaps에 대한 저작자 표시 요구 사항이 없고, 파일에 워터마크가 없으며, 별도 구매 라이선스가 없습니다.

모델 가중치는 BigScience Open RAIL M 라이센스에 따라 공개됩니다. 이 라이센스는 상업적 사용을 허용하지만 출력에 대한 조건을 첨부합니다. 중요한 것은 동의 없이 특정 실제 인물을 모방하는 데 사용하지 말고, 합성 음성을 누군가의 진짜 녹음인 것처럼 위장하지 말고, 사람을 속이거나 괴롭히거나 해를 끼칠 수 있는 콘텐츠를 생성하는 데 사용하지 마세요. 이러한 제한 사항은 오디오와 함께 전달되므로 파일을 전달하는 모든 사람에게 적용됩니다.

전체 텍스트는 당사 약관에서 링크되어 있으며, 읽을 수 있을 만큼 짧습니다. 내레이션, 설명자, 데모 비디오, 기사의 오디오 버전 또는 제품에 대한 음성 안내를 제작하는 경우 이 중 어느 것도 방해가 되지 않습니다.

이 도구가 수행할 수 없는 작업과 Yaps 앱이 추가하는 작업

정확하게 말하면 이 페이지는 로컬 PDF, EPUB, TXT, Markdown, HTML, RTF 또는 DOCX 파일에서 입력하거나 붙여넣거나 가져온 텍스트를 읽습니다. 귀하가 보고 있는 기사, 이메일, 다른 창에 있는 문서 또는 화면의 다른 위치에 있는 선택 항목에는 도달하지 않습니다. 웹페이지가 그러한 것들에 접근할 수 있는 방법은 없으며, 우리는 그럴 수 있는 것을 원하지 않을 것입니다.

Yaps 데스크톱 앱이 변경되는 곳입니다. Mac, Windows 또는 Linux 시스템 어디에서나 텍스트를 강조표시하고 단축키를 누르면 동일한 음성으로 큰 소리로 읽혀집니다. 4개가 아닌 10개의 음성 스타일 전체 세트를 제공하고, 600자 제한이 없으며, 한 번에 한 단락씩 읽는 긴 형식을 처리하고, 음성 복제를 통해 표현 엔진을 추가합니다. 기기에서도 실행되므로 개인 정보 보호 정책은 동일합니다.

짧은 클립과 WAV 파일만 필요한 경우 여기에 머무르세요. 무료이며 평가판이 아닙니다.

브라우저에서 텍스트 음성 변환을 사용하는 방법

  1. 파일 입력, 붙여넣기, 놓기

    최대 600자를 입력하거나 붙여넣거나 PDF, EPUB, TXT, Markdown, HTML, RTF 또는 DOCX 파일을 드롭하세요. 가져온 텍스트는 기기에 그대로 유지됩니다.

  2. 언어를 설정하세요

    사용 가능한 31개 언어 중에서 텍스트가 작성된 언어를 선택하세요. 이는 철자가 발음으로 바뀌는 방식을 변경하므로 보이는 것보다 결과에 더 많은 영향을 미칩니다.

  3. 음성 선택

    Nora, Luna, Watson 또는 Keld를 선택하세요. 네 가지 모두 지원되는 모든 언어를 읽습니다.

  4. 음성 생성

    말하기 버튼을 누르세요. 처음 방문하면 145MB 음성 엔진이 다운로드되고 캐시됩니다. 그 이후에는 생성이 바로 시작되고 첫 번째 문장에서 재생이 시작됩니다.

  5. WAV 다운로드

    다운로드를 눌러 오디오를 44.1kHz WAV 파일로 저장하세요. 워터마크가 없으며, 모델 라이센스 조건에 따라 상업적으로 이용이 가능합니다.

질문

내 텍스트가 어디에나 업로드되나요?

아니요. 음성 모델은 귀하의 브라우저에 다운로드되고 오디오는 귀하의 컴퓨터에서 생성됩니다. 텍스트를 보낼 합성 서버가 없습니다. 음성이 캐시된 후 인터넷 연결을 끊고 클립을 생성하면 이를 확인할 수 있습니다.

계정이나 API 키가 필요합니까?

아니요. 가입도, 이메일 주소도, API 키도, 크레딧 잔액도 없습니다. 합성이 귀하의 장치에서 실행되기 때문에 복구하는 데 단어당 비용이 들지 않으므로 게이트할 것이 없습니다.

브라우저 내 텍스트 음성 변환이 오프라인에서 작동하나요?

네, 첫 방문 이후에요. 145MB 음성 엔진을 한 번 다운로드하면 브라우저가 이를 캐시합니다. 그때부터 페이지는 전혀 연결되지 않은 오디오를 생성합니다. 사이트 데이터를 지우면 모델이 다시 다운로드됩니다.

첫 번째 로드가 145MB 다운로드인 이유는 무엇입니까?

서버에 머물지 않고 모델 자체가 찾아오기 때문이죠. 145MB는 다국어 음성 모델치고는 작은 용량이고 일회성이다. 대부분의 브라우저 내 대안은 더 큰 다운로드이며 일반적으로 브라우저에서 영어로만 제공되는 Kokoro를 실행합니다.

어떤 언어가 지원되나요?

31: 영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어, 폴란드어, 러시아어, 우크라이나어, 체코어, 슬로바키아어, 슬로베니아어, 크로아티아어, 불가리아어, 루마니아어, 헝가리어, 그리스어, 스웨덴어, 덴마크어, 핀란드어, 에스토니아어, 라트비아어, 리투아니아어, 터키어, 아랍어, 힌디어, 인도네시아어, 베트남어, 한국어 및 일본어. 그들 모두는 동일한 모델과 네 가지 음색 중 하나를 사용합니다.

어떤 파일 형식을 얻을 수 있나요?

44.1kHz의 WAV 파일입니다. 더 작은 파일이 필요한 경우 편집기에서 MP3로 변환할 수 있습니다. 오디오에는 워터마크나 브랜딩이 없습니다.

왜 600자 제한이 있나요?

품질과 인내심을 위해. 모델은 짧은 구간에서 더 안정적이며, 긴 단일 실행에서는 작동하는 동안 피드백을 제공하지 않습니다. 긴 형식의 읽기가 필요한 경우 Yaps 데스크톱 앱은 한도 없이 한 번에 한 단락씩 처리합니다.

오디오를 상업적으로 사용할 수 있나요?

그렇습니다. 모델 가중치는 BigScience Open RAIL M 라이센스를 사용하여 출력에 제한을 두고 상업적 사용을 허용합니다. 즉, 동의 없이 특정 실제 인물을 모방하지 않고, 생성된 음성을 실제 녹음으로 전달하지 않으며, 기만적이거나 유해한 사용을 하지 않습니다. 전체 약관은 약관 페이지에 링크되어 있습니다.

어떤 브라우저에서 작동하나요?

데스크톱 및 휴대폰에서 사용 가능한 Chrome, Edge, Firefox 및 Safari의 최신 버전입니다. WebAssembly에서 실행되므로 그래픽 카드나 확장이 필요하지 않습니다. 구형이거나 메모리가 부족한 휴대폰은 모델이 메모리에 남아 있어야 하기 때문에 생성 속도가 더 느려집니다.

웹 페이지, PDF 또는 문서를 읽을 수 있나요?

로컬 PDF, EPUB, TXT, Markdown, HTML, RTF 또는 DOCX 파일을 삭제할 수 있으며 페이지는 해당 텍스트를 장치에서 추출합니다. 다른 응용 프로그램에서 열려 있는 웹 페이지, 이메일 또는 문서에 접근할 수 없습니다. Yaps 데스크톱 앱은 키보드 단축키를 사용하여 모든 애플리케이션에서 강조 표시된 텍스트를 읽습니다.

Yaps 앱과 동일한 음성인가요?

동일한 엔진과 동일한 무게. 이 페이지는 4가지 음성 스타일을 제공하며, 앱은 10가지를 제공하고 문자 제한을 제거하며 음성 복제를 통해 표현 엔진을 추가합니다.

Kokoro 기반 브라우저 TTS 도구와 어떻게 비교됩니까?

둘 다 브라우저에서 로컬로 실행되므로 개인 정보 보호 위치는 동일합니다. 차이점은 적용 범위와 크기입니다. Supertonic 3은 대략 145MB에서 31개 언어를 읽습니다. Kokoro의 브라우저 빌드는 언어별로 발음 사전이 필요하기 때문에 일반적으로 더 큰 다운로드와 영어로만 제공됩니다.

짖어대기 시작해맥 · 윈도우 · 리눅스 · 안드로이드

읽기 anything, 이 상자뿐만이 아닙니다.

하나의 단축키로 모든 앱에서 텍스트를 강조표시하고 들을 수 있습니다.

Mac용 다운로드

macOS 13.0 이상 필요(Apple Silicon 권장)iOS는 곧 출시 예정