Notice
Recent Posts
Recent Comments
Link
일 | 월 | 화 | 수 | 목 | 금 | 토 |
---|---|---|---|---|---|---|
1 | 2 | 3 | 4 | 5 | 6 | 7 |
8 | 9 | 10 | 11 | 12 | 13 | 14 |
15 | 16 | 17 | 18 | 19 | 20 | 21 |
22 | 23 | 24 | 25 | 26 | 27 | 28 |
29 | 30 | 31 |
Tags
- 서보모터
- 이미지 편집
- 오픈AI
- OpenAI
- 딥마인드
- 뉴럴링크
- ubuntu
- ChatGPT
- 우분투
- 생성형 AI
- ControlNet
- 트랜스포머
- 멀티모달
- javascript
- 인공지능
- PYTHON
- LORA
- LLM
- 티스토리챌린지
- 아두이노
- 시간적 일관성
- 오블완
- tts
- AI
- 메타
- 일론 머스크
- TRANSFORMER
- 확산 모델
- 가상환경
- AI 기술
Archives
- Today
- Total
목록fish-audio (1)
AI 탐구노트
Fish-Speech : 다국어를 지원하는 TTS 모델
FishAudio라는 업체에서 개발한 다국어를 지원하는 텍스트 음성변환(TTS) 모델입니다. 최신 버전인 Fish Speech V1.4의 경우, 다국어로 구성된 70만 시간 분량의 오디오 데이터를 사용해 훈련되었으며 초저지연 실시간 음성합성(TTS)과 음성 복제 기능을 제공합니다. 70만 시간 가운데 30만 시간이 영어, 중국어라고 하며 한국어는 2만 시간 정도가 포함되어 있다고 합니다. 미세조정에는 8GB, 추론에는 4GB 수준의 VRAM만 있으면 된다고 하는데, 4GB면 사양이 좀 낮은 GPU를 가지고도 음성을 만들고 테스트 하는데는 전혀 문제가 없다는 얘기가 됩니다. (CUDA를 사용해 추론 속도를 높이는 경우라고 생각하면 될 듯...) 데모로 공개되어 있는 FishAudio 사이트 에는 이미 만..
AI 기술
2024. 9. 23. 10:33