> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# FishAudioTextToSpeech - ComfyUI Built-in Node Documentation

> 이 노드는 Fish Audio 텍스트 음성 변환 모델을 사용하여 작성된 텍스트를 음성 오디오로 변환합니다. 텍스트에 포함된 감정 큐([happy], [whispering]는 s2.1-pro, (happy)는 s1)와 여러 음성이 연결된 경우 @Voice1/@Voice2 태그를 사용하는 다중 화자 대화를 지원합니다. 사용

이 노드는 Fish Audio 텍스트 음성 변환 모델을 사용하여 작성된 텍스트를 음성 오디오로 변환합니다. 텍스트에 포함된 감정 큐(\[happy], \[whispering]는 s2.1-pro, (happy)는 s1)와 여러 음성이 연결된 경우 @Voice1/@Voice2 태그를 사용하는 다중 화자 대화를 지원합니다. 사용 가능한 모델은 두 가지입니다. 최대 5개의 음성과 다중 화자 대화를 지원하는 s2.1-pro와 단일 선택적 음성을 사용하는 s1입니다.

## 입력

### 공통 입력

| 매개변수    | 설명                                                                                  | 데이터 타입         | 필수 | 범위                   |
| ------- | ----------------------------------------------------------------------------------- | -------------- | -- | -------------------- |
| `text`  | 음성으로 변환할 텍스트입니다. 두 개 이상의 음성이 연결된 경우 @Voice1, @Voice2 등으로 화자 변경을 표시합니다. (기본값: 비어 있음) | STRING         | 예  | 비어 있지 않은 모든 텍스트      |
| `model` | 텍스트 음성 변환에 사용할 모델입니다.                                                               | DYNAMIC\_COMBO | 예  | "s2.1-pro"<br />"s1" |
| `seed`  | 노드를 다시 실행할지 여부를 제어하는 시드입니다. 시드와 관계없이 결과는 비결정적입니다. (기본값: 42)                         | INT            | 예  | 0 \~ 2147483647      |

### s2.1-pro 입력

이 입력은 s2.1-pro 모델을 선택했을 때 표시됩니다.

| 매개변수          | 설명                                                                                                                                                       | 데이터 타입           | 필수  | 범위            |
| ------------- | -------------------------------------------------------------------------------------------------------------------------------------------------------- | ---------------- | --- | ------------- |
| `voices`      | 확장 가능한 슬롯: 0\~5개의 음성 항목(`voice_1`, `voice_2`, ...)을 연결합니다. 합성을 위한 음성입니다. 기본 음성을 사용하려면 비워 둡니다. 두 개 이상의 음성이 있는 경우 텍스트에서 @Voice1, @Voice2 등으로 화자 변경을 표시합니다. | FISHAUDIO\_VOICE | 아니요 | 0 \~ 5개 음성    |
| `temperature` | 표현력입니다. 값이 높을수록 더 다양하고, 낮을수록 더 일관됩니다. (기본값: 0.7)                                                                                                         | FLOAT            | 예   | 0.0 \~ 1.0    |
| `top_p`       | 뉴클리어스 샘플링을 통한 다양성입니다. (기본값: 0.7)                                                                                                                         | FLOAT            | 예   | 0.01 \~ 1.0   |
| `speed`       | 말하기 속도입니다. 1.0은 보통, \<1.0은 느림, >1.0은 빠름입니다. (기본값: 1.0)                                                                                                   | FLOAT            | 예   | 0.5 \~ 2.0    |
| `volume`      | 데시벨 단위의 볼륨 조정입니다. 0은 변경 없음입니다. (기본값: 0.0)                                                                                                                | FLOAT            | 예   | -10.0 \~ 10.0 |
| `normalize`   | 영어와 중국어의 숫자 및 텍스트를 정규화하여 숫자와 날짜의 안정성을 향상합니다. (기본값: true)                                                                                                 | BOOLEAN          | 예   | true / false  |

### s1 입력

이 입력은 s1 모델을 선택했을 때 표시됩니다.

| 매개변수          | 설명                                                       | 데이터 타입           | 필수  | 범위            |
| ------------- | -------------------------------------------------------- | ---------------- | --- | ------------- |
| `voice`       | 합성을 위한 음성입니다. 기본 음성을 사용하려면 연결하지 않은 상태로 둡니다.              | FISHAUDIO\_VOICE | 아니요 | 선택적 단일 음성     |
| `temperature` | 표현력입니다. 값이 높을수록 더 다양하고, 낮을수록 더 일관됩니다. (기본값: 0.7)         | FLOAT            | 예   | 0.0 \~ 1.0    |
| `top_p`       | 뉴클리어스 샘플링을 통한 다양성입니다. (기본값: 0.7)                         | FLOAT            | 예   | 0.01 \~ 1.0   |
| `speed`       | 말하기 속도입니다. 1.0은 보통, \<1.0은 느림, >1.0은 빠름입니다. (기본값: 1.0)   | FLOAT            | 예   | 0.5 \~ 2.0    |
| `volume`      | 데시벨 단위의 볼륨 조정입니다. 0은 변경 없음입니다. (기본값: 0.0)                | FLOAT            | 예   | -10.0 \~ 10.0 |
| `normalize`   | 영어와 중국어의 숫자 및 텍스트를 정규화하여 숫자와 날짜의 안정성을 향상합니다. (기본값: true) | BOOLEAN          | 예   | true / false  |

**참고:** `text` 입력은 비어 있으면 안 됩니다. 화자 태그(@Voice1, @Voice2 등)는 대소문자를 구분하지 않으며 연결된 음성을 참조해야 합니다. 연결되지 않은 음성에 태그를 지정하면 오류가 발생합니다. 두 개 이상의 음성이 연결된 경우 텍스트는 연결된 모든 음성을 최소 한 번씩 참조해야 하며, 그렇지 않으면 노드가 누락된 태그를 보고합니다. s2.1-pro에서는 음성을 0개 연결하면 기본 음성을 사용하고, 1개 연결하면 해당 음성만 사용하며, 2개 이상 연결하면 다중 화자 대화를 활성화합니다. s1에서는 선택적 단일 음성을 사용하며 연결하지 않으면 기본 음성을 사용합니다. 감정 큐는 텍스트에 배치할 수 있습니다: s2.1-pro에서는 \[happy] 및 \[whispering], s1에서는 (happy)입니다.

## 출력

| 출력 이름   | 설명                     | 데이터 타입 |
| ------- | ---------------------- | ------ |
| `audio` | 생성된 음성을 오디오 파일로 제공합니다. | AUDIO  |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/FishAudioTextToSpeech/ko.md)

***

**Source fingerprint (SHA-256):** `6cc005ae76fc7b60d9399b1b0a3c5de40a6eff47cd6f0f0b73b4212c0270ae29`
