> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# FishAudioTextToSpeech - ComfyUI Built-in Node Documentation

> このノードは、Fish Audio の音声合成モデルを使用して、書かれたテキストを音声に変換します。

このノードは、Fish Audio の音声合成モデルを使用して、書かれたテキストを音声に変換します。テキストに埋め込まれた感情キュー（s2.1-pro では \[happy]、\[whispering]、s1 では (happy)）と、複数の音声が接続されている場合の @Voice1/@Voice2 タグを使用した複数話者ダイアログをサポートします。利用可能なモデルは2つあります。s2.1-pro は最大5つの音声と複数話者ダイアログをサポートし、s1 は単一の任意音声を使用します。

## 入力

### 共通入力

| パラメータ   | 説明                                                                       | データ型           | 必須 | 範囲                   |
| ------- | ------------------------------------------------------------------------ | -------------- | -- | -------------------- |
| `text`  | 音声に変換するテキスト。2つ以上の音声が接続されている場合、話者の切り替えを @Voice1、@Voice2 などで示します。（デフォルト：空） | STRING         | はい | 任意の空でないテキスト          |
| `model` | 音声合成に使用するモデル。                                                            | DYNAMIC\_COMBO | はい | "s2.1-pro"<br />"s1" |
| `seed`  | シードはノードを再実行するかどうかを制御します。シードに関係なく結果は非決定的です。（デフォルト：42）                     | INT            | はい | 0～2147483647         |

### s2.1-pro 入力

これらの入力は、s2.1-pro モデルが選択されている場合に表示されます。

| パラメータ         | 説明                                                                                                                                         | データ型             | 必須  | 範囲           |
| ------------- | ------------------------------------------------------------------------------------------------------------------------------------------ | ---------------- | --- | ------------ |
| `voices`      | 拡張可能スロット：0～5個の音声アイテム（`voice_1`、`voice_2`、...）を接続します。音声合成用の音声です。デフォルト音声を使用する場合は空のままにします。2つ以上の音声がある場合、テキスト内の話者切り替えを @Voice1、@Voice2 などで示します。 | FISHAUDIO\_VOICE | いいえ | 0～5音声        |
| `temperature` | 表現力。値が高いほど変化に富み、低いほど一貫性が高くなります。（デフォルト：0.7）                                                                                                 | FLOAT            | はい  | 0.0～1.0      |
| `top_p`       | ニュークリアスサンプリングによる多様性。（デフォルト：0.7）                                                                                                            | FLOAT            | はい  | 0.01～1.0     |
| `speed`       | 話速。1.0 が標準で、1.0 未満は遅く、1.0 超は速くなります。（デフォルト：1.0）                                                                                             | FLOAT            | はい  | 0.5～2.0      |
| `volume`      | 音量をデシベル単位で調整します。0 は変更なしです。（デフォルト：0.0）                                                                                                      | FLOAT            | はい  | -10.0～10.0   |
| `normalize`   | 英語と中国語の数値およびテキストを正規化し、数値と日付の安定性を向上させます。（デフォルト：true）                                                                                        | BOOLEAN          | はい  | true / false |

### s1 入力

これらの入力は、s1 モデルが選択されている場合に表示されます。

| パラメータ         | 説明                                                  | データ型             | 必須  | 範囲           |
| ------------- | --------------------------------------------------- | ---------------- | --- | ------------ |
| `voice`       | 音声合成用の音声。デフォルト音声を使用する場合は未接続のままにします。                 | FISHAUDIO\_VOICE | いいえ | 任意の単一音声      |
| `temperature` | 表現力。値が高いほど変化に富み、低いほど一貫性が高くなります。（デフォルト：0.7）          | FLOAT            | はい  | 0.0～1.0      |
| `top_p`       | ニュークリアスサンプリングによる多様性。（デフォルト：0.7）                     | FLOAT            | はい  | 0.01～1.0     |
| `speed`       | 話速。1.0 が標準で、1.0 未満は遅く、1.0 超は速くなります。（デフォルト：1.0）      | FLOAT            | はい  | 0.5～2.0      |
| `volume`      | 音量をデシベル単位で調整します。0 は変更なしです。（デフォルト：0.0）               | FLOAT            | はい  | -10.0～10.0   |
| `normalize`   | 英語と中国語の数値およびテキストを正規化し、数値と日付の安定性を向上させます。（デフォルト：true） | BOOLEAN          | はい  | true / false |

**注：** `text` 入力は空にできません。話者タグ（@Voice1、@Voice2 など）は大文字と小文字を区別せず、接続されている音声を参照する必要があります。接続されていない音声にタグを付けるとエラーが発生します。2つ以上の音声が接続されている場合、テキストは接続されているすべての音声を少なくとも1回参照する必要があり、そうでない場合、ノードは不足しているタグを報告します。s2.1-pro では、0個の音声を接続するとデフォルト音声が使用され、1個の音声ではその音声のみが使用され、2個以上では複数話者ダイアログが有効になります。s1 では、単一の任意音声が使用され、未接続のままにするとデフォルト音声が使用されます。感情キューはテキスト内に配置できます。s2.1-pro では \[happy] と \[whispering]、s1 では (happy) です。

## 出力

| 出力名     | 説明                      | データ型  |
| ------- | ----------------------- | ----- |
| `audio` | 生成された音声を音声ファイルとして出力します。 | AUDIO |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/FishAudioTextToSpeech/ja.md)

***

**Source fingerprint (SHA-256):** `6cc005ae76fc7b60d9399b1b0a3c5de40a6eff47cd6f0f0b73b4212c0270ae29`
