入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25cDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
MiniMax Music3 Text Encode は MiniMax Music3 CLIP モデルを使用して、テキストの説明と歌詞を音楽生成用の音響条件シーケンスに変換します。
| パラメータ | 説明 | データ型 | 必須 | 範囲 |
|---|---|---|---|---|
clip | MiniMax Music3 CLIP モデル。テキストエンコーディングと条件シーケンスの生成に使用されます。 | CLIP | はい | - |
caption | 生成する音楽を説明するテキスト内容。複数行のテキストと動的プロンプトに対応しています。 | STRING | はい | - |
lyrics | 音楽の生成に使用する歌詞テキスト。複数行のテキストと動的プロンプトに対応しています。 | STRING | はい | - |
seed | 生成プロセスで使用する再現可能な乱数シード。デフォルト値:0。 | INT | はい | 0 から 18446744073709551615(0xffffffffffffffff) |
max_duration | 生成する音楽の最大長(秒)。モデルが曲を途中で終了する場合があります。デフォルト値:120.0。 | FLOAT | はい | 0.04 からモデルの最大オーディオ長(MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND)、ステップ 0.04 |
cfg_scale | 分類器フリーガイダンスのスケール係数。デフォルト値:モデル定数 CFG_SCALE。上級パラメータ。 | FLOAT | はい | 0.0 から 100.0、ステップ 0.1(小数点以下2桁) |
top_k | 音響トークン選択に使用する top-k サンプリング値。デフォルト値:モデル定数 CFG_TOP_K。上級パラメータ。 | INT | はい | 1 からモデルの語彙サイズ(C0_VOCAB_SIZE) |
| 出力名 | 説明 | データ型 |
|---|---|---|
conditioning | 生成された音響条件シーケンス。後続の音楽生成をガイドするために使用されます。 | CONDITIONING |
seconds | 条件シーケンスに対応する実際の長さ(秒単位)。 | FLOAT |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25c