オーディオモデル
Whisper
Whisper は、Nodaro で使える OpenAI のオーディオモデルです。対応するモードは文字起こしです。1 回の実行は 40 クレジットからです。
Whisper による文字起こしで、返すのはフレーズ単位のセグメントのみ、単語のタイムスタンプはありません。文字起こしや静的な字幕には十分ですが、単語ごとにタイミングを合わせる(キネティックな)字幕には向きません。
クレジット
| ティア | クレジット |
|---|---|
| Whisper | 40 |
Nodaro で Whisper を使う
次のいずれかのノードをキャンバスに追加して設定を開き、モデルとして Whisper を選んでください:
似たモデル
| モデル | 開発元 | モード | クレジット | 詳細 |
|---|---|---|---|---|
| Incredibly Fast Whisper | OpenAI | 文字起こし | 40 | Whisper による高速な文字起こしです。指定すると単語単位のタイムスタンプを返すため、その文字起こしを字幕に使えます。 |
よくある質問
最終更新