AIツールギャラリー
F5-TTS

F5-TTS

SWivid

F5-TTSは、短い参照音声と文章から話者の声に似た音声をローカル生成できるオープンソースTTSです。コードはMITですが、公式学習済みモデルはCC-BY-NCで商用利用できません。日本語は共有モデルで試せます。

オープンソース$0(ローカル実行)1回比較
無料枠
コードは無料のMIT。公式F5TTS_v1_Base重みはCC-BY-NCで非商用に限定され、GPU・ストレージなど実行費は利用者負担です。
日本語
日本語一部対応
商用利用
商用利用制限あり
登録
登録不要
対応環境
Web・デスクトップ・API
情報確認
2026年8月3日時点
AIツールギャラリー公式キャラクター、タイルン

F5-TTS、使っていますか?

あなたに近いものを選んでください。

基本情報

公式サイトgithub.com
開発元SWivid
カテゴリ
無料枠コードは無料のMIT。公式F5TTS_v1_Base重みはCC-BY-NCで非商用に限定され、GPU・ストレージなど実行費は利用者負担です。
日本語対応日本語一部対応
登録登録不要
商用利用商用利用制限あり
対応プラットフォーム
WebデスクトップAPI
情報確認日2026年8月3日時点

料金プラン

Source code

$0/月

MITライセンスのコード。Python、CLI、Gradio、Dockerで自分の環境へ導入できます。

Official pretrained model

$0(非商用)/月

F5TTS_v1_BaseはCC-BY-NC。研究・非商用用途で条件と表示義務を守ります。

Community Japanese model

$0(モデル別条件)/月

共有一覧の日本語モデル。CC-BY-NC-4.0など各モデルカードを確認します。

F5-TTSとは

F5-TTSは、参照する短い音声と読み上げたい文章を入力し、話者の声質や話し方を反映した音声を生成するオープンソースのText-to-Speechモデルです。Flow Matchingを用いた研究実装で、ローカルPCやGPUサーバーに導入し、Python、CLI、Gradio画面から利用できます。ホスト型の月額サービスではなく、ソフトウェアとモデルを自分で動かします。

主な機能

ゼロショット音声生成

参照音声とその文字列を与え、新しい文章を同じ話者らしい声で生成します。参照音声の録音品質、言語、発音、長さで結果が変わります。本人または明示的同意を得た話者の音声だけを使ってください。

CLI・Gradio・Docker

pipでインストールし、コマンドラインやGradioのローカル画面から推論できます。Docker構成も公式リポジトリにあります。Python 3.10以上が必要で、GPUを使うと高速ですが、CPU環境では処理時間が長くなる場合があります。

中国語・英語と日本語モデル

公式のF5TTS_v1_Baseは主に中国語と英語を対象とします。公式リポジトリの共有モデル一覧には、Jmicaによる日本語F5-TTSモデルが掲載されています。日本語モデルは公式ベースモデルとは作成者、データセット、品質、ライセンスが異なるため、モデルカードを個別に確認します。

導入方法

Python環境を分け、公式リポジトリの手順でf5-ttsをインストールします。まず公式サンプル音声で動作を確認し、その後に自分が権利を持つ短い参照音声を用意します。参照テキストと生成テキストを正確に入力し、ノイズや読み間違いを確認します。外部公開サーバーにする場合は認証、ファイルサイズ、保存期間、GPU使用量を制限します。

無料版と費用

ソースコードはMITライセンスで、利用料は0ドルです。ただしGPU、ストレージ、電気、クラウド計算、運用保守の費用がかかります。公式ホスト型プランやSLAはありません。Hugging Faceなど第三者が提供するデモやAPIを使う場合は、その提供者の料金、保存、利用規約が別に適用されます。

日本語対応と商用利用

日本語はコミュニティモデルで利用できますが、公式ベースの主要対象は中国語・英語です。最重要点はコードとモデルのライセンスが異なることです。コードはMITで商用利用できますが、Emiliaデータで学習した公式F5TTS_v1_Base重みはCC-BY-NCのため商用利用できません。日本語共有モデルもCC-BY-NC-4.0など独自条件があり、販売や広告利用前にモデル単位で確認します。

向いている人

音声合成の研究や非商用試作をローカルで行いたい開発者、音声クローンの仕組みを検証したい研究者、公開モデルを自社環境で比較したい人に向きます。すぐに商用ナレーションを作りたい人は、商用ライセンスを明示したAPIサービスの方が安全です。

注意点

本人の許可なく声を模倣し、なりすまし、詐欺、誤情報へ使わないでください。音声がAI生成であることを必要に応じて表示し、公開用途では同意記録を残します。出力に個人の声の特徴が含まれるため、参照音声と生成物を個人データとして保護します。MITという表示だけを見て公式重みまで商用可能と誤解しないことが重要です。

このツールの運営者の方へ: 掲載情報をご自身で更新・強化できます → 掲載を引き継ぐ / 掲載プランを見る

関連YouTube動画

F5-TTSの使い方やレビュー動画をまとめています。

関連動画は収集中です。

ユーザーレビュー

F5-TTSのレビューはまだありません。使ったことがあれば、最初のレビューを投稿してみませんか?

人気AIツールランキングをチェック

F5-TTSの代替ツール

同じカテゴリの人気ツール

すべて見る →
Hume AI

Hume AI

Hume AI, Inc.

Hume AIは、感情や声の抑揚を扱う音声対話EVIと、自然言語で演技を指定できるOctave音声合成、音声クローン、変換APIを提供する開発者向け音声AI基盤です。日本語音声にも対応し、会話アプリへ組み込めます。

音声生成・読み上げフリーミアム
Typeless

話すだけで「えーと」や言い直しを自動で消して、きれいな文章を作ってくれるAI音声入力ツール。

音声生成・読み上げフリーミアム
PAPERCUP

人間らしい声優によるダビングとビデオ翻訳を可能にするAIツール。

AI翻訳音声生成・読み上げ有料
Audioread

記事・PDF・メールの内容をポッドキャストに変換してくれるAIツール。

音声生成・読み上げ有料
AudioCraft|Meta

Meta社が開発した、テキストベースの入力で音楽やサウンドを作成できるAIツール。

AI音楽生成音声生成・読み上げ無料
Tone Transfer

ユーザーが録音した音声を、実際の楽器の音に変換できるAIツール。

AI音楽生成音声生成・読み上げ無料

F5-TTSをほかのツールと比較

F5-TTS
VS

F5-TTSの代替ツールを探す →

F5-TTSと比較してみる

すべての比較を見る →

次に読む

F5-TTSを始めよう

公式サイトへ