オファー終了まで 47H 59M 59S

Fish Audio は1周年 🎂

50% オフ すべて対象

特典を受け取る

エンタープライズ向け音声インフラ

HeyGen、Retell、Sanasをはじめ、次世代の音声AI開発者に選ばれる、豊かな表現力と高度な制御性を備えたリアルタイム音声モデル。アバター動画、音声エージェント、キャラクターアプリ、音声コンテンツ、多言語対応、声質を維持した音声翻訳まで、商用・本番環境で幅広く活用されています。

S2 Pro のインタラクティブデモを公開中。声を選び、テキストを入力するだけで、その場で生成音声を試聴できます。開発現場で採用されている本番環境と同じモデルを、会員登録も、営業との面談も、デモ環境の手続きも一切なしですぐにお試しいただけます。

80以上の
言語
200万種類以上の
音声ライブラリ
$15/100万文字
固定 API 料金
<150ms
初回音声まで (クラウド)

商用・本番環境で音声プロダクトを開発するチームに選ばれています

音声開発チームが乗り換える6つの理由

一般的な TTS はデモならどれも綺麗に聞こえます。Fish Audio が真価を発揮するのは、その先の『本番運用』です。大規模トラフィックの安定処理、特殊な単語の発音、多言語のコードスイッチング、データ主権を満たすオンプレミス導入、そして事業拡大を力強く支える圧倒的なコストパフォーマンスを提供します。

本番運用

Artificial Analysis 掲載 · 評価手法を公開中

ベンチマーク

HeyGen、Retell、Sanas、FinalRound などの導入実績

発音

カスタム辞書 · 数値、固有名詞、専門用語に対応

S2 Pro は Artificial Analysis の音声リーダーボードに掲載され、HeyGen、Retell、Sanas の本番環境を支えています。実際のトラフィック処理、特殊な難読発音、そしてベンチマークでは見えにくいマルチリージョン環境での高負荷にも安定して対応します。

本番での圧倒的な実績デモでの評価だけではありません

重要なのは、単なる品質のアピールではなく、導入後にチームが何をもたらしたかです。掲載されているのはすべて、お客様自身によって語られた数値的な導入成果です。

米国英語以外のアクセントにおける音声クローニングで他社プロダクトを 3 対 1 の割合で上回り選ばれました

Picto VOICE 内の日本語 AI キャラクターに1文字単位の繊細な表現力を実現しています

リアルタイムボイスエージェント向け TTS1,000万人超 のユーザー規模に対応自然さ・感情表現・低遅延・多言語を完備

企業向け対話システムに特化したリアルタイム・オーケストレーション対応の本番環境向け音声エージェント

ライブ面接コーチングをリアルタイム・低遅延で提供します

6つの音声プロダクト領域で
すでに本番環境で稼働中

アバター動画の作成から多言語カスタマーサポートまで。以下の各カテゴリは将来のロードマップではなく、すでに Fish Audio 上で稼働している本番環境への導入実績です。

AI エージェント向け音声

キャラクター&コンパニオンアプリ

アバター・動画ナレーション

多言語カスタマーサポート

中国語 · 日本語 · 韓国語 · 広東語

大規模な音声クローニング

200万音声のエコシステム · 30秒クローン

音声翻訳と吹き替え

80以上の全言語 · コードスイッチング

すでにお使いの音声エージェント基盤にのまま接続可能

既存のオーケストレーション、テレフォニー、インフラ環境へそのまま導入可能。あらゆる主要言語向け SDK をご用意し、WebSocket ストリーミング、REST、受信 Webhook などの連携パターンをわかりやすいドキュメントでサポートします。

実用通話で本当に必要な、確かな基本品質

商用環境での運用は Enterprise プランより承ります。想定トラフィックに応じたボリュームディスカウントや、データ主権要件を満たすセルフホスト環境(個別セットアップ・契約体系)のご案内については、営業担当までお気軽にご相談ください。

最大99%

稼働率 SLA
premium enterprise プランで利用可能

<150ms

初回音声 (クラウド)
米国、EU、APAC リージョンで検証済み

カスタム

同時ストリーム
High Volume プランで 50 以上 · Enterprise プランでカスタム対応

80+

言語
ネイティブ品質音声 · コードスイッチング対応

ビジネスの実態的な成長スピードに合わせて最適化

Enterprise プランは1つ。明確な文字単位料金。 スケールに合わせて割引率が段階的に適用されるボリュームディスカウントを、ひとつの契約・統一された担当窓口で一括導入できます。

商用環境での運用は Enterprise プランより承ります。想定トラフィックに応じたボリュームディスカウントや、データ主権要件を満たすセルフホスト環境(個別セットアップ・契約体系)のご案内については、営業担当までお気軽にご相談ください。

プラン内容
Enterprise プラン
条件と注記
開始価格
月額 $999 から
利用規模(コミットメント)に応じたボリュームディスカウント
TTS · S2 Pro
$15 / 100万文字
UTF-8 バイト単位で課金:100万バイト=英語約18万単語
TTS · S1
$15 / 100万文字
S2 Pro と同じフラット料金
ASR · transcribe-1
$0.36 / 音声時間
利用時間は 1 秒単位で切り上げ
同時実行
カスタム
High Volume プランで 50 以上 · Enterprise プランでカスタム対応
音声
無制限
スロット制限なし · 音声ごとの料金なし
SLA
最大 99%
premium enterpriseプランで利用可能
サポート
専用 Slack チャンネル
リクエストに応じて SOC2 / HIPAA コンプライアンス
Self-host premium
初期費用 1 万ドル + 月額 1 万ドル~
12か月契約 · VPC · オンプレミス · エアギャップ · ソブリンクラウド

利用量に応じた段階的割引を適用可能です。公開価格は Enterprise プランの最低導入価格となります。想定トラフィックや契約規模に応じた個別お見積もり(追加ディスカウント)については、営業までお気軽にご相談ください。

いつでもご利用いただけます

まずはご相談ください。貴社の要件に合わせた準備をしてお待ちしています。

よくある質問

データはどこに保管されますか? 米国、EU、APAC のデータレジデンシーに対応していますか?

デフォルトでは、データは米国で保持され、Google Cloud(Cloudflare R2 ストレージ)上でホストされます。推論処理は米国およびアジア太平洋(東京)のエッジリージョンから実行され、ユーザーの位置を問わず低レイテンシな体験を提供します。コンプライアンス要件のあるワークロードでは、Enterprise 契約で『Zero Data Retention(データ非保持)』を有効化でき、リクエストのテキストや音声データがディスクに書き込まれることは一切ありません。また、データを特定の国・地域内に完全に留める必要がある場合は、お客様自身のインフラ内で全機能が稼働する『self-hosted enterpriseプラン』をご利用いただくことで、データが外部へ出るのを完全に防ぐことができます。

大規模環境での運用やトラフィックの急増に対応できますか?

はい、商用レベルの大規模なトラフィックにも確実に対応します。処理能力はご契約内容に応じてスケールする『同時生成数』として割り当てられ、すでに本番環境で 1,000 件以上の同時生成を運用されているお客様もいらっしゃいます。Rust 製エッジゲートウェイが複数の GPU リージョンに跨って推論を処理するため、トラフィックが急増した際も、弊社チームが同日中に上限枠を引き上げます。サポートチケットの返信を待つタイムロスなく、即座にスケールアップが可能です。

どのようなセキュリティ認証を取得していますか?

セキュリティは本プラットフォームのあらゆる層に組み込まれています。現在 SOC 2 Type II 監査を進行中であり、完了次第 NDAのもとでレポートを提供可能です。Enterprise 契約では「Zero Data Retention(データ非保持)」を利用でき、リクエストのペイロードが保存されることはありません。また、self-hostedプランではすべてのデータを自社環境内に完全に保持できます。さらに、医療分野のワークロード向けに HIPAA に準拠した構成や BAAの締結にも対応しており、継続的なコンプライアンスプログラムの一環として第三者機関によるペネトレーションテストも定期実施しています。

カスタムデプロイ向けのエンジニアリング支援は提供していますか?

もちろんです。Enterprise プランのお客様には、チケット制の問い合わせフォームではなく、貴社チームのご希望のチャネルで 弊社エンジニアリングチームと直接連絡が取れる専用ラインをご提供します。お客様固有のシステム連携機能やプロトコル拡張の開発・定期提供を行うほか、セルフホスト環境の構築においても初期セットアップから本番稼働(Go-Live)まで、エンドツーエンドで伴走・立ち上げ支援を行います。

SSO と RBAC に対応していますか?

はい、運用初日から柔軟かつ精緻な権限管理が可能です。RBACにより、チームレベルでは Owner・Admin・Member、ワークスペースレベルでは Manager・Contributor・Viewer の権限をそれぞれ割り当てられるため、各ユーザーに最適なアクセス権限のみを確実に付与できます。また、SSOは現時点で Google および GitHub による OAuth 認証に対応しています。

自社データによるモデルの追加学習や、独自の音声モデル作成に対応していますか?

双方に対応しており、お客様のご要件・運用条件に合わせて自由にご利用いただけます。プライベートなボイスクローンは、API または Web UI からわずか 10 秒(高品質な生成には 30 秒以上を推奨)の参照用音声データを用意するだけで即座に作成でき、作成した音声はチーム内限定で安全に保持されます。さらに発展的な活用をご希望の場合は、貴社の独自データを用いたカスタムモデルのファインチューニングにも対応いたします。

他社サービスから移行する場合のサポートはありますか?

Fish Audio への移行は非常にスムーズで、多くのチームがそのスピーディーさに驚かれます。既存の音声モデルはサンプル音声(参照用データ)から再生成して簡単に移植可能です。また、Python、TypeScript、Go 向けの SDK や WebSocket ストリーミング API が、現在お使いの連携パターンをそのままカバーします。さらに、弊社のエンジニアリングチームが移行作業を直接伴走するため、本番環境のサービスを止めることなくシームレスに切り替えることができます。