オトシゴ

日本語のための音声スタジオ

あなたの言葉に、
ぴったりの声を。

動画のナレーション、物語の朗読、商品の紹介。声を選ぶか、イメージを言葉で伝えて、あなたの文章を音声に。

オトシゴのマスコット。ヘッドホンをした白いタツノオトシゴ

まずは短い文章から。登録・APIキーの設定なしで試せます。

サンプルを聴く Studioで試せる3つの合成音声

若い女性・ひなた・シニア男性の3声を、Studioで選んで生成できます。 ここでは3声×3役の事前生成サンプルを試聴できます。掲載サンプルのダウンロード・再配布・学習利用はできません。 自分で入力した文章の生成音声は、Studioで再生・WAV保存できます。

朝の一杯を、もっと香り豊かに。選び抜いた豆の深い味わいを、今日からご自宅で。

38 字 = 50 クレジット
50字未満の生成は一律50クレジット

ここでは3声×3役の事前生成サンプルを再生できます。好きな文章で試すにはStudioを開く

01 / VOICES

声を選んで、生成。

若い女性・ひなた・シニア男性。3つの声をあなたの原稿で。

Studioを開く ↗
02 / VOICE DESIGN

イメージから、生成。

「やわらかく、落ち着いた声」。声の説明と原稿を入力するだけ。

声をデザインする ↗
03 / YOUR AUDIO

聴いて、そのまま保存。

生成した音声をその場で再生。WAVでダウンロードできます。

使い方を見る ↓

25.6秒の音声を約1秒で生成(自社実測)

基盤モデルのコードとチェックポイントはMIT宣言(学習データの権利は確認中)

公開時は全生成音声に透かし・無効化不可

特定商取引法に基づく表記を公開済み

使い方

入力から保存まで、4ステップ。

いま使えるStudioの画面でご案内します。文章を入れて、声を選んで、できあがりを聴いてみましょう。

01

文章を入力する

現在のStudioの入力欄。読ませる文章と文字数、3つの例文ボタン

「読ませる文章」に日本語で最大150文字を入力します。「動画ナレーション」「物語・朗読」「商品紹介」の例文からも始められます。

02

声を選ぶ・イメージを伝える

現在のStudioでひなたを選択したプリセット設定現在のStudioの声をデザイン設定。声のイメージを文章で入力

「プリセット」なら若い女性・ひなた・シニア男性から選択。「声をデザイン」なら「落ち着いた、やわらかい声」など、声のイメージを文章で伝えます。

03

音声を生成する

現在のStudioの利用条件チェック欄と音声を生成するボタン

表示される利用条件を確認し、該当する項目にチェックを入れて「音声を生成する」を押します。生成が終わると、入力欄の下に結果が表示されます。

04

聴いて、WAVで保存する

実際の生成結果。あなたの音声の再生プレーヤーとWAVを保存リンク

「あなたの音声」のプレーヤーで確認し、「WAVを保存」からダウンロードします。ページを閉じる前に、必要な音声を保存してください。

できること

声を選んでも、言葉で伝えても。

公開デモでは、プリセットと声のデザインを使って日本語音声を生成できます。

聴いた声で、あなたの文章を。

このページで試聴できる若い女性・ひなた・シニア男性の3声を、Studioのプリセットから選べます。読み上げる内容を変えて試してみてください。

3つの声を聴く →

欲しい声を、文章で伝える。

「声のイメージ」に、声の高さや雰囲気、語り口を入力します。読み上げる文章とは別の欄なので、伝えたい内容に集中できます。

Studioで声をつくる →

参照音声からの生成・マイク録音は、現在の公開デモでは利用できません。

開発者向け

OpenAI互換API

公開時には、既存の OpenAI SDK からエンドポイントを差し替えるだけで利用できます。長文向けの非同期ジョブAPIも用意します。

非同期ジョブの結果は状態照会APIで取得します。完了時のwebhook通知は未提供です。

公開時はAPIから生成した音声にも透かしを入れます。生成IDを応答に含め、監査ログから生成者まで遡れる設計です。

# OpenAI SDK のまま、URL を差し替えるだけ POST /v1/audio/speech { "model": "otoshigo-1", "voice": "voice_id", "input": "こんにちは。オトシゴです。" }

料金

1字=1クレジットの明朗会計

月額プランに毎月クレジットが付与され、テキスト1文字が1クレジットを消費します。目安は約300字で音声1分です。

無料

まず声を試したい方に

¥0

登録時 3,000字+毎月 1,000字

  • 公開時に利用可能な声で生成
  • 絵文字によるスタイル指示
  • ボイスクローン
  • 商用利用
クローン対応の最小プラン

スタンダード

自分の声で作りたい方に

¥2,980/月

毎月 30,000字(約100分)

  • 同意済みの声のクローンなど 保存3枠
  • API利用
  • 商用利用

プロ

制作・配信を仕事にする方に

¥9,800/月

毎月 150,000字(約500分)

  • 同意済みの声のクローンなど 保存10枠
  • API 高レート・優先キュー
  • 商用利用

5プランすべてと機能比較表を見る

サービス公開時の方針

機能を足すために、
曲げない3原則。

  1. 01

    同意なき声は、登録できない

    公開時は、その場で生成された同意文を本人が読み上げ、読み上げ内容の照合と話者照合の両方に合格した声だけを有効化します。

  2. 02

    生成音声は、生成者まで遡れる

    公開時は全生成音声に透かしを埋め込み、監査ログとあわせて生成者・声・日時を特定できる状態を保ちます。無効化はできません。

  3. 03

    問題が起きたら、即時に止める

    公開時は通報・同意撤回・凍結の仕組みを常設し、問題のある声と生成を即時に停止します。通報の一次対応は24時間以内です。

安全への取り組みを読む

よくある質問

はじめる前に

いつから使えますか?

Studioの公開デモで、3声から選ぶ生成と、声の説明+文章からの生成を試せます。登録やAPIキーの入力は不要です。現在は1回150文字まで、出力はWAVです。録音・参照音声からの生成、会員機能・課金はまだ利用できません。GPUの稼働時間と試用回数に上限があり、接続状況はStudioで確認できます。

生成した音声は商用利用できますか?

正式サービスではライト以上の有料プランで商用利用できる予定です。現在の公開デモは有料プランの提供開始を意味しません。無料プランの条件とデモの試用を同一扱いにはしません。

対応している言語は?

日本語だけです。日本語の読みとイントネーションの品質に集中するため、他の言語には対応しません。

ボイスクローンは誰の声でも登録できますか?

いいえ。登録できるのは「同意済みの声」だけです。自分の声のほか、声の持ち主本人が自分の端末でその場の同意文を読み上げるボイスチャレンジ(音声認識+話者照合)に合格した声だけが有効になり、持ち主はいつでも同意を撤回できます。詳しくは安全への取り組みをご覧ください。

利用に条件はありますか?

18歳以上で日本国内にお住まいの方に限定しています。年齢とお住まいはご登録時にご自身で申告いただく形で、証明書類の確認は行っていません。無料プランのご利用にはメール認証が必要です。

短い文章でも1字=1クレジットですか?

1リクエストの最低課金は50字です。50字未満の入力は一律50クレジットを消費します。絵文字によるスタイル指示と読み仮名の指定は課金対象外です。

声を選ぶ。
声をつくる。

3つの合成音声から選ぶか、声のイメージを説明して、文章を音声にしてみましょう。生成した音声はその場で再生・WAV保存できます。

Studioで生成する