オトシゴ

日本語専用の音声合成サービス

読み間違えない。
息づかいまで。

日本語だけに集中した音声合成です。数字や日付の読みも、文末の余韻も自然に。1字=1クレジットなので、生成する前に費用が確定します。

生成スタジオはデモ用APIキーで利用できます — 本サービスの申し込みは準備中です。

サンプルを聴く 生成サンプル3声

生成デモで選べるオトシゴ公式プリセットです。試聴WAVには開発中の識別マーカーを埋め込んでいます。

朝の一杯を、もっと香り豊かに。選び抜いた豆の深い味わいを、今日からご自宅で。

38 字 = 50 クレジット
50字未満の生成は一律50クレジット

ここでは事前生成サンプルを再生します。同じ3声でのリアルタイム生成は生成スタジオで試せます。

25.6秒の音声を約1秒で生成(自社実測)

基盤はMITライセンスの公開モデル

公開時は全生成音声に透かし・無効化不可

特定商取引法に基づく表記を公開済み

使い方

入力から書き出しまで、4ステップ。

下の画面はすべて実際のスタジオです。ログインしたあとも、この画面のまま作業が続きます。

01

テキストを入力する

オトシゴのスタジオの入力ブロック。話者チップ、本文のテキストエリア、下に感情の絵文字チップが並ぶ

読み仮名も、絵文字による表情の指示もそのまま書けます。消費クレジットは入力している最中に確定します。

02

声を選ぶ

右パネルの「声を選ぶ」。声の一覧と各行の試聴ボタンが表示されている

登録した同意済みの声・デザイン声から選びます。試聴にクレジットは消費しません。

03

生成する

生成結果。「透かし入り・生成者まで追跡可能」のバッジ、再生プレーヤー、消費クレジットと残高、生成IDが並ぶ

25.6秒の音声を約1秒で生成します(自社実測)。生成に失敗したぶんのクレジットは自動で戻ります。

04

書き出す

右パネルの履歴タブ。生成時刻・声・本文の冒頭・消費クレジットと再生ボタンが1行に並ぶ

WAVでダウンロードします。履歴から聴き直して、言い回しの違いを並べて比べられます。

できること

日本語のためだけに作った音声合成

数字や日付の読み、イントネーション、文末の息づかい。日本語だけに集中したエンジンで作っています。

絵文字で、声の表情を指示する

「明るく」「ささやき」など45種の絵文字を文中に置くだけで、その場所から声の表情が変わります。指示に使った絵文字は課金文字数に含まれません。

本文中に置かれた絵文字と、その下の感情チップ(明るく・ささやき・吐息・しんみり・力強く)

同意済みの声で、しゃべらせる

数十秒の読み上げで声のクローンを作れます。登録できるのは、声の持ち主本人がその場で同意文を読み上げた「同意済みの声」だけです(スタンダード以上)。

声の一覧。1行に声の名前、種別タグ、短い説明、試聴ボタンが並ぶ

生成する前に、費用が確定する

1字=1クレジット。空白・改行と絵文字によるスタイル指示をのぞいた文字数がそのまま消費クレジットになり、押す前に金額がわかります(1回の最低課金は50字)。失敗した生成には課金しません。

スタジオ下部の文字数メーター。「54字 = 54クレジット 残9,410」と10文字ごとの目盛り、右に生成ボタン

話速も出力も、右のパネルで完結

話速、スタイルの言葉による指定、出力形式。設定は右のパネルにまとめてあり、書いている面を邪魔しません。

右パネルの読み上げ設定。話速のステッパー、スタイル指定の自由入力、出力形式

開発者向け

OpenAI互換API

公開時には、既存の OpenAI SDK からエンドポイントを差し替えるだけで利用できます。長文向けの非同期ジョブAPIも用意します。

公開時はAPIから生成した音声にも透かしを入れます。生成IDを応答に含め、監査ログから生成者まで遡れる設計です。

# OpenAI SDK のまま、URL を差し替えるだけ POST /v1/audio/speech { "model": "otoshigo-1", "voice": "voice_id", "input": "こんにちは。オトシゴです。" }

料金

1字=1クレジットの明朗会計

月額プランに毎月クレジットが付与され、テキスト1文字が1クレジットを消費します。目安は約300字で音声1分です。

無料

まず声を試したい方に

¥0

登録時 3,000字+毎月 1,000字

  • 公開時に利用可能な声で生成
  • 絵文字によるスタイル指示
  • ボイスクローン
  • 商用利用
クローン対応の最小プラン

スタンダード

自分の声で作りたい方に

¥2,980/月

毎月 30,000字(約100分)

  • 同意済みの声のクローンなど 保存3枠
  • API利用
  • 商用利用

プロ

制作・配信を仕事にする方に

¥9,800/月

毎月 150,000字(約500分)

  • 同意済みの声のクローンなど 保存10枠
  • API 高レート・優先キュー
  • 商用利用

5プランすべてと機能比較表を見る

サービス公開時の方針

機能を足すために、
曲げない3原則。

  1. 01

    同意なき声は、登録できない

    公開時は、その場で生成された同意文を本人が読み上げ、読み上げ内容の照合と話者照合の両方に合格した声だけを有効化します。

  2. 02

    生成音声は、生成者まで遡れる

    公開時は全生成音声に透かしを埋め込み、監査ログとあわせて生成者・声・日時を特定できる状態を保ちます。無効化はできません。

  3. 03

    問題が起きたら、即時に止める

    公開時は通報・同意撤回・凍結の仕組みを常設し、問題のある声と生成を即時に停止します。通報の一次対応は24時間以内です。

安全への取り組みを読む

よくある質問

はじめる前に

いつから使えますか?

本サービスの申し込みは準備中ですが、現在はデモ用APIキーで使う生成スタジオを公開しています。一般提供の時期が決まったら、このサイトでお知らせします。

生成した音声は商用利用できますか?

ライト以上の有料プランで商用利用できます。無料プランの音声は商用利用できず、クレジット表記が必要です。

対応している言語は?

日本語だけです。日本語の読みとイントネーションの品質に集中するため、他の言語には対応しません。

ボイスクローンは誰の声でも登録できますか?

いいえ。登録できるのは「同意済みの声」だけです。自分の声のほか、声の持ち主本人が自分の端末でその場の同意文を読み上げるボイスチャレンジ(音声認識+話者照合)に合格した声だけが有効になり、持ち主はいつでも同意を撤回できます。詳しくは安全への取り組みをご覧ください。

利用に条件はありますか?

18歳以上で日本国内にお住まいの方に限定しています。無料プランの利用にはSMS認証が必要です。

短い文章でも1字=1クレジットですか?

1リクエストの最低課金は50字です。50字未満の入力は一律50クレジットを消費します。絵文字によるスタイル指示と読み仮名の指定は課金対象外です。

声を選ぶ。
声をつくる。

プリセットと声の説明はデモ用APIキーで試せます。参照音声のアップロード・録音は、安全な製品版経路を準備中です。

生成スタジオを試す