端末の中で、声をつくる。
Onsei は、日本語テキストをその場で音声に変換する iOS アプリです。 推論はすべてオンデバイス。入力した文章や参照音声を、提供者が運営するサーバーへ送信しません。
主な機能
テキストから音声
日本語テキストを入力し、端末内の音声合成モデルで WAV を生成・再生します。
任意の声クローン
マイク録音または音声ファイルを参照し、話し方に近い音声を合成できます。本人の明示的な同意がある場合にのみ使用してください。
表情・スタイル
絵文字による話し方のコントロールや、モデルによってはキャプションによる VoiceDesign に対応します。
オフライン生成
モデルを一度端末に取得すれば、合成そのものはネットワークなしで実行できます。
仕組み(簡潔に)
- エンジンは Irodori-TTS 系モデルを ONNX に変換したパックと、ONNX Runtime による端末内推論です。
- 初回起動時などに、Hugging Face 上の配布リポジトリからモデルパック(おおよそ 2〜3 GB)を HTTPS で取得します。Wi‑Fi と十分な空き容量を推奨します。
- 合成に使うテキスト・参照音声・生成結果は、アプリの設計上、提供者のサーバーへアップロードされません。
- アカウント登録・広告・トラッキング SDK・アプリ内課金は、現バージョンでは使用していません。
動作環境(目安)
- iOS 17 以降
- メモリに余裕のある iPhone / iPad(大型モデルのため、余裕のある端末を推奨)
- 初回のモデル取得時はインターネット接続と、数 GB 程度の空き容量
責任ある利用
本人の明示的な同意なく他人の声を複製したり、なりすましに使ったりしないでください。 誤情報の拡散や、相手を誤認させるディープフェイク目的の利用は禁止です。 合成音声であることは、状況に応じて明示し、適用される法令を守ってください。
詳細は 利用規約 をご確認ください。
免責の概要
Onsei および関連モデルは、現状有姿(AS IS)で提供されます。 生成音声の品質・正確性・特定用途への適合性、第三者の権利非侵害、中断のない動作は保証しません。 利用は利用者ご自身の責任で行ってください。責任の制限の詳細は 利用規約 に定めます。