実際に届く質問。
答えは正面から。遠回しは抜き。
お金と自由
無料。本当に。
本当に無料ですか?
はい。YappyはMITライセンスのオープンソースです。読んでいるものを耳で聞けるのはアクセシビリティの問題であり、アクセシビリティの道具がカードを求めるべきではありません。パソコン版には、有料版も広告もありません。iPhoneでは、お試しのオウムがとまり木に文書を3件まで止まらせます。時間制限はありません。底なしのとまり木と、オーディオブックの印刷所と、パソコンへの橋が欲しければ、Yappy Parlanchínでゼンマイを巻いてください。サブスクリプション、または買い切りの一回払いです。いずれにせよ、アカウント登録も広告もありません。
カラクリは? どうやって運営しているのですか?
カラクリはありません。支払うべきサーバーがないのです。音声合成はあなたの端末の中で動くので、Yappyにユーザーあたりのコストはかかりません。作者の個人的なプロジェクトで、すでにできあがっていたものを、ほかの誰かの役に立ちそうだから公開した、それだけです。
無料のお試しはありますか?
いいえ、わざとです。3件までのとまり木こそがお試しです。期限切れにはならないし、7日目に請求に化けることもありません。Yappyが役に立つかどうかは、誰も目の前に時計を出してこなくても、あなたにはもうわかっているはずです。
作った音声を、ポッドキャストや動画で公開してもいいですか?
YappyのコードはMITで、利用に条件を付けません。音声モデルのSupertonic 3には、独自のライセンスがあります。OpenRAIL-M型のオープンライセンスで、利用条項が付いています。商用利用の前に、モデルのページで確認してください。その部分はYappyの管轄外なので、私たちが代わりに約束することはできません。
あなたのテキストは、どこにも行かない
プライバシーの話は、実名で。
私のテキストはどこかのサーバーに送られますか?
いいえ。音声合成も文字起こしも記事の抽出も、端末の中で行われます。Yappyに渡したテキストがどこかへ送られることはありません。アカウントはなく、コピーもなく、保存されようのないYappyのサーバーは、そもそも存在しません。ネットワークに触れるのは具体的に4つのケースだけで、どれもプライバシーポリシーに書いてあります。
Yappyは利用統計を収集しますか?
収集します。遠回しにする必要もないので、はっきり言います。モバイルアプリは匿名の利用統計を送ります。初期状態でオンになっていて、設定の奥でオフにできます。送られるのは、決められたリストの中のイベント名(アプリを開いた、初回ツアーのどの段階を見た、どのプランに触れた、読み上げが終わった、など)、インストールごとのランダムな識別子、言語、バージョン。あなたの名前も、メールアドレスも、読んでいるテキストも、文書のタイトルも、リンクも、広告の識別子も一切送りません。行き先も、GoogleでもFirebaseでも分析会社でもありません。作者自身のCloudflareのWorkerとD1データベースです。デスクトップ版には、統計という統計が一切ありません。
では、モバイルとパソコンをつなぐ「ブリッジ」は?
2台の端末同士の直接接続です。irohのプロトコルを使い、QUICでエンドツーエンド暗号化されます。ペアリングは、パソコンが表示するQRコードにカメラを向けるだけ。できあがった鍵は、いつでもそこから取り消せます。間にYappyのサーバーはありません。Yappyのサーバーは存在しないので。
オフラインでも使えますか?
はい、ずっと使えます。最初のモデルのダウンロード(モバイルで約200MB、パソコンで約398MB)のあとは、機内モードのままで貼り付け、文書を開く、合成、書き出しが全部できます。ネットワークが要るのは新しいアドレスの共有だけです。理由は言うまでもないでしょう。クラウド同期もありません。ライブラリは端末の中に住んでいて、ブリッジは物を別の機械へ手渡すのに一番近いやり方です。
音になるもの
声と言語。
どの音声モデルを使っていますか?
Supertonic 3。Supertone製のオープンなモデルで、約9,900万パラメータ。パソコンなら398MB、モバイルなら200MBに収まり、ここ数年のノートパソコンならリアルタイムより速く合成できます。文字レベルで動くモデルです。だからこそ台本化機能があります。数字、略語、記号を、声が読む前に言葉へ直しておくのです。
どんな言語を話せますか?
ドイツ語、アラビア語、ブルガリア語、チェコ語、韓国語、クロアチア語、デンマーク語、スロバキア語、スロベニア語、スペイン語、エストニア語、フィンランド語、フランス語、ギリシャ語、ヒンディー語、ハンガリー語、インドネシア語、英語、イタリア語、日本語、ラトビア語、リトアニア語、オランダ語、ポーランド語、ポルトガル語、ルーマニア語、ロシア語、スウェーデン語、トルコ語、ウクライナ語、ベトナム語。31言語です。しかも10の声はどれも多言語話者で、全部を同じ声が読み上げます。声色は変わりません。
言語が混ざった文書だとどうなりますか?
Yappyは文書全体の言語を検出し、さらに段落ごとにも判定します。日本語の文章の中にある英語の引用は、同じ声のままで英語として読み上げます。何も触る必要はありません。判定が間違っていたときは、言語を手動で固定できます。
VoiceOverや「画面の読み上げ」と何が違いますか?
システムの読み上げ機能は、画面をそのまま、システムの抑揚で読みます。記憶力はありません。Yappyは言う前にテキストを仕込みます。記事をきれいにし、数字と略語を言葉にし、休止を打つ。自然な声で読み、どこまで読んだか覚えていて、オーディオブックに書き出せて、画面ロック中も鳴り続けます。親戚同士のような道具で、仕事が違うので、同時に使っても邪魔し合いません。Yappyはスクリーンリーダーの代わりにはなりませんし、なるつもりもありません。
取り込めるもの
文書のこと。
どの形式を受け付けますか?
ウェブ記事(ページは自分できれいになります)、公開文字起こし経由の動画、PDF、EPUB、Word、ODT、RTF、Markdown、プレーンテキスト、.pptx、.xlsx、.csv、ボイスメモ。モバイルでは全部、共有シートから。デスクトップではそれに加えて、ドラッグでもショートカットでも。パソコンにpandocが入っていれば、リストはLaTeX、reStructuredText、Orgなど、もう少し広がります。
では、中にテキストがないスキャンPDFは?
デスクトップでは、読み上げの前にローカルOCRを通します。ここでも、パソコンの外に何も出ません。iPhoneはまだ非対応です。PDFが紙の写真だと、スマホは読むべきテキストを見つけられません。傾いたスキャンやぼやけたスキャンはOCRの実力通りの結果になりますが、まともなスキャンなら最後まで読めます。
店で買った本も読み上げられますか?
開けられる本だけです。保護のないEPUBなら、章ごと全部読み上げます。店のDRM付きの本は読めません。このアプリでも、ほかのどんなアプリでも。あの錠前はYappyのものではないので、鍵を持っているふりをするつもりはありません。
ライブラリから削除するには?
ライブラリの中から削除します。書類ごとに削除の項目があり、音声もそれと一緒に消えます。書き出したファイル(.m4b、.mp3、.wav)はあなたのものなので、保存した場所にあります。消すのも移動するのも、Finderかファイルアプリの仕事です。
うまくいかないとき
不具合とヘルプ。
最初の読み上げだけ、数秒余計にかかるのはなぜですか?
最初の一度だけ、モデルをメモリに読み込みます。あとは温まったままなので、次の文はすぐ出ます。パソコンにアプリを入れた直後なら、最初の待ち時間に音声モデルのダウンロードも加わります。
ある単語の発音が変です。教え込むことはできますか?
ユーザーが発音を教え込む辞書はありません。手っ取り早いのは、エディタで聞こえたとおりに書き換えることです。モデルは文字のとおりに読むので、言うことを聞いてくれます。略語や頭字語、単位のように同じパターンが繰り返すものなら、GitHubのIssuesに報告してください。読み上げの対応表は、そういう報告で育ちます。
動画を共有したのに、何も読みません。
Yappyが読むのは、動画に公開されている文字起こしです。動画の音声を聞き取るわけではありません。文字起こしのない動画には、読むものがありません。動画が自分のものでファイルを手元に持っているなら、そのファイルを共有してください。そうすれば、端末の中の耳が文字起こしします。
不具合を見つけました。どこに報告すればいいですか?
GitHubのIssuesか、[email protected]宛のメールで。うまく読めなかったテキストを共有できるなら、それとOSの情報も一緒に送ってください。早く直ります。