日本語の文字起こし
CPU上の軽量Vosk日本語モデル。短い窓でライブ字幕し、モーラ/連語の後処理で補正します。
日本語音声を文字起こしし、必要なら英語に翻訳。配信オーバーレイ、モバイル、バックエンド向け。
1日あたりIPごとに8時間無料 — クォータは毎日 00:00 GMT にリセット。残り時間は ステータス.
curl -X POST https://api.jptranscribe.com/v1/transcribe \
-H "Authorization: Bearer YOUR_API_KEY" \
-F "file=@recording.wav" \
-F "language=ja" \
-F "translate=true"
機能
日本語ASRと任意の英訳。音声を送るだけでテキストが返ります。
CPU上の軽量Vosk日本語モデル。短い窓でライブ字幕し、モーラ/連語の後処理で補正します。
translate=true を付けると、日本語に加えて(または代わりに)英語字幕が返ります。
ファイルまたはURLを送信。JSONで送受信。Bearer認証。標準のHTTPステータス。
OpenAPI 3 は /spec/openapi.yaml。Python / TypeScript / Go などでクライアントを生成できます。
HTTPSのみ。プロジェクトごとのAPIキー。音声は処理後に削除し、学習には使いません。
Swagger UI でエンドポイントを試すか、音声をアップロード: 試してみる.
用途
OBSやアプリから音声チャンクを送り、海外視聴者向けの英語オーバーレイを表示。
生産性アプリで日本語ボイスメモを文字起こし。検索可能なテキストや英訳サマリーを出力。
RESTでメディアを一括処理。CMSや自動化パイプラインに接続。
日本語のフィールド録音をテキスト化して分析。
FAQ
WAV、MP3、M4A、FLAC、OGG。ライブ優先:短いASR窓(各30秒以内)で連続配信。GPU不要。
CPU上のVosk小型日本語モデル。短い明瞭な音声向け。雑音や長尺では精度が落ちることがあります。
起動時はREST一括API。サブ秒のライブ字幕向けWebSocketはロードマップ。ベータが必要ならご連絡ください。
音声はメモリ上で処理し、リクエスト完了後に削除。お客様の音声でモデル学習はしません。
ずっと無料。クレカ不要。翻訳は常に0円。文字起こしは1日8時間/IPまで。料金を参照。