2026/08/02まだまだ翻訳を詰めていたっぱ
02:06
ばんわっぱ かっぱだっぱ⋯
いろいろ修正したっぱ(。-Θ-。)ボォ…
なのでまたAIに調整分雑に説明させるっぱが・・
前よりだいぶ使いやすくなった予感っぱ・・
“OBS配信でリアルタイム日英翻訳字幕を無料で作る — Cloudflare Workers AI × Python” “GPU不要・サーバー不要・月額0円で、OBS配信にリアルタイム翻訳字幕を表示する方法。Cloudflare Workers AIの無料枠で動くPythonスクリプトの導入ガイド。”
これは何?
配信で話した声をリアルタイムで文字起こし&翻訳して、OBSに字幕として表示するスクリプトです。
- 🇯🇵 日本語で話す → 英語字幕を表示
- 🇺🇸 英語の配信を聴く → 日本語字幕を表示
- 🌐 両方混在 → 自動判定して双方向翻訳
GPU不要、サーバー不要、月額0円で始められます。Cloudflare Workers AIの無料枠(1日10,000 Neurons)で動作します。
こんな人におすすめ
- 英語配信を日本語字幕で楽しみたい人
- 日本語配信に英語字幕をつけたい人
- 国際配信で双方向翻訳が必要な人
- GPU持ってないけどAI字幕を使いたい人
必要なもの
| 項目 | 詳細 |
|---|---|
| PC | Windows / Mac / Linux(Python 3.10以上) |
| Cloudflareアカウント | 無料登録 — クレカ不要 |
| マイク または 仮想音声ケーブル | マイクモードはマイク、配信モードはVoicemeeter等 |
| OBS Studio | 無料ダウンロード |
仕組み
あなたの声 → Pythonスクリプト → Cloudflare Workers AI → テキストファイル → OBSが表示 ↑ Whisper(文字起こし) Llama(翻訳)
scipy はオプション インストールされていなくても動作しますが、音声リサンプリングの精度がやや落ちます。
Step 5: スクリプトのダウンロード
スクリプト(obs_subtitle_translator_0802.py)をダウンロードし、任意のフォルダに保存します。
Step 6: APIトークンを設定
スクリプトの91行目を書き換えます:
CLOUDFLARE_API_TOKEN = os.environ.get(“CF_API_TOKEN”, “”)
↓
CLOUDFLARE_API_TOKEN = os.environ.get(“CF_API_TOKEN”, “ここにトークンを貼り付け”)
同じく92行目の ACCOUNT_ID も自分のアカウントIDに書き換えます。アカウントIDはダッシュボードの右側サイドバーに表示されています。
環境変数で管理する場合 トークンをソースコードに書きたくない場合は、環境変数 CF_API_TOKEN を設定すればスクリプトの書き換え不要です。
Windows
set CF_API_TOKEN=あなたのトークン
Mac/Linux
export CF_API_TOKEN=あなたのトークン
Step 7: 実行
python obs_subtitle_translator_0802.py
起動するとメニューが表示されます: 1: 🎤 マイクモード(自分の声を拾う) 2: 🎮 配信モード(ゲーム・配信音声を拾う)
Step 8: OBSに字幕ソースを追加
- OBSで**テキストソース(GDI+)**を追加
- ファイルから読み込むにチェック
- スクリプトと同じフォルダの
output_mic.txtまたはoutput_game.txtを指定 - エンコーディング: UTF-8
使い方
マイクモード(自分の声を翻訳)
- 起動時に
1を選択 - 言語を選択(日本語→英語 など)
- デバイスを選択
- 約30秒間黙って待つ(ノイズ学習中)
[ノイズゲート確定]が表示されたら話し始める
学習中の3つのルール
- 黙って待つ — 話すと閾値が高くなりすぎて話声を拾わなくなる
- マイクに触れない — ノイズフロアが跳ね上がる
- BGMがある環境なら流したまま学習 — BGM音量がノイズフロアになり、話声だけを拾いやすくなる
配信モード(ゲーム音声を翻訳)
- 起動時に
2を選択 - 言語を選択
- デバイスを選択(Voicemeeter Out B2 など)
- すぐに動き始めます(ノイズ学習なし)
レイテンシモード
起動時に3つのモードから選べます:
| モード | チャンク長 | 遅延 | 精度 | Neuron消費 |
|---|---|---|---|---|
| 🚀 短縮 | 3秒 | 4〜6秒 | やや低 | 多め |
| ⚖️ 通常 | 5秒 | 6〜8秒 | バランス | 標準 |
| 🎯 精度優先 | 8秒 | 8〜11秒 | 最高 | 少なめ |
滑舌に不安がある方 精度優先モード(8秒)を推奨します。長い音声をWhisperに渡すため、認識精度が上がります。
ジャンル選択
Whisperの語彙ヒントを設定できます:
| 選択肢 | 効果 |
|---|---|
| 🎮 ゲーム配信 | RPG・FPS・MOBA等のゲーム用語を拾いやすくする |
| 🏕️ 雑談・生活 | 日常会話・料理・旅行等の言葉を拾いやすくする |
| 🔧 技術・プログラミング | API・Python・サーバー等の技術用語を拾いやすくする |
| 🎵 音楽・歌 | 楽器名・音楽用語・曲名等を拾いやすくする |
| 🎯 指定しない | ジャンル固有のヒントを入れない(デフォルト) |
| 🥒 かっぱ配信 | 語尾に「っぱ」がつく配信者向け |
終了
Ctrl+C で終了します。outputファイルが空になります。
料金
| プラン | 無料枠 | 超過分 |
|---|---|---|
| Free | 1日10,000 Neurons | —(エラーになるだけ) |
| Paid($5/月) | 1日10,000 Neurons | $0.011 / 1,000 Neurons |
無料枠でどれくらい使える? モードによって異なりますが、約2〜8時間の連続使用が可能です。1日あたりのリセットはUTC 00:00(日本時間9:00)です。
Freeプランの場合、10,000 Neuronsに達したらエラーになるだけで課金されません。
トラブルシューティング
| 症状 | 解決策 |
|---|---|
| 話声を拾わない | NOISE_GATE_MULTIPLIER を 3.0→2.0 に下げる |
| ノイズを拾いすぎる | NOISE_GATE_MULTIPLIER を 3.0→4.0 に上げる |
| ゲーム音声を拾わない | VAD_THRESHOLD_GAME を 400→300 に下げる |
| ゲーム音声を拾いすぎる | VAD_THRESHOLD_GAME を 400→500 に上げる |
| APIエラーが出る | トークンとアカウントIDを確認 |
| scipyエラー | pip install scipy |
| 録音エラー(PaErrorCode) | デバイス番号を確認。l で一覧表示して正しい番号を選ぶ |
よくある質問
Q: GPUは必要ですか?
A: 不要です。すべてCloudflareのエッジで処理されます。
Q: 通信量はどれくらいですか?
A: 1チャンク(5秒)あたり約80KBの音声データを送信します。1時間で約57MBです。
Q: オフラインで使えますか?
A: いいえ、インターネット接続が必要です。Cloudflare Workers AIはクラウドサービスです。
Q: 遅延はどれくらいですか?
A: 発話から字幕表示まで平均6〜8秒(通常モード)です。内訳は録音バッファ2.5秒 + Whisper API 1〜3秒 + 翻訳API 0.5〜2秒 + OBS更新0.1〜1秒です。
Q: 他の言語にも対応していますか?
A: Whisperは多言語対応です。「日本語以外すべて」モードで英語・スペイン語・フランス語等の音声を日本語に翻訳できます。
Q: FPSゲームにラグが出ますか?
A: 出ません。このスクリプトがCPUを使うのは1チャンクあたり数ミリ秒だけです。残りの時間はAPI応答待ち(ネットワークI/O)か録音待ちで、CPUは使っていません。
技術構成
通信構成
Python(PC) │ ├─→ Whisper API(音声→テキスト) │ @cf/openai/whisper │ ├─→ LLM翻訳 API(テキスト→翻訳) │ @cf/meta/llama-3.1-8b-instruct-fast │ └─→ output_*.txt → OBSが読み込み
音声処理フロー
音声録音 → 動的ノイズゲート(マイクモードのみ) → 周波数VAD(200〜3400Hzの音声帯域パワーで判定) → 音声正規化(DCオフセット除去 + ゲイン調整) → 無音トリミング(前後の無音をカット) → リサンプリング(scipy高品質、フォールバック付き) → Whisper API送信
v5.2 の改善点
| # | 改善 | 効果 |
|---|---|---|
| 1 | 非ブロッキングパイプライン | API応答中も録音が止まらない |
| 2 | NG正規表現の事前コンパイル | 毎チャンクの処理を高速化 |
| 3 | 翻訳APIリトライ | 一時的なエラーに耐性 |
| 4 | Atomic write | OBSの文字欠落を防止 |
| 5 | 環境変数化 | トークンの安全な管理 |
| 6 | HTTPセッション再用 | 2回目以降のAPI呼び出しを50〜150ms短縮 |
| 7 | レイテンシモード選択 | 短縮/通常/精度優先を選択可能 |
| 8 | ガードレール対応 | AI Gateway Guardrailsのブロックを検出 |
| 9 | ノイズゲート学習の動的調整 | チャンク長に応じて学習時間を約30秒に固定 |
| 10 | VAD閾値の自動スケール | 短チャンク時にゲームモードの閾値を調整 |
⚠️ 免責事項
- 本ソフトウェアの利用はすべて利用者自己責任となります
- Cloudflare Workers AI の仕様変更・料金改定により、予告なく動作しなくなる可能性があります
- 無料枠であっても設定ミス等による想定外の消費についても責任を負いません
- 放送禁止用語の抑止機能を備えていますが、100%の保証はできません
- 本ソフトウェアをインストール・実行した時点で、上記に同意したものとみなします
おねむなので雑対応っぱがやることはやったっぱ・・
滑舌の悪いおいらには未対応アプリ感あるっぱが( ・Θ・).;’.、ブッ
滑舌が良い人に配信者の方には問題なく使える気配っぱ(*´-Θ-)ホッ-3
かっぱでしたっぱ♪
あ”
今回のファイルね 2026/08/02版 多分これで安心っぱ(人Θ’o)ネッ
コメント