ROCK ON MJ
MIT License · オープンソース

録音して、文字起こす。
ぜんぶ、このPCで。

Web会議の音声をそのまま録音して、終わったら文字起こし。 インターネットにつながっていなくても動きます。音声も文字も、PCの外には出ません。

Windows 10 / 11(64bit)・メモリ8GB以上を推奨 / 実行ファイルは配布していません(各自ビルド)

ネット接続なしで動く通信するのはモデル取得のときだけ
会員登録なし・無料MIT License のオープンソース
相手の声を録音ドライバも管理者権限も不要
4つの形式で保存テキスト/字幕/Word/Excel

GEAR

録音の道具。

ROCK ON MJ は音声ファイルがあれば動きます。会議の録音に使っている道具と、文字起こしを見ながら手直しするときの相棒を並べておきます。

ICレコーダー

ソニー ICD-UX570F

薄くて軽い会議録音の定番。USB直結でファイルを取り出せるので、そのまま ROCK ON MJ に放り込めます。

Amazonで見る ↗

オープンイヤーイヤホン

Shokz OpenFit 2+

耳をふさがない耳掛け型。文字起こしを読みながら録音を聞き返すときに、周りの声も聞こえたままなので仕事の邪魔になりません。

Amazonで見る ↗

電子メモ帳

キングジム ポメラ DM250

起動2秒のテキスト専用機。録音しながら要点だけ打っておくと、あとで文字起こしと突き合わせやすい。

Amazonで見る ↗

電子メモ帳

キングジム ブギーボード BB-14

手書きの電子メモパッド。録音中に「ここ重要」と時刻だけ書き留めておく用途に。

Amazonで見る ↗

01 — FEATURES

会議のあとの、
いちばん面倒なところを。

録音ファイルを探して、別のソフトに読み込ませて、聞き直しながら打ち直す。 その一連を、ひとつのウィンドウで終わらせます。

01

録音する

Web会議で相手の声が聞こえていれば、そのまま録音できます。

  • スピーカーやヘッドセットに流れる音を録音(WASAPIループバック)
  • 録音しながら随時保存。途中で落ちてもそこまでは残る
  • デバイスエラー時は最大5回まで自動で録り直しを試みる

02

文字起こす

録音を止めると、そのまま文字起こしが始まります。

  • Whisper(large-v3-turbo)をローカルで実行
  • 手持ちの音声・動画ファイルも可(WAV / M4A / MP3 / FLAC / MP4)
  • 残り時間つきの進捗表示

03

書き出す

用途に合わせて、必要な形式にまとめて保存します。

  • テキスト(全文+タイムスタンプ付き)
  • 字幕(SRT)・Word(docx)・Excel(xlsx)
  • 自信の低い箇所には「※要確認」を付与(Excelは黄色で塗り)

04

精度を上げる

固有名詞は、辞書に書き足すだけで拾えるようになります。

  • 同じフォルダの「辞書.txt」に1行ずつ書くだけ(再ビルド不要)
  • 無音区間で同じ言葉を繰り返す暴走への対策ずみ
  • 話者の区別(話者分離)は行いません

02 — HOW IT WORKS

音声を、外に出さない。

会議の中身は、その場かぎりのものです。クラウドに送らずに済むなら、 そのほうがいい。ROCK ON MJ は、認識も変換もすべてPCの中で行います。

ローカルで完結する 音声認識のモデルをPC内に持ち、そこで処理します。通信するのは、 最初にモデルを取得するときだけです。
落ちても巻き込まれない 文字起こしは本体とは別のプロセスで実行します。万一そこで異常が起きても アプリは動き続け、設定を変えて自動で再試行します。
録音を失わない 録音開始と同時にファイルへ書き込み、数秒ごとに確定させます。 強制終了しても、そこまでの音声が残ります。
速度の目安 50分の会議で42分ほど(第11世代Core i5・メモリ8GB・CPUのみ)。 GPUは必要ありません。
01Web会議を録音(相手の声のみ・自分のマイクは録りません)
02停止すると、録音ファイルが保存される
03そのまま文字起こしが始まる
04テキスト・字幕・Word・Excel が音声と同じ場所に保存される

03 — GET STARTED

使いはじめる。

ビルド済みの実行ファイルは配布していません。Python が入っていれば、 3つの手順で自分のPC用に作れます。

1

必要なものを入れる

Python 3.12以降と、下のコマンドで依存パッケージを導入します。

2

モデルを取得する

音声認識のモデル(約776MB)を models/ に置きます。

3

ビルドする

PyInstaller で実行ファイルを作ります。10分ほどかかります。

# 1. 依存パッケージ(ctranslate2 は 4.7.2 に固定してください)
py -m pip install faster-whisper "ctranslate2==4.7.2" av openpyxl python-docx soundcard pyinstaller

# 2. モデルの取得(models/large-v3-turbo/ に置く)
py -c "from faster_whisper import WhisperModel; WhisperModel('large-v3-turbo', device='cpu', compute_type='int8', download_root='models')"

# 3. ビルド
py -m PyInstaller 文字起こしツール_会議録音_fw.spec

ctranslate2 のバージョン指定は必須です。 4.8.0以降はモデル読み込み時に約3GBを余分に確保するため、 メモリの少ないPCで起動できなくなります(実測でピーク1.9GB→4.4GB)。

Web会議を録音するときは、参加者への告知と同意を必ず取ってください。 録音した内容の取り扱いは、所属する組織のルールに従ってください。 また、文字起こしはAIによる自動処理のため、人名や固有名詞を中心に誤変換が含まれます。 重要な記録は、必ず元の音声と照らし合わせて確認してください。

04 — FAQ

よくある質問

音声や文字起こしの内容が、外部に送信されることはありますか?

ありません。録音も音声認識も、すべてPCの中で処理します。通信が発生するのは、 最初に音声認識のモデルを取得するときだけです。

自分の声も録音されますか?

録音されるのは「PCから流れてくる音(相手の声)」です。自分がマイクで話した声は 含まれません。自分の声も残したい場合は、会議アプリ側の録音機能をご利用ください。

誰が話したかは分かりますか?

話者の区別(話者分離)には対応していません。発言は時刻順に並びます。

Mac やスマートフォンでも使えますか?

Windows 10 / 11(64bit)専用です。録音にWindowsの音声機能を使っているため、 他のOSには対応していません。

どのくらいの性能のPCが必要ですか?

GPUは不要で、CPUだけで動きます。メモリは8GB以上を推奨します。 文字起こし中は1〜2GBほど使うため、他のアプリを閉じておくと安定します。

実行ファイルを配布しないのはなぜですか?

コード署名をしていないため、配布した実行ファイルは警告の対象になります。 自分のPCでビルドしたものであれば、その心配がありません。手順は上のとおりです。

READY WHEN YOU ARE

次の会議から、ROCK ON。

ソースコードとビルド手順は、すべてGitHubで公開しています。

MIT License · Windows 10 / 11(64bit)

MORE TOOLS

同じ作者の、ほかのツール。

ブラウザだけで動く道具とゲームを、ひとつのページにまとめています。