音声認識ソフトUTMOSv2をPCに入れて簡易評価
***最新更新 2026年9月15日 22時30分*** FreeDVの評価で使用されたWhisperの次にUTMOSv2をPCに入れてみることにします。 UTMOS(UTokyo-SaruLab MOS prediction system)については以下のブログを参照ください。 https://jk1gpc.blogspot.com/2026/09/freedv_0435876116.html Windowsに入れるかLinuxに入れるかですが、先にWindowsを試してみます。 -------- Windows よりも Linuxの方が良さそうです GPUはなくともOK------- 以下Pythonがインストールされていることを前提に進めます。 参考: https://jk1gpc.blogspot.com/2026/09/wisper-large-v3.html 1.専用フォルダーと仮想環境を作る。 Windowsターミナル MSマークを右クリック ターミナルを起動します。 以下の太字の部分をコピペ (コピーしてターミナルプロンプトにカーソルを置き右クリックします) cd C:\ mkdir UTMOSv2 *Windowsエクスプローラで作成しても可能 mkdir UTMOSv2\result *同上 C:/UTMOSv2 python -m venv venv venv\Scripts\activate (venv) PS C:\UTMOSv2> がでればOKです。 2. pipを更新する。 python -m pip install --upgrade pip setuptools wheel 2. UTMOSv2をインストールする。 pip install git+https://github.com/sarulab-speech/UTMOSv2.git *Pipでは手順が複雑なので今回はgithubよりダウンロードします。 以下Pythonの仮想環境(venv)でも良いしなくても構いません。 cd C:\UTMOSv2 Invoke-WebRequest -Uri "https://github.c...