音声WAV → Whisper transcribe → 原文との forced alignment → タイムスタンプ付き字幕 (LRC) 生成。Whisper の誤認識・幻覚を吸収して原文ベースの正しい字幕を作る。v2.1 (2026-05-23): オーナー指示で 1センテンス = 1 LRC 行に統一 (カンマ副分割を廃止)。