音声入力アプリ「Willow Voice」を手がけるWillow Care Inc.は、モデルの学習にCoreWeave Inc.の強化学習インフラを利用すると発表した。この提携により、Willowはハードウェアやソフトウェアの細かな管理を省き、アライメントの評価や後処理に専念できる。Willowは実環境で録音された静かな音声を使って音声認識モデルを微調整し、その後、小型の大規模言語モデルでテキストを整える。同社は、学習処理よりも音声入力の需要のほうが速いペースで伸びると見込んでいる。
なぜ重要か
Willowは複雑な計算リソースを管理せずに、音声文字起こしサービスの改善を加速できる。