Metaは、音声認識、話者分離、発話終了検知を単一でこなすモデル「Muse Voice Transcribe」を発表しました。20人以上の話者識別や日本語を含む多言語に対応し、Meta Model APIやMac版アプリなどで利用可能です。