Microsoftが話者識別と内容書き起こしを同時に行うストリーミングASRモデルを公開
ア
Microsoftが話者識別と内容書き起こしを同時に行うストリーミングASRモデルを公開 https://bunrin.work/news/ja/news/microsoft-vibevoice-asr-streaming-1-5b-44341 Microsoft Researchは、音声の入力に合わせて「誰が何を話したか」を継続的に書き起こすストリーミングASRモデル「VibeVoice-ASR-Streaming-1.5B」を発表しました。