Meta Muse Voice Transcribe Brings Real-Time AI Transcription for 70+ Languages with Multi-Speaker Detection
Meta Superintelligence Labs unveiled Muse Voice Transcribe, its first real-time audio perception model that combines live speech transcription, speaker separation, and endpointing in a single system. The AI model distinguishes between more than 20 speakers, handles code-switching across 70+ languages, and processes audio in 80-millisecond chunks using adaptive delay technology.