~/wiki

Web Speech API

Confiance : high
web-speech-apispeech-recognitionbrowser-apivoice-interfacesclient-side-processingreal-time-audio

Browser-native JavaScript API providing speech recognition and speech synthesis capabilities, enabling voice-driven web applications without server-side audio processing requirements.

Core Capabilities

Speech Recognition

The SpeechRecognition interface converts spoken words into text in real-time:

const recognition = new (window.SpeechRecognition || window.webkitSpeechRecognition)();
recognition.continuous = true;
recognition.interimResults = true;
recognition.lang = 'en-US';

recognition.onresult = (event) => {
    const transcript = event.results[event.results.length - 1][0].transcript;
    // Process recognized speech
};

Configuration Options

  • **Continuous mode