From a7b4b6e51a0933ce4ffbd487b1279a51c1e78cf4 Mon Sep 17 00:00:00 2001 From: Timothy Jaeryang Baek Date: Fri, 9 Jan 2026 19:42:13 +0400 Subject: [PATCH] enh: WHISPER_MULTILINGUAL --- backend/open_webui/config.py | 8 +++----- backend/open_webui/main.py | 1 - backend/open_webui/routers/audio.py | 5 ++++- 3 files changed, 7 insertions(+), 7 deletions(-) diff --git a/backend/open_webui/config.py b/backend/open_webui/config.py index 6a00c21c0..dab5b6cfe 100644 --- a/backend/open_webui/config.py +++ b/backend/open_webui/config.py @@ -3744,11 +3744,9 @@ WHISPER_MODEL_AUTO_UPDATE = ( and os.environ.get("WHISPER_MODEL_AUTO_UPDATE", "").lower() == "true" ) -WHISPER_VAD_FILTER = PersistentConfig( - "WHISPER_VAD_FILTER", - "audio.stt.whisper_vad_filter", - os.getenv("WHISPER_VAD_FILTER", "False").lower() == "true", -) +WHISPER_VAD_FILTER = os.getenv("WHISPER_VAD_FILTER", "False").lower() == "true" + +WHISPER_MULTILINGUAL = os.getenv("WHISPER_MULTILINGUAL", "False").lower() == "true" WHISPER_LANGUAGE = os.getenv("WHISPER_LANGUAGE", "").lower() or None diff --git a/backend/open_webui/main.py b/backend/open_webui/main.py index 9b1ae53be..82a87e3fd 100644 --- a/backend/open_webui/main.py +++ b/backend/open_webui/main.py @@ -1174,7 +1174,6 @@ app.state.config.STT_OPENAI_API_BASE_URL = AUDIO_STT_OPENAI_API_BASE_URL app.state.config.STT_OPENAI_API_KEY = AUDIO_STT_OPENAI_API_KEY app.state.config.WHISPER_MODEL = WHISPER_MODEL -app.state.config.WHISPER_VAD_FILTER = WHISPER_VAD_FILTER app.state.config.DEEPGRAM_API_KEY = DEEPGRAM_API_KEY app.state.config.AUDIO_STT_AZURE_API_KEY = AUDIO_STT_AZURE_API_KEY diff --git a/backend/open_webui/routers/audio.py b/backend/open_webui/routers/audio.py index c999c132f..2a64a3598 100644 --- a/backend/open_webui/routers/audio.py +++ b/backend/open_webui/routers/audio.py @@ -41,8 +41,10 @@ from open_webui.config import ( WHISPER_MODEL_AUTO_UPDATE, WHISPER_COMPUTE_TYPE, WHISPER_MODEL_DIR, + WHISPER_VAD_FILTER, CACHE_DIR, WHISPER_LANGUAGE, + WHISPER_MULTILINGUAL, ELEVENLABS_API_BASE_URL, ) @@ -601,8 +603,9 @@ def transcription_handler(request, file_path, metadata, user=None): segments, info = model.transcribe( file_path, beam_size=5, - vad_filter=request.app.state.config.WHISPER_VAD_FILTER, + vad_filter=WHISPER_VAD_FILTER, language=languages[0], + multilingual=WHISPER_MULTILINGUAL, ) log.info( "Detected language '%s' with probability %f"