diff --git a/requirements/server.txt b/requirements/server.txt index 1edec84..fe976a4 100644 --- a/requirements/server.txt +++ b/requirements/server.txt @@ -11,6 +11,7 @@ jiwer evaluate numpy>=1.26.4,<2.5 openai-whisper==20250625 +pyannote.audio tokenizers==0.20.3 transformers[torch] sentencepiece diff --git a/whisper_live/backend/openvino_backend.py b/whisper_live/backend/openvino_backend.py index 3f0fb69..1d9586f 100644 --- a/whisper_live/backend/openvino_backend.py +++ b/whisper_live/backend/openvino_backend.py @@ -28,6 +28,7 @@ class ServeClientOpenVINO(ServeClientBase): no_speech_thresh=0.45, clip_audio=False, same_output_threshold=10, + diarization=None, ): """ Initialize a ServeClient instance. @@ -56,6 +57,8 @@ class ServeClientOpenVINO(ServeClientBase): no_speech_thresh, clip_audio, same_output_threshold, + None, # translation_queue — OpenVINO backend does not support translation + diarization, # speaker diarization — passed through to base class ) self.language = "en" if language is None else language if not self.language.startswith("<|"): diff --git a/whisper_live/server.py b/whisper_live/server.py index 21a6ab6..16139d0 100644 --- a/whisper_live/server.py +++ b/whisper_live/server.py @@ -258,6 +258,7 @@ class TranscriptionServer: no_speech_thresh=options.get("no_speech_thresh", 0.45), clip_audio=options.get("clip_audio", False), same_output_threshold=options.get("same_output_threshold", 10), + diarization=self._create_diarizer(options), ) logging.info("Running OpenVINO backend.") except Exception as e: