run server with custom model from args

This commit is contained in:
makaveli10
2024-01-18 15:02:51 +08:00
parent 0c01d7b1e5
commit 881fd55776
2 changed files with 24 additions and 27 deletions
+19 -18
View File
@@ -6,7 +6,7 @@ import json
import textwrap
import logging
# logging.basicConfig(level = logging.INFO)
logging.basicConfig(level = logging.INFO)
from websockets.sync.server import serve
@@ -100,9 +100,9 @@ class TranscriptionServer:
return
# validate custom model
if options["use_custom_model"]:
if custom_model_path is None or not os.path.exists(custom_model_path):
options["use_custom_model"] = False
if custom_model_path is not None and os.path.exists(custom_model_path):
logging.info(f"Using custom model {custom_model_path}")
options["model"] = custom_model_path
client = ServeClient(
websocket,
@@ -110,10 +110,9 @@ class TranscriptionServer:
language=options["language"],
task=options["task"],
client_uid=options["uid"],
model_size_or_path=custom_model_path if options["use_custom_model"] else options["model_size"],
model=options["model"],
initial_prompt=options.get("initial_prompt"),
vad_parameters=options.get("vad_parameters"),
use_custom_model=options["use_custom_model"]
)
self.clients[websocket] = client
@@ -206,10 +205,9 @@ class ServeClient:
multilingual=False,
language=None,
client_uid=None,
model_size_or_path="small",
model="small",
initial_prompt=None,
vad_parameters=None,
use_custom_model=False
):
"""
Initialize a ServeClient instance.
@@ -230,13 +228,15 @@ class ServeClient:
self.data = b""
self.frames = b""
self.model_sizes = [
"tiny", "base", "small", "medium", "large-v2", "large-v3"
"tiny", "tiny.en", "base", "base.en", "small", "small.en",
"medium", "medium.en", "large-v2", "large-v3",
]
self.multilingual = multilingual
if not use_custom_model:
self.model_size_or_path = self.get_model_size(model_size_or_path)
if not os.path.exists(model):
self.model_size_or_path = self.get_model_size(model)
else:
self.model_size_or_path = model_size_or_path
self.model_size_or_path = model
self.language = language if self.multilingual else "en"
self.task = task
@@ -246,7 +246,7 @@ class ServeClient:
device = "cuda" if torch.cuda.is_available() else "cpu"
if self.model_size_or_path == None:
if self.model_size_or_path is None:
return
self.transcriber = WhisperModel(
@@ -302,12 +302,13 @@ class ServeClient:
)
return None
if model_size in ["large-v2", "large-v3"]:
if model_size.endswith("en") and self.multilingual:
logging.info(f"Setting multilingual to false with {model_size} which is english only model.")
self.multilingual = False
if not model_size.endswith("en") and not self.multilingual:
logging.info(f"Setting multilingual to true with multilingual model {model_size}.")
self.multilingual = True
return model_size
if not self.multilingual:
model_size = model_size + ".en"
return model_size