sep for mlx is also ""

This commit is contained in:
Silas Kieser 2025-01-21 10:39:38 +01:00
parent 4293580581
commit 9f262813ec
2 changed files with 8 additions and 2 deletions

View file

@ -164,7 +164,7 @@ class MLXWhisper(ASRBase):
Significantly faster than faster-whisper (without CUDA) on Apple M1. Significantly faster than faster-whisper (without CUDA) on Apple M1.
""" """
sep = " " sep = "" # In my experience in french it should also be no space.
def load_model(self, modelsize=None, cache_dir=None, model_dir=None): def load_model(self, modelsize=None, cache_dir=None, model_dir=None):
""" """

View file

@ -175,8 +175,14 @@ class OnlineASRProcessor:
if ( if (
len(self.audio_buffer) / self.SAMPLING_RATE > self.buffer_trimming_sec len(self.audio_buffer) / self.SAMPLING_RATE > self.buffer_trimming_sec
): # longer than this ): # longer than this
logger.debug("chunking sentence")
self.chunk_completed_sentence() self.chunk_completed_sentence()
else:
logger.debug("not enough audio to trim as a sentence")
if self.buffer_trimming_way == "segment": if self.buffer_trimming_way == "segment":
s = self.buffer_trimming_sec # trim the completed segments longer than s, s = self.buffer_trimming_sec # trim the completed segments longer than s,
else: else:
@ -286,7 +292,7 @@ class OnlineASRProcessor:
""" """
o = self.transcript_buffer.complete() o = self.transcript_buffer.complete()
f = self.to_flush(o) f = self.to_flush(o)
logger.debug(f"last, noncommited: {f}") logger.debug(f"last, noncommited: {f[0]*1000:.0f}-{f[1]*1000:.0f}: {f[2]}")
self.buffer_time_offset += len(self.audio_buffer) / 16000 self.buffer_time_offset += len(self.audio_buffer) / 16000
return f return f