Merge pull request #22 from Tiger14n/patch-1

fix language transcribe selection
This commit is contained in:
litagin02
2024-01-10 17:41:04 +09:00
committed by GitHub

View File

@@ -66,17 +66,17 @@ if __name__ == "__main__":
os.rename(output_file, output_file + ".bak") os.rename(output_file, output_file + ".bak")
if language == "ja": if language == "ja":
language = Languages.JP language_id = Languages.JP
elif language == "en": elif language == "en":
language = Languages.EN language_id = Languages.EN
elif language == "zh": elif language == "zh":
language = Languages.ZH language_id = Languages.ZH
else: else:
raise ValueError(f"{language} is not supported.") raise ValueError(f"{language} is not supported.")
with open(output_file, "w", encoding="utf-8") as f: with open(output_file, "w", encoding="utf-8") as f:
for wav_file in tqdm(wav_files, file=SAFE_STDOUT): for wav_file in tqdm(wav_files, file=SAFE_STDOUT):
file_name = os.path.basename(wav_file) file_name = os.path.basename(wav_file)
text = transcribe(wav_file, initial_prompt=initial_prompt) text = transcribe(wav_file, initial_prompt=initial_prompt, language=language)
f.write(f"{file_name}|{speaker_name}|{language}|{text}\n") f.write(f"{file_name}|{speaker_name}|{language_id}|{text}\n")
f.flush() f.flush()
sys.exit(0) sys.exit(0)