Fix: Use Fast Tokenizer instead of Slow Tokenizer, which makes validation very slow

This commit is contained in:
tsukumi
2024-12-19 13:41:09 +09:00
parent ebd249bca8
commit e1ce12a336

View File

@@ -265,6 +265,9 @@ if __name__ == "__main__":
res = torch.cat(res["hidden_states"][-3:-2], -1)[0].cpu() res = torch.cat(res["hidden_states"][-3:-2], -1)[0].cpu()
return res return res
# 再度 Fast Tokenizer でロード
tokenizer = bert_models.load_tokenizer(language)
# ONNX 変換用の BERT モデルをロード # ONNX 変換用の BERT モデルをロード
model = ONNXBert() model = ONNXBert()
inputs = tokenizer("今日はいい天気ですね", return_tensors="pt") inputs = tokenizer("今日はいい天気ですね", return_tensors="pt")