Commit Graph

12 Commits

Author SHA1 Message Date
tsukumi
08c439e88e Refactor: Use I/O Binding during BERT inference and always release memory after inference 2024-12-22 06:49:43 +09:00
tsukumi
d397a58874 Fix: errors during ONNX CPU inference 2024-10-06 16:18:21 +09:00
tsukumi
c4b6c169fc Fix: Inference failure with some ExecutionProviders
length_scale, etc. were passed as one-dimensional arrays when they should have been passed as scalar values.
2024-09-28 17:36:26 +09:00
tsukumi
e91b69862c Fix: ONNX inference with DirectML fails 2024-09-23 15:06:19 +09:00
tsukumi
758696c59c Fix: Device ID specified in ExecutionProvider options is respected when moving input tensors 2024-09-23 12:57:14 +09:00
tsukumi
2cdb5844cb Fix: ONNX inference fails in Windows environments
ref: https://qiita.com/gomasa/items/f6337087988685d00ebb
2024-09-23 11:55:50 +09:00
tsukumi
db0acd7b5f Add: Support for ONNX inference and ONNX conversion of Non-JP-Extra models 2024-09-23 05:59:12 +09:00
tsukumi
291e635e9e Improve: ONNX conversion logic improved, and support for noise_scale(_w) model argument 2024-09-22 16:14:25 +09:00
tsukumi
327e038977 Improve: I/O binding during ONNX inference
I honestly don't see a big difference...
2024-09-18 04:49:56 +09:00
tsukumi
5e2c83c6c7 Improve: Support ONNX inference, add ONNX conversion script 2024-09-17 16:55:03 +09:00
tsukumi
ebd4551d1e Add: Preparation for ONNX inference support ③ 2024-09-17 09:16:16 +09:00
tsukumi
b9fdeb4492 Add: Preparation for ONNX inference support ② 2024-09-17 09:02:14 +09:00