第一章:Go调用ONNX不支持动 … Go调用ONNX不支持动态shape?——手写TensorShape推导引擎,300行代码破解限制Read more
动态shape调度
Go语言大模型批量推理优化:batch padding对齐、动态shape调度与显存复用3大突破
第一章:Go语言大模型批量推理优 … Go语言大模型批量推理优化:batch padding对齐、动态shape调度与显存复用3大突破Read more
第一章:Go调用ONNX不支持动 … Go调用ONNX不支持动态shape?——手写TensorShape推导引擎,300行代码破解限制Read more
第一章:Go语言大模型批量推理优 … Go语言大模型批量推理优化:batch padding对齐、动态shape调度与显存复用3大突破Read more