大模型推理性能测试
飞桨golang工程化实践:从单机推理到K8s Operator编排的6阶段演进路径
第一章:飞桨golang工程化实 … 飞桨golang工程化实践:从单机推理到K8s Operator编排的6阶段演进路径Read more
Go语言调用ONNX Runtime的终极姿势:零拷贝内存共享实现(实测吞吐提升4.2倍)
第一章:Go语言可以搞AI Go … Go语言调用ONNX Runtime的终极姿势:零拷贝内存共享实现(实测吞吐提升4.2倍)Read more
【权威认证】eBPF+Go实现AI服务实时可观测性:捕获每个HTTP请求的模型推理耗时与显存占用
第一章:eBPF+Go构建AI服 … 【权威认证】eBPF+Go实现AI服务实时可观测性:捕获每个HTTP请求的模型推理耗时与显存占用Read more
