第一章:Go+TensorFlo … Go+TensorFlow Lite端侧OCR集成实战:在安卓自动化中实时识别验证码/弹窗文本(模型量化后仅1.2MB)Read more
Go语言模型量化
Go调用ONNX Runtime的生产级封装(支持动态batch、量化模型与CUDA上下文复用)
第一章:Go调用ONNX Run … Go调用ONNX Runtime的生产级封装(支持动态batch、量化模型与CUDA上下文复用)Read more
从零部署LLM推理API,Go语言实操全链路:模型加载、量化、流式响应、GPU绑定,一步到位
第一章:从零部署LLM推理API … 从零部署LLM推理API,Go语言实操全链路:模型加载、量化、流式响应、GPU绑定,一步到位Read more
【Go视觉识别进阶必修课】:手写OCR引擎从模型量化、ONNX转换到低延迟C-API封装
第一章:Go视觉识别技术栈全景与 … 【Go视觉识别进阶必修课】:手写OCR引擎从模型量化、ONNX转换到低延迟C-API封装Read more
从BERT到Phi-3,Go语言模型加载器演进史(支持12种格式/7类量化/4级精度自动降级)
第一章:Go语言大模型加载器的演 … 从BERT到Phi-3,Go语言模型加载器演进史(支持12种格式/7类量化/4级精度自动降级)Read more
