第一章:从零手写Go版llama … 从零手写Go版llama.cpp:内存映射加载GGUF、量化算子内联汇编、AVX-512自动降级机制Read more
GGUF格式
GGUF格式模型在Go中运行的5大性能瓶颈:实测对比Llama.cpp与llm-go,附压测数据
第一章:GGUF格式模型在Go中 … GGUF格式模型在Go中运行的5大性能瓶颈:实测对比Llama.cpp与llm-go,附压测数据Read more
第一章:从零手写Go版llama … 从零手写Go版llama.cpp:内存映射加载GGUF、量化算子内联汇编、AVX-512自动降级机制Read more
第一章:GGUF格式模型在Go中 … GGUF格式模型在Go中运行的5大性能瓶颈:实测对比Llama.cpp与llm-go,附压测数据Read more