leejet/stable-diffusion.cpp
stable-diffusion.cpp 是一个基于 ggml、使用纯 C/C++ 实现的扩散模型(Diffusion model)推理引擎,支持 SD、Flux、Wan、Qwen Image、Z-Image 等众多图像/视频生成与编辑模型,工作方式类似 llama.cpp,并以超轻量、无外部依赖、跨平台多后端为特色。
GitHub查看原文 →
面向本地部署与推理加速的开源工具:leejet/stable-diffusion.cpp 基于 ggml 用纯 C/C++ 实现扩散模型推理引擎,支持 SD、Flux、Wan、Qwen Image、Z-Image 等图像/视频生成与编辑模型,轻量无依赖、跨平台多后端;NVIDIA/Model-Optimizer 是 NVIDIA 统一开源模型优化库,集成量化(PTQ/QAT)、剪枝、蒸馏、NAS、投机解码与稀疏化,将 Hugging Face/PyTorch/ONNX 模型压缩导出至 TensorRT-LLM、vLLM、SGLang 等框架加速推理。
stable-diffusion.cpp 是一个基于 ggml、使用纯 C/C++ 实现的扩散模型(Diffusion model)推理引擎,支持 SD、Flux、Wan、Qwen Image、Z-Image 等众多图像/视频生成与编辑模型,工作方式类似 llama.cpp,并以超轻量、无外部依赖、跨平台多后端为特色。
NVIDIA Model Optimizer 是 NVIDIA 推出的统一开源模型优化库,集成量化、剪枝、神经架构搜索、蒸馏、投机解码和稀疏化等 SOTA 技术,可将 Hugging Face、PyTorch 或 ONNX 模型压缩并导出为优化检查点,无缝部署到 TensorRT-LLM、TensorRT、vLLM、SGLang 等推理框架以加速推理。