Portable native inference stack for Mage-Flow-Turbo using stable-diffusion.cpp/sd-cli, Q8_0 DiT GGUF, Qwen3-VL-4B Q4_K_M and a dedicated VAE, with CPU/CUDA backends, CLI, REST API, model verification and Kaggle integration.
rest-api cuda kaggle image-generation quantization text-to-image nvidia-cuda cpu-inference generative-ai safetensors gguf stable-diffusion-cpp qwen3-vl native-inference q8-0 mage-flow mage-flow-turbo qwen3-vl-4b q4-k-m reproducible-inference
-
Updated
Sep 11, 2026 - Python