CUDA coding assistant for 16 GB NVIDIA GPUs, with reproducible model compression and local evaluation.
python cuda nvidia lora quantization ai-agents model-compression wsl2 coding-assistant llm llama-cpp local-llm qlora qwen recursive-language-models autoresearch cpu-offloading multilingual-code multipl-e
-
Updated
Oct 5, 2026 - Python