memra-engine v0.137.0 — From-scratch CUDA LLM inference engine for NVIDIA RTX 50-series (sm_120a) and Hopper (sm_90a) - custom kernels, no frameworks crates.io· crate · ▲ 0 points · Sep 9, 2026
0 comments
No comments yet.