memra-engine v0.109.0 — From-scratch CUDA LLM inference engine for NVIDIA RTX 50-series (sm_120a) and Hopper (sm_90a) - custom kernels, no frameworks crates.io· crate · ▲ 0 points · Aug 23, 2026
0 comments
No comments yet.