memra-engine v0.123.0 — From-scratch CUDA LLM inference engine for NVIDIA RTX 50-series (sm_120a) and Hopper (sm_90a) - custom kernels, no frameworks crates.io· crate · ▲ 0 points · Sep 1, 2026
0 comments
No comments yet.