memra-engine 0.83.0

From-scratch CUDA LLM inference engine for NVIDIA RTX 50-series (sm_120a) and Hopper (sm_90a) - custom kernels, no frameworks
Documentation

memra engine: Stage-1 correctness-first forward-pass kernels + ops, on sm_120 via cudarc.