Native MLX runtime for Laya typed decision models — 7–14 ms short decisions on M3 Max. No text generation, PyTorch, or cloud API.
Python6,440 stars504 forksApache-2.0 apple-silicondecision-modelinferencelayalocal-aimachine-learningmlxmodernbertsystem-onetyped-decisions