Containerized LLM inference toolboxes for developers on AMD Strix Halo hardware, tracking versioned releases and supporting both single-machine deployment and multi-node inference clusters.