Provides an on-device large model inference runtime for Snapdragon platforms, supporting NPU, GPU, and CPU execution through cross-platform SDKs and OpenAI-like service interfaces.