An open-source LLM router and cost optimizer that automatically sends simple prompts to cheap or local models and complex ones to premium models via an OpenAI-compatible proxy.