J
jeremy
7 minutes
Pick between a frontier, balanced, and fast model tier by weighing task difficulty, latency budget, and cost per token, instead of defaulting to the largest model available.