¿Qué hace esta skill?
La Optimización de Costes para LLM Skill proporciona una arquitectura componible para controlar y reducir el gasto en APIs de LLM sin sacrificar la calidad de las respuestas. Combina enrutamiento inteligente de modelos según la complejidad de la tarea, un rastreador de costes inmutable, reintentos selectivos ante errores transitorios y caché de prompts para minimizar latencia y coste por token en iteraciones repetidas.