Por qué descontinuamos nuestro LLM router en Manifest
Everyone is building LLM routers, we deprecated ours

Tras cuatro meses de uso con 7000 usuarios en la nube, decidimos eliminar nuestro LLM router. Descubrimos que la complejidad no se deduce solo del prompt, el cache es más efectivo para reducir costos y la rotación de modelos rompe la consistencia del comportamiento. En la mayoría de los casos, mantener un modelo único y probado es la mejor estrategia.
La cantidad ahorrada se paga en otro lugar, y ese costo es más difícil de estimar.