Otra noticia sobre Lovable, ¡pero qué se le va a hacer!
Ahora la compañía está trasladando las tareas sensibles a la latencia a la infraestructura de inferencia de Cerebras.
La solución se basa en Wafer-Scale Engine: los pesos del modelo se almacenan en un único chip-oblea, lo que acelera la generación secuencial de tokens frente a los sistemas GPU clásicos.
Según Anton Osika, CEO de Lovable, esto permite que la plataforma «responda tan rápido como piensan los usuarios».
Las compañías también acordaron investigar conjuntamente nuevos escenarios de producto que se vuelven posibles gracias a una inferencia más rápida.