Mais uma notícia sobre a Lovable, mas fazer o quê!
Agora, a empresa está transferindo tarefas sensíveis à latência para a infraestrutura de inferência da Cerebras.
No centro da solução está o Wafer-Scale Engine: os pesos do modelo são armazenados em um único chip-wafer, o que acelera a geração sequencial de tokens em comparação com sistemas GPU clássicos.
Segundo Anton Osika, CEO da Lovable, isso permite que a plataforma «responda tão rápido quanto os usuários pensam».
As empresas também concordaram em pesquisar conjuntamente novos cenários de produto que se tornam possíveis com uma inferência mais rápida.