Lovableに関するニュースがまた一つ、とはいえ仕方ありません!
同社は現在、レイテンシに敏感なタスクをCerebrasの推論インフラへ移行しています。
このソリューションの中核にあるのはWafer-Scale Engineです。モデルの重みを1枚のウェハーチップ上に保存することで、従来のGPUシステムと比べて逐次的なトークン生成を高速化します。
LovableのCEOであるAnton Osika氏によると、これによりプラットフォームは「ユーザーが考えるのと同じ速さで応答」できるようになります。
両社はまた、より高速な推論によって実現可能になる新しいプロダクトシナリオを共同で研究することにも合意しました。