跳到正文
原文
Replicate Blog·· 2025-09-08AI 评分57

Replicate 缓存 torch.compile 产物加速 FLUX 模型启动

Torch compile caching for inference speed

AI 导读

Replicate 现在缓存 torch.compile 产物来减少 PyTorch 模型的启动时间。

来源:Replicate Blog · replicate.com