daKhosa commited on
Commit
0b97720
·
1 Parent(s): 0a04b27

Defer LTX model loading to GPU worker

Browse files
Files changed (1) hide show
  1. app.py +1 -20
app.py CHANGED
@@ -242,26 +242,7 @@ pipeline = DistilledPipeline(
242
  quantization=QuantizationPolicy.fp8_cast(),
243
  )
244
 
245
- print("[startup] Preloading LTX models")
246
- ledger = pipeline.model_ledger
247
- _transformer = ledger.transformer()
248
- _video_encoder = ledger.video_encoder()
249
- _video_decoder = ledger.video_decoder()
250
- _audio_decoder = ledger.audio_decoder()
251
- _vocoder = ledger.vocoder()
252
- _spatial_upsampler = ledger.spatial_upsampler()
253
- _text_encoder = ledger.text_encoder()
254
- _embeddings_processor = ledger.gemma_embeddings_processor()
255
-
256
- ledger.transformer = lambda: _transformer
257
- ledger.video_encoder = lambda: _video_encoder
258
- ledger.video_decoder = lambda: _video_decoder
259
- ledger.audio_decoder = lambda: _audio_decoder
260
- ledger.vocoder = lambda: _vocoder
261
- ledger.spatial_upsampler = lambda: _spatial_upsampler
262
- ledger.text_encoder = lambda: _text_encoder
263
- ledger.gemma_embeddings_processor = lambda: _embeddings_processor
264
- print("[startup] LTX pipeline ready")
265
 
266
 
267
  def log_memory(tag):
 
242
  quantization=QuantizationPolicy.fp8_cast(),
243
  )
244
 
245
+ print("[startup] LTX assets ready; model loading is deferred to the GPU worker")
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
246
 
247
 
248
  def log_memory(tag):