Exosfeer commited on
Commit
e09b7e0
·
1 Parent(s): 9749f8a

Fix AudioProcessor init: use target_sample_rate kwarg and Audio object for waveform_to_mel

Browse files
packages/ltx-pipelines/src/ltx_pipelines/distilled.py CHANGED
@@ -204,13 +204,14 @@ class DistilledPipeline:
204
 
205
  # Waveform -> Mel spectrogram
206
  audio_processor = AudioProcessor(
207
- sample_rate=target_sr,
208
  mel_bins=mel_bins,
209
  mel_hop_length=mel_hop,
210
  n_fft=n_fft,
211
  ).to(waveform.device)
212
 
213
- mel = audio_processor.waveform_to_mel(waveform, target_sr)
 
214
 
215
  # Mel -> latent (run encoder on its own device/dtype)
216
  audio_params = next(audio_encoder.parameters(), None)
 
204
 
205
  # Waveform -> Mel spectrogram
206
  audio_processor = AudioProcessor(
207
+ target_sample_rate=target_sr,
208
  mel_bins=mel_bins,
209
  mel_hop_length=mel_hop,
210
  n_fft=n_fft,
211
  ).to(waveform.device)
212
 
213
+ audio_obj = Audio(waveform=waveform, sampling_rate=target_sr)
214
+ mel = audio_processor.waveform_to_mel(audio_obj)
215
 
216
  # Mel -> latent (run encoder on its own device/dtype)
217
  audio_params = next(audio_encoder.parameters(), None)