8. Real-time Audio DSP & Mel-Spectrogram Center
Executes 1D convolution, Short-Time Fourier Transform (STFT), and 64-band Mel-Filterbank tensor transforms on live audio at 60fps.
Signal Source & Filter Mode
Multimodal Tensor Foundation:
Feeds directly into Whisper / Conformer / Speech Recognition encoder layers via WebGPU.
Feeds directly into Whisper / Conformer / Speech Recognition encoder layers via WebGPU.