from pathlib import Path import torch import torchaudio from torchaudio.compliance.kaldi import fbank from transformers import ProcessorMixin from transformers.feature_extraction_utils import BatchFeature class SalmonnProcessor(ProcessorMixin): """Prepare text, audio, and contextual examples for SALMONN-2 inference.""" attributes = ["tokenizer"] tokenizer_class = ("Qwen2Tokenizer", "Qwen2TokenizerFast") audio_placeholder = "