from datasets import load_dataset from IPython.display import Audio # 1. Load the dataset in 'streaming' mode # Configuration 'fil_ph' is for Filipino (Tagalog) dataset = load_dataset("google/fleurs", "fil_ph", split="train", streaming=True, trust_remote_code=True) # 2. Grab just the first sample sample = next(iter(dataset)) # 3. View the metadata print(f"Transcription: {sample['transcription']}") print(f"Sampling Rate: {sample['audio']['sampling_rate']}") # 4. Listen to the audio (if in a Jupyter/Colab notebook) Audio(sample["audio"]["array"], rate=sample["audio"]["sampling_rate"])