from datasets import load_dataset with open("calibration_data.txt", "w", encoding="utf-8") as f: ds = load_dataset("Salesforce/wikitext", "wikitext-2-raw-v1", split="train") for ex in ds: f.write(ex["text"])