Spaces:
Runtime error
Runtime error
Add application file
Browse files
app.py
CHANGED
|
@@ -26,20 +26,11 @@ features = Features({
|
|
| 26 |
})
|
| 27 |
|
| 28 |
def load_data():
|
| 29 |
-
|
| 30 |
-
dataset = load_dataset(DATASET_NAME, token=HF_TOKEN)['train']
|
| 31 |
-
except:
|
| 32 |
-
# Create empty dataset if not found
|
| 33 |
-
dataset = Dataset.from_dict({
|
| 34 |
-
'comment_id': [],
|
| 35 |
-
'generated_text': [],
|
| 36 |
-
'manual_annotation': []
|
| 37 |
-
}, features=features)
|
| 38 |
-
|
| 39 |
df = dataset.to_pandas().set_index('comment_id', drop=False)
|
| 40 |
|
| 41 |
# Find unannotated comments using index
|
| 42 |
-
unannotated = df[df['manual_annotation']
|
| 43 |
|
| 44 |
return {
|
| 45 |
"original_dataset": dataset,
|
|
|
|
| 26 |
})
|
| 27 |
|
| 28 |
def load_data():
|
| 29 |
+
dataset = load_dataset(DATASET_NAME, token=HF_TOKEN)['train']
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 30 |
df = dataset.to_pandas().set_index('comment_id', drop=False)
|
| 31 |
|
| 32 |
# Find unannotated comments using index
|
| 33 |
+
unannotated = df[df['manual_annotation'] == ""].index.tolist()
|
| 34 |
|
| 35 |
return {
|
| 36 |
"original_dataset": dataset,
|