Text Classification
Transformers
Safetensors
Japanese
modernbert
feature-extraction
line-classification
japanese
corpus-cleaning
custom_code
text-embeddings-inference
Instructions to use KeisukeMiyamoto/corpus-refiner-jp with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use KeisukeMiyamoto/corpus-refiner-jp with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("text-classification", model="KeisukeMiyamoto/corpus-refiner-jp", trust_remote_code=True)# Load model directly from transformers import AutoTokenizer, AutoModel tokenizer = AutoTokenizer.from_pretrained("KeisukeMiyamoto/corpus-refiner-jp", trust_remote_code=True) model = AutoModel.from_pretrained("KeisukeMiyamoto/corpus-refiner-jp", trust_remote_code=True, device_map="auto") - Notebooks
- Google Colab
- Kaggle
File too large to display, you can check the raw version instead.