Token Classification
Transformers
Safetensors
PyTorch
Turkish
longformer
ner
pii
pii-detection
de-identification
privacy
healthcare
medical
clinical
phi
openmed
turkish
Instructions to use OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1 with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("token-classification", model="OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1")# pip install -U transformers accelerate # Load model directly from transformers import AutoTokenizer, AutoModelForTokenClassification tokenizer = AutoTokenizer.from_pretrained("OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1") model = AutoModelForTokenClassification.from_pretrained("OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1", device_map="auto") - Notebooks
- Google Colab
- Kaggle
Upload Turkish PII detection model OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1
6a5b1fe verified Download tokenizer_config.json from OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1: direct link, hf CLI and curl.
- Browser
- Download file 388 Bytes
-
https://huggingface.co/OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1/resolve/main/tokenizer_config.json
- Command line
-
hf download hf://OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1/tokenizer_config.json
-
curl -L -o tokenizer_config.json https://huggingface.co/OpenMed/OpenMed-PII-Turkish-ClinicalLongformer-Base-149M-v1/resolve/main/tokenizer_config.json
388 Bytes
| { | |
| "add_prefix_space": true, | |
| "backend": "tokenizers", | |
| "bos_token": "<s>", | |
| "cls_token": "<s>", | |
| "eos_token": "</s>", | |
| "errors": "replace", | |
| "is_local": false, | |
| "local_files_only": false, | |
| "mask_token": "<mask>", | |
| "model_max_length": 4096, | |
| "pad_token": "<pad>", | |
| "sep_token": "</s>", | |
| "tokenizer_class": "RobertaTokenizer", | |
| "trim_offsets": true, | |
| "unk_token": "<unk>" | |
| } | |