@@ -20,7 +20,9 @@ def __init__(self) -> None:
2020 )
2121
2222 self .tokenizer = AutoTokenizer .from_pretrained (_MODEL_NAME )
23- self .model_for_masked_lm = AutoModelForMaskedLM .from_pretrained (_MODEL_NAME )
23+ self .model_for_masked_lm = AutoModelForMaskedLM .from_pretrained (
24+ _MODEL_NAME
25+ )
2426 self .model = pipeline (
2527 "fill-mask" ,
2628 tokenizer = self .tokenizer ,
@@ -53,7 +55,9 @@ def generate(
5355
5456 return gen_txt
5557
56- def augment (self , text : str , num_augs : int = 3 , sample : bool = False ) -> list [str ]:
58+ def augment (
59+ self , text : str , num_augs : int = 3 , sample : bool = False
60+ ) -> list [str ]:
5761 """Text augmentation from PhayaThaiBERT
5862
5963 :param str text: Thai text
@@ -87,7 +91,9 @@ def augment(self, text: str, num_augs: int = 3, sample: bool = False) -> list[st
8791 if num_augs <= MAX_NUM_AUGS :
8892 for rank in range (num_augs ):
8993 gen_text = self .generate (text , rank , sample = sample )
90- processed_text = re .sub ("<_>" , " " , self .processor .preprocess (gen_text ))
94+ processed_text = re .sub (
95+ "<_>" , " " , self .processor .preprocess (gen_text )
96+ )
9197 augment_list .append (processed_text )
9298 else :
9399 raise ValueError (
0 commit comments