Skip to content

Commit d7b35e0

Browse files
author
mykola
committed
Added docstrings for some transformers
1 parent ed24791 commit d7b35e0

6 files changed

Lines changed: 39 additions & 2 deletions

File tree

scaledp/image/ImageCropBoxes.py

Lines changed: 10 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -59,6 +59,7 @@ class ImageCropBoxes(
5959
"Padding.",
6060
typeConverter=TypeConverters.toInt,
6161
)
62+
6263
noCrop = Param(
6364
Params._dummy(),
6465
"noCrop",
@@ -73,6 +74,13 @@ class ImageCropBoxes(
7374
typeConverter=TypeConverters.toInt,
7475
)
7576

77+
autoRotate = Param(
78+
Params._dummy(),
79+
"autoRotate",
80+
"Auto rotate cropped image if box height > box width.",
81+
typeConverter=TypeConverters.toBoolean,
82+
)
83+
7684
defaultParams = MappingProxyType(
7785
{
7886
"inputCols": ["image", "boxes"],
@@ -85,6 +93,7 @@ class ImageCropBoxes(
8593
"propagateError": False,
8694
"noCrop": True,
8795
"limit": 0,
96+
"autoRotate": True,
8897
},
8998
)
9099

@@ -115,7 +124,7 @@ def transform_udf(self, image, data):
115124
box = b
116125
if not isinstance(box, Box):
117126
box = Box(**box.asDict())
118-
if box.width < box.height:
127+
if self.getAutoRotate() and box.width < box.height:
119128
cropped_image = img.crop(box.bbox(self.getPadding())).rotate(
120129
-90,
121130
expand=True,

scaledp/models/detectors/BaseDetector.py

Lines changed: 7 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -75,6 +75,7 @@ def get_params(self):
7575
return json.dumps({k.name: v for k, v in self.extractParamMap().items()})
7676

7777
def outputSchema(self):
78+
"""Output schema of the detector."""
7879
return StructType(
7980
[
8081
StructField("path", StringType(), True),
@@ -92,6 +93,9 @@ def outputSchema(self):
9293
)
9394

9495
def transform_udf(self, image, params=None):
96+
"""
97+
Run detector on a single image.
98+
"""
9599
logging.info("Run Detector")
96100
if params is None:
97101
params = self.get_params()
@@ -147,6 +151,9 @@ def transform_udf_pandas(
147151
images: pd.DataFrame,
148152
params: pd.Series,
149153
) -> pd.DataFrame:
154+
"""
155+
Run detector on a batch of images.
156+
"""
150157
params = json.loads(params[0])
151158
resized_images = []
152159
for _index, img in images.iterrows():

scaledp/models/detectors/CraftTextDetector.py

Lines changed: 2 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -12,6 +12,8 @@
1212

1313

1414
class CraftTextDetector(BaseDetector, HasDevice, HasBatchSize):
15+
"""CRAFT text detector."""
16+
1517
_craft_net = None
1618
_refine_net = None
1719

scaledp/models/detectors/YoloOnnxTextDetector.py

Lines changed: 2 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -17,6 +17,8 @@
1717

1818

1919
class YoloOnnxTextDetector(BaseDetector, HasDevice, HasBatchSize):
20+
"""YOLO ONNX text detector."""
21+
2022
_model = None
2123

2224
task = Param(
Lines changed: 17 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -0,0 +1,17 @@
1+
from scaledp.models.detectors.BaseDetector import BaseDetector
2+
from scaledp.models.detectors.CraftTextDetector import CraftTextDetector
3+
from scaledp.models.detectors.DBNetOnnxDetector import DBNetOnnxDetector
4+
from scaledp.models.detectors.FaceDetector import FaceDetector
5+
from scaledp.models.detectors.SignatureDetector import SignatureDetector
6+
from scaledp.models.detectors.YoloOnnxDetector import YoloOnnxDetector
7+
from scaledp.models.detectors.YoloOnnxTextDetector import YoloOnnxTextDetector
8+
9+
__all__ = [
10+
"FaceDetector",
11+
"SignatureDetector",
12+
"YoloOnnxDetector",
13+
"BaseDetector",
14+
"DBNetOnnxDetector",
15+
"CraftTextDetector",
16+
"YoloOnnxTextDetector",
17+
]

scaledp/pdf/PdfDataToSingleImage.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -65,7 +65,7 @@ def process(self, input, path, resolution=0):
6565
except Exception:
6666
return Image(
6767
path,
68-
exception="Error in extration of image from pdf document",
68+
exception="Error in extraction of image from pdf document",
6969
)
7070

7171
def getPageNumber(self):

0 commit comments

Comments
 (0)