Skip to content

Commit 1236835

Browse files
dolfim-ibmcau-git
andauthored
fix: enable typing (#4)
* enable typing Signed-off-by: Michele Dolfi <dol@zurich.ibm.com> * Address mypy errors Signed-off-by: Christoph Auer <cau@zurich.ibm.com> --------- Signed-off-by: Michele Dolfi <dol@zurich.ibm.com> Signed-off-by: Christoph Auer <cau@zurich.ibm.com> Co-authored-by: Christoph Auer <cau@zurich.ibm.com>
1 parent 5e44906 commit 1236835

3 files changed

Lines changed: 10 additions & 11 deletions

File tree

docling_cvat_tools/cvat_tools/cvat_to_docling.py

Lines changed: 10 additions & 9 deletions
Original file line numberDiff line numberDiff line change
@@ -953,7 +953,7 @@ def _find_group_id_for_element(self, element: CVATElement) -> Optional[int]:
953953

954954
def _prune_empty_groups(self) -> None:
955955
"""Remove group containers that ended up without children."""
956-
empty_groups: List[GroupItem] = []
956+
empty_groups: List[NodeItem] = []
957957

958958
for item, _ in self.doc.iterate_items(with_groups=True):
959959
if (
@@ -2428,8 +2428,9 @@ def load_document_pages(
24282428

24292429
if has_text and has_good_quality and native_seg_page is not None:
24302430
# Use native text layer
2431-
seg_page = scale_segmented_pdf_page(native_seg_page, cvat_input_scale)
2432-
segmented_pages[page_no] = seg_page
2431+
segmented_pages[page_no] = scale_segmented_pdf_page(
2432+
native_seg_page, cvat_input_scale
2433+
)
24332434
else:
24342435
# Fallback to OCR
24352436
if not has_text:
@@ -2442,13 +2443,13 @@ def load_document_pages(
24422443
if ocr_image is not None and page_image is not None:
24432444
ensure_ocr_image_within_limit(ocr_image, input_path.name, page_no)
24442445
coord_scale = cvat_input_scale / ocr_scale
2445-
seg_page = create_segmented_page_from_ocr(
2446+
ocr_seg_page = create_segmented_page_from_ocr(
24462447
ocr_image,
24472448
coordinate_scale=coord_scale,
24482449
target_width=page_image.width,
24492450
target_height=page_image.height,
24502451
)
2451-
segmented_pages[page_no] = seg_page
2452+
segmented_pages[page_no] = ocr_seg_page
24522453
ocr_pages.add(page_no)
24532454

24542455
if page_image is not None:
@@ -2502,13 +2503,13 @@ def load_document_pages(
25022503
ensure_ocr_image_within_limit(ocr_image, input_path.name, page_no)
25032504
# Map OCR coordinates from ocr_scale to cvat_input_scale
25042505
coord_scale = cvat_input_scale / ocr_scale
2505-
seg_page = create_segmented_page_from_ocr(
2506+
ocr_seg_page = create_segmented_page_from_ocr(
25062507
ocr_image,
25072508
coordinate_scale=coord_scale,
25082509
target_width=cvat_image.width,
25092510
target_height=cvat_image.height,
25102511
)
2511-
segmented_pages[page_no] = seg_page
2512+
segmented_pages[page_no] = ocr_seg_page
25122513
page_images[page_no] = cvat_image
25132514
ocr_pages.add(page_no)
25142515

@@ -2521,9 +2522,9 @@ def load_document_pages(
25212522
image = PILImage.open(input_path)
25222523
page_no = page_numbers[0] if page_numbers else 1
25232524
ensure_ocr_image_within_limit(image, input_path.name, page_no)
2524-
seg_page = create_segmented_page_from_ocr(image)
2525+
ocr_seg_page = create_segmented_page_from_ocr(image)
25252526

2526-
segmented_pages[page_no] = seg_page
2527+
segmented_pages[page_no] = ocr_seg_page
25272528
page_images[page_no] = image
25282529
ocr_pages.add(page_no)
25292530

docling_cvat_tools/py.typed

Whitespace-only changes.

pyproject.toml

Lines changed: 0 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -99,8 +99,6 @@ exclude = '^\\.venv/'
9999

100100
[[tool.mypy.overrides]]
101101
module = [
102-
"docling_core.*",
103-
"docling.*",
104102
"cvat_sdk.*",
105103
"lxml.*",
106104
"PIL.*",

0 commit comments

Comments
 (0)