enum_class.py
2.44 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
class BlockType:
IMAGE = 'image'
TABLE = 'table'
IMAGE_BODY = 'image_body'
TABLE_BODY = 'table_body'
IMAGE_CAPTION = 'image_caption'
TABLE_CAPTION = 'table_caption'
IMAGE_FOOTNOTE = 'image_footnote'
TABLE_FOOTNOTE = 'table_footnote'
TEXT = 'text'
TITLE = 'title'
INTERLINE_EQUATION = 'interline_equation'
LIST = 'list'
INDEX = 'index'
DISCARDED = 'discarded'
# Added in vlm 2.5
CODE = "code"
CODE_BODY = "code_body"
CODE_CAPTION = "code_caption"
ALGORITHM = "algorithm"
REF_TEXT = "ref_text"
PHONETIC = "phonetic"
HEADER = "header"
FOOTER = "footer"
PAGE_NUMBER = "page_number"
ASIDE_TEXT = "aside_text"
PAGE_FOOTNOTE = "page_footnote"
class ContentType:
IMAGE = 'image'
TABLE = 'table'
TEXT = 'text'
INTERLINE_EQUATION = 'interline_equation'
INLINE_EQUATION = 'inline_equation'
EQUATION = 'equation'
CODE = 'code'
class CategoryId:
Title = 0
Text = 1
Abandon = 2
ImageBody = 3
ImageCaption = 4
TableBody = 5
TableCaption = 6
TableFootnote = 7
InterlineEquation_Layout = 8
InterlineEquationNumber_Layout = 9
InlineEquation = 13
InterlineEquation_YOLO = 14
OcrText = 15
LowScoreText = 16
ImageFootnote = 101
class MakeMode:
MM_MD = 'mm_markdown'
NLP_MD = 'nlp_markdown'
CONTENT_LIST = 'content_list'
class ModelPath:
vlm_root_hf = "opendatalab/MinerU2.5-2509-1.2B"
vlm_root_modelscope = "OpenDataLab/MinerU2.5-2509-1.2B"
pipeline_root_modelscope = "OpenDataLab/PDF-Extract-Kit-1.0"
pipeline_root_hf = "opendatalab/PDF-Extract-Kit-1.0"
doclayout_yolo = "models/Layout/YOLO/doclayout_yolo_docstructbench_imgsz1280_2501.pt"
yolo_v8_mfd = "models/MFD/YOLO/yolo_v8_ft.pt"
unimernet_small = "models/MFR/unimernet_hf_small_2503"
pp_formulanet_plus_m = "models/MFR/pp_formulanet_plus_m"
pytorch_paddle = "models/OCR/paddleocr_torch"
layout_reader = "models/ReadingOrder/layout_reader"
slanet_plus = "models/TabRec/SlanetPlus/slanet-plus.onnx"
unet_structure = "models/TabRec/UnetStructure/unet.onnx"
paddle_table_cls = "models/TabCls/paddle_table_cls/PP-LCNet_x1_0_table_cls.onnx"
paddle_orientation_classification = "models/OriCls/paddle_orientation_classification/PP-LCNet_x1_0_doc_ori.onnx"
class SplitFlag:
CROSS_PAGE = 'cross_page'
LINES_DELETED = 'lines_deleted'
class ImageType:
PIL = 'pil_img'
BASE64 = 'base64_img'