|
|
@@ -80,7 +80,6 @@ python -m src.image_split -i scan.jpg --slice-auto
|
|
80
|
80
|
| `--ocr-engine` | `paddle` или `surya` | `paddle` |
|
|
81
|
81
|
| `--llm` | Локальный LLM-корректор (Qwen2.5-7B) | OFF |
|
|
82
|
82
|
| `--vlm` | Vision LM корректор (Qwen3.8 Max, API) | OFF |
|
|
83
|
|
-| `--force-ocr` | Перераспознать даже при наличии `.json` | OFF |
|
|
84
|
83
|
| `--pause` | Пауза между изображениями (сек) | 5 |
|
|
85
|
84
|
| `--no-result-one-document` | Не объединять `.md` в один документ | — |
|
|
86
|
85
|
| `--no-post-crop` | Не обрезать по контенту (Stage 1) | — |
|
|
|
@@ -93,9 +92,6 @@ python -m src.image_ocr -i page.jpg
|
|
93
|
92
|
# Пакетный режим — все изображения в каталоге
|
|
94
|
93
|
python -m src.image_ocr -i ./pages/ --ocr-engine surya
|
|
95
|
94
|
|
|
96
|
|
-# Принудительное перераспознавание
|
|
97
|
|
-python -m src.image_ocr -i ./pages/ --force-ocr
|
|
98
|
|
-
|
|
99
|
95
|
# Без объединения в один документ
|
|
100
|
96
|
python -m src.image_ocr -i ./pages/ --no-result-one-document
|
|
101
|
97
|
|