瀏覽代碼

removed useless parameter

master
Evgeniy Ierusalimov 5 天之前
父節點
當前提交
4325ccec9b
共有 2 個檔案被更改,包括 8 行新增20 行删除
  1. 0
    4
      README.md
  2. 8
    16
      src/image_ocr.py

+ 0
- 4
README.md 查看文件

@@ -80,7 +80,6 @@ python -m src.image_split -i scan.jpg --slice-auto
80 80
 | `--ocr-engine` | `paddle` или `surya` | `paddle` |
81 81
 | `--llm` | Локальный LLM-корректор (Qwen2.5-7B) | OFF |
82 82
 | `--vlm` | Vision LM корректор (Qwen3.8 Max, API) | OFF |
83
-| `--force-ocr` | Перераспознать даже при наличии `.json` | OFF |
84 83
 | `--pause` | Пауза между изображениями (сек) | 5 |
85 84
 | `--no-result-one-document` | Не объединять `.md` в один документ | — |
86 85
 | `--no-post-crop` | Не обрезать по контенту (Stage 1) | — |
@@ -93,9 +92,6 @@ python -m src.image_ocr -i page.jpg
93 92
 # Пакетный режим — все изображения в каталоге
94 93
 python -m src.image_ocr -i ./pages/ --ocr-engine surya
95 94
 
96
-# Принудительное перераспознавание
97
-python -m src.image_ocr -i ./pages/ --force-ocr
98
-
99 95
 # Без объединения в один документ
100 96
 python -m src.image_ocr -i ./pages/ --no-result-one-document
101 97
 

+ 8
- 16
src/image_ocr.py 查看文件

@@ -183,13 +183,6 @@ def image_to_latex(
183 183
             help="Не объединять .md результаты в один документ",
184 184
         ),
185 185
     ] = True,
186
-    force_ocr: Annotated[
187
-        bool,
188
-        typer.Option(
189
-            "--force-ocr",
190
-            help="Принудительно перераспознать все изображения, игнорируя уже существующие .json",
191
-        ),
192
-    ] = False,
193 186
     pause: Annotated[
194 187
         int,
195 188
         typer.Option(
@@ -215,15 +208,14 @@ def image_to_latex(
215 208
         out.mkdir(parents=True, exist_ok=True)
216 209
 
217 210
         skipped = 0
218
-        if not force_ocr:
219
-            filtered: list[Path] = []
220
-            for p in image_paths:
221
-                if (out / (p.stem + ".json")).exists():
222
-                    logger.info("Пропуск %s (уже есть .json)", p.name)
223
-                    skipped += 1
224
-                else:
225
-                    filtered.append(p)
226
-            image_paths = filtered
211
+        filtered: list[Path] = []
212
+        for p in image_paths:
213
+            if (out / (p.stem + ".json")).exists():
214
+                logger.info("Пропуск %s (уже есть .json)", p.name)
215
+                skipped += 1
216
+            else:
217
+                filtered.append(p)
218
+        image_paths = filtered
227 219
 
228 220
         if not image_paths:
229 221
             logger.info("Все изображения уже обработаны (пропущено %d)", skipped)

Loading…
取消
儲存