pagescan.scan_batch#

pagescan.scan_batch(input_dir, output_dir=None, config=None, workers=None)[source]#

Process all images in a directory.

Parameters:
  • input_dir (str) – Directory containing input images.

  • output_dir (str | None) – Directory for output PDFs. Defaults to input_dir.

  • config (ScanConfig | None) – Scan configuration.

  • workers (int | None) – Number of parallel workers. Default: min(4, cpu_count). Use 1 for sequential/debug mode.

Return type:

dict

Returns:

Dict with processed, failed, low_quality counts.