Skip to content

Integration test: AI service OCR regression harness on multiple languages #278

Description

@kilodesodiq-arch

Problem Statement. regression_harness/evaluator.py runs against
regression_harness/dataset/ground_truth.json but a single language is supported.

Technical Context.
app/ai-service/regression_harness/.

Expected Outcome. Add Spanish + Arabic datasets, asserting OCR tolerance ≥ 0.7.

Acceptance Criteria.

  • CI runs the harness on both languages.

Files or modules likely to be affected.
new app/ai-service/regression_harness/dataset/{es,ar}/ground_truth.json,
cli.py.

Difficulty. Medium
Estimated effort. M



Backlog item #70 from `docs/maintainer-issue-backlog.md.

Metadata

Metadata

Assignees

Labels

Type

No type

Projects

No projects

Milestone

No milestone

Relationships

None yet

Development

No branches or pull requests

Issue actions