# Decisoes tecnicas

## 2026-08-25 — modelo congelado e separacao do Sabichao

- Nao ha treino de pesos. A afinacao e feita por prompts, variantes de imagem, parsers e validacao.
- A API corre no PC da RTX; o Sabichao continua responsavel por processo, classificacao, parsing,
  checksums, merge, corpus e formulario.
- A indisponibilidade da VLM nunca bloqueia uma admissao: o cliente DEV cai para Tesseract.
- O benchmark VLM nao pode contar execucoes em que tenha ocorrido fallback.
- A versao permanece `3.0.0-dev` ate superar o Tesseract em erros, vazios, media e p95.

## 2026-08-25 — PaddleOCR-VL escolhido como modelo definitivo

- O modelo da `3.0.0-dev` e `AuditAid/PaddleOCR-VL-1.6-0.9B:latest`, blob Ollama
  `71306567488b`. Nao actualizar o blob durante a afinacao.
- A partir desta decisao so se trabalha sobre modelos especializados em OCR. Qwen3-VL e Qwen3.5
  ficam fora do ambito; os seus ensaios permanecem documentados apenas como historico.
- GLM-OCR foi rejeitado por lacunas de campos e latencia extrema. Nao e fallback nem motor hibrido.
- O modelo fica congelado; a melhoria faz-se por prompts de transcricao, recortes, variantes de
  imagem, parsers e validacoes deterministicas, sempre sem adivinhar valores.
