AWS Textract OCR Data Extração de Dados
Budget: $30 – $250 USD
A ideia é criar uma API que eu possa enviar um documento em um formado Binario ou a URL de um documento em formato PDF, ou postar via um formulário. A parte do PHP iria usar o SDK da AWS e chamar o serviço da Amazon Textract para obter os dados em me retonar um Json estruturado.
Os dados precisam estar estruturados de acordo com o exemplo em anexo que foi gerado através do AWS Console Textract. Pequenas variações do documento podem ocorrer mas de maneira geral o documento é similar.
- O projeto irá rodar em PHP Linux Ubuntu
- Deverá ser utilizado o GITHUB para controle de versão do código
- O projeto só será pago se a funcionalidade estiver de acordo com o esperado: A extração dos dados devera ser de forma estruturada e organizada de forma que seja possível a utilização. A simples extração da informação de forma não estruturada não servirá.
Anexo também um exemplo do documento PDF que precisa ser extraido.
Os dados precisam estar estruturados de acordo com o exemplo em anexo que foi gerado através do AWS Console Textract. Pequenas variações do documento podem ocorrer mas de maneira geral o documento é similar.
- O projeto irá rodar em PHP Linux Ubuntu
- Deverá ser utilizado o GITHUB para controle de versão do código
- O projeto só será pago se a funcionalidade estiver de acordo com o esperado: A extração dos dados devera ser de forma estruturada e organizada de forma que seja possível a utilização. A simples extração da informação de forma não estruturada não servirá.
Anexo também um exemplo do documento PDF que precisa ser extraido.