estoy trabajando en este proyecto, la idea es que le des al programa una imagen y usando OCR en javascript, el programa detecte bien o (reconoca) una cadena o una palabra, por ejemplo ('رقم العداد') y copie el número o el entero después de la cadena con (espacios) como ==>>
7038842 رقم العدادy eso es todo, así que estoy usando Tesseract.js (Tesseract.recognize) para reconocer la cadena, pero al principio me encontré con un error
No atrapado (en promesa)
Error, así que después de andarme por las ramas resultó que el teseracto no pudo detectar algunas letras árabes tal como son, así que imprimo todo el texto detectado en la imagen y resultó que la cadena ['نقطة الخدمة'] se reconoce como [' ننطة الخدمة'] y ['رقم العداد'] como ['رم العداد'] así que usando
El método string.match para manipular y copiar el número después de la palabra para la que se dio el número ['رم العداد'] fue correcto y claro, pero !!! por alguna razón, el código no está copiando el número escrito después de la palabra ['ننطة الخدمة'] Traté de jugar agregando espacios y tabulaciones, pero se da el mismo problema, así que finalmente decidí pedir ayuda, entonces, ¿qué es? me falta
el código :-
<script> Tesseract.recognize( 'form.png', 'ara', { logger: m => console.log(m) } ).then(({ data: { text } }) => { console.log(text); const info = ['ننطة الخدمة','رم العداد','القراءة']; for(k=0;k<info.length;k++){ var result = text.match(new RegExp(info[0] + '\\s+(\\w+)'))[1]; /* info[0] the index of ['نقطة الخدمة']*/ alert(result); } }) </script>la imagen del proyecto:-