Estoy trabajando en este script que usa la biblioteca OCR para leer una imagen y luego alertar al texto coincidente usando el método (text.match), así que este es el código:
function readfile() { Tesseract.recognize( 'form.png', 'ara', { logger: m => console.log(m) } ).then(({ data: { text } }) => { console.log(text); /* this line here */ const info = ['نقطة الخدمة','رقم العداد','القراءة']; for(k=0;k<info.length;k++){ var result = text.match(new RegExp(info[k] + '\\s+(\\w+)'))[1]; alert(result); } }) };el código solo alerta al número que viene después de la palabra ['القراءة'] pero los otros números después de ambas palabras ['نقطة الخدمة','رقم العداد'] no reciben alertas, ya que pueden ver que estoy registrando el agujero text para asegurarse de que la biblioteca Tesseract no falle en detectar algunas letras árabes tal como son, así que este es el resultado:
نقطة الخدمة 200135644 نوع الاستهلاك 0 رقم العداد 7038842 ١ القراءة 95808 تاريخها 05/04/2022la imagen (formulario.png):-