Há dois modos na barra.
Imagem no Word (padrão) monta um .docx de verdade com a foto ajustada à página. Use quando um formulário pede «um arquivo Word» e você só tem um scan.
OCR — extrair texto roda Tesseract na aba e escreve as letras como parágrafos que você pode editar. Inglês é o pacote padrão; mude se a página estiver em russo, alemão, espanhol, francês ou chinês simplificado.
OCR melhor
Escaneamentos de páginas impressas com bom contraste funcionam. Fotos de telas, letra manuscrita e pôsteres recarregados perdem caracteres. Texto pequeno é ampliado antes do reconhecimento.
A primeira execução de OCR pode baixar dados de idioma de um CDN. Depois isso fica em cache no navegador. O modo de colocar imagem nunca precisa desse download.