Sfotografowana tabela w pliku PDF jest znacznie mniej użyteczna niż ustrukturyzowany tekst lub dane.
Treści nadające się do odczytu maszynowego można przeszukiwać, indeksować, tłumaczyć, przekształcać i sprawdzać za pomocą technologii wspomagających; pułapka egzaminacyjna polega na myleniu zeskanowanego obrazu z tekstem strukturyzowanym.