Tak samo jak IronPDF może generować pikselowo doskonale pliki PDF z zawartości HTML, może być również używany do konwertowania dokumentów PDF na HTML. Używając klas PdfDocument i HtmlFormatOptions, użytkownicy uzyskają dostęp do metod niezbędnych do przekształcenia PDF na HTML oraz kontroli nad tym, jak będzie sformatowana końcowa zawartość HTML.
5 krokow do konwersji PDF na HTML
Oto przykład kodu krok po kroku ilustrujacy jak wykonac konwersje:
Aby rozpocząć konwertowanie pliku PDF na HTML, musimy najpierw załadować PDF, który chcemy przekonwertować, używając metody FromFile klasy PdfDocument. Ta metoda przyjmuje nazwę pliku lub lokalizację pliku, którą do niej przekazujemy, i Load ją do nowego obiektu PdfDocument, pdf. Teraz będziemy mogli po prostu odwolac sie do tego obiektu, gdy tylko będziemy chcieli uzyskać do niego dostep w procesie konwersji.
Następnie, demonstrujemy metode konwersji dokumentu PDF do prostego obiektu ciągu znakow HTML, ktory można pozniej wyświetlic na konsoli, gotowy do dalszej manipulacji w zależności od potrzeb programisty. Nastepna linia kodu demonstruje inny sposob, w ktorym konwertujemy PDF na plik HTML, gotowy do bardziej zlozonej pracy lub udostępnienia w porownaniu do prostego ciągu znakow HTML. Obie te metody wymagaja tylko jednej linii do wykonania procesu konwersji, co czyni je prostymi w użyciu i efektywnymi.
Teraz przyjrzyjmy się bardziej zaawansowanemu przykładowi, w którym bierzemy klasę HtmlFormatOptions i używamy jej właściwości do dostosowania końcowego wyjścia HTML. Z ta klasa można dostosować różne aspekty, takie jak kolor tla, kolor naglowka (H1), wyrównanie tekstu H1, marginesy strony i inne. Najpierw musimy stworzyć nową instancję tej klasy, nazwaną htmlFormat w kodzie.
W tym przykładzie zmieniamy kolor tła na biały i ustawiamy kolor tekstu H1 na niebieski za pomocą klasy IronSoftware.Drawing.Color. Następnie dostosowujemy rozmiar czcionki H1 do 25 pikseli. Następnie dostosowujemy wyrównanie tekstu H1 do centrali. W koncu ustawiamy marginesy strony PDF w dokumencie HTML na 10 pikseli.
Ostateczny krok polega na ponownym użyciu metody SaveAsHtml w celu przekonwertowania PDF na HTML, tym razem z dodatkowymi parametrami. Pierwszym parametrem jest nazwa i lokalizacja do zapisania nowo wygenerowanego dokumentu HTML. Następnie ustawiamy zmienną logiczną fullContentWidth na true, co konfiguruje HTML do użycia pełnej szerokości dla zawartości PDF. Również określamy tytuł dla wyjścia HTML i ostatecznie stosujemy ustawienia dostosowania, które wcześniej stworzyliśmy, przy użyciu htmlFormatOptions.