v25.7
- Class TextExtractor: bersifat statis dan tidak memerlukan penggunaan konstruktor.
- Class TextExtractor: perilaku yang ditingkatkan saat berjalan dalam mode evaluasi. Tidak ada pengecualian untuk dokumen dengan lebih dari 4 halaman.
- Class TextExtractor: memperbaiki masalah pada metode Process.
- Class PdfExtractorOptions: dihapus.
- Class TextExtractorOptions: direfaktor.
- Enum TextFormattingMode: diubah nama dan ditingkatkan.
Contoh Penggunaan
// Contoh ini menunjukkan cara mengekstrak konten teks dari dokumen PDF.
// Buat objek TextExtractorOptions untuk menetapkan instruksi
var options = new TextExtractorOptions(TextFormattingMode.Pure);
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_your_pdf_file.pdf"));
// Lakukan proses
var results = TextExtractor.Process(options);
// Dapatkan teks yang diekstrak dari objek ResultContainer
var textExtracted = results.ResultCollection[0].ToString();
Peningkatan kegunaan Html Converter
- Class HtmlConverter: bersifat statis dan tidak memerlukan penggunaan konstruktor.
- Class HtmlConverter: memperbaiki masalah pada metode Process.
- Class HtmlConverter: menghapus logika IDisposable.
- Class PdfConverterOptions: dihapus.
Contoh Penggunaan
// Contoh ini menunjukkan cara mengonversi PDF ke dokumen HTML.
// Buat objek PdfToHtmlOptions untuk mengatur tipe data output sebagai file dengan sumber daya tersemat
var options = new PdfToHtmlOptions(PdfToHtmlOptions.SaveDataType.FileWithEmbeddedResources);
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_input.pdf"));
// Tetapkan jalur file output
options.AddOutput(new FileDataSource("path_to_output.html"));
// Lakukan proses
HtmlConverter.Process(options);
// Contoh ini menunjukkan cara mengonversi HTML ke dokumen PDF.
// Buat HtmlToPdfOptions
var options = new HtmlToPdfOptions();
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_input.html"));
// Tetapkan jalur file output
options.AddOutput(new FileDataSource("path_to_output.pdf"));
// Lakukan proses
HtmlConverter.Process(options);
- Class ImageExtractor: bersifat statis dan tidak memerlukan penggunaan konstruktor.
Contoh Penggunaan
// Contoh ini menunjukkan cara mengekstrak gambar dari dokumen PDF.
// Buat ImageExtractorOptions untuk menetapkan instruksi
var options = new ImageExtractorOptions();
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_your_pdf_file.pdf"));
// Tetapkan jalur direktori output
options.AddOutput(new DirectoryDataSource("path_to_results_directory"));
// Lakukan proses
var results = ImageExtractor.Process(options);
// Dapatkan jalur ke hasil gambar
var imageExtracted = results.ResultCollection[0].ToFile();
Perbaikan Minor
- Perbaikan internal.
- Memperbaiki contoh dan petunjuk pada Tiff Converter.
- Memperkecil durasi optimasi halaman.
- Memperbaiki: output gambar yang salah pada konversi PDF ke PNG.
- Memperbaiki: karakter Cina tidak tampil dengan benar saat konversi PDF ke PNG.
- Meningkatkan: kinerja selama konversi PDF ke HTML.