v25.7

Peningkatan kegunaan Text Extractor

  • Class TextExtractor: bersifat statis dan tidak memerlukan penggunaan konstruktor.
  • Class TextExtractor: perilaku yang ditingkatkan saat berjalan dalam mode evaluasi. Tidak ada pengecualian untuk dokumen dengan lebih dari 4 halaman.
  • Class TextExtractor: memperbaiki masalah pada metode Process.
  • Class PdfExtractorOptions: dihapus.
  • Class TextExtractorOptions: direfaktor.
  • Enum TextFormattingMode: diubah nama dan ditingkatkan.

Contoh Penggunaan

// Contoh ini menunjukkan cara mengekstrak konten teks dari dokumen PDF.
// Buat objek TextExtractorOptions untuk menetapkan instruksi
var options = new TextExtractorOptions(TextFormattingMode.Pure);
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_your_pdf_file.pdf"));
// Lakukan proses
var results = TextExtractor.Process(options);
// Dapatkan teks yang diekstrak dari objek ResultContainer
var textExtracted = results.ResultCollection[0].ToString();

Peningkatan kegunaan Html Converter

  • Class HtmlConverter: bersifat statis dan tidak memerlukan penggunaan konstruktor.
  • Class HtmlConverter: memperbaiki masalah pada metode Process.
  • Class HtmlConverter: menghapus logika IDisposable.
  • Class PdfConverterOptions: dihapus.

Contoh Penggunaan

// Contoh ini menunjukkan cara mengonversi PDF ke dokumen HTML.
// Buat objek PdfToHtmlOptions untuk mengatur tipe data output sebagai file dengan sumber daya tersemat
var options = new PdfToHtmlOptions(PdfToHtmlOptions.SaveDataType.FileWithEmbeddedResources);
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_input.pdf"));
// Tetapkan jalur file output
options.AddOutput(new FileDataSource("path_to_output.html"));
// Lakukan proses
HtmlConverter.Process(options);

// Contoh ini menunjukkan cara mengonversi HTML ke dokumen PDF.
// Buat HtmlToPdfOptions
var options = new HtmlToPdfOptions();
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_input.html"));
// Tetapkan jalur file output
options.AddOutput(new FileDataSource("path_to_output.pdf"));
// Lakukan proses
HtmlConverter.Process(options);

Peningkatan kegunaan Image Extractor

  • Class ImageExtractor: bersifat statis dan tidak memerlukan penggunaan konstruktor.

Contoh Penggunaan

// Contoh ini menunjukkan cara mengekstrak gambar dari dokumen PDF.
// Buat ImageExtractorOptions untuk menetapkan instruksi
var options = new ImageExtractorOptions();
// Tambahkan jalur file input
options.AddInput(new FileDataSource("path_to_your_pdf_file.pdf"));
// Tetapkan jalur direktori output
options.AddOutput(new DirectoryDataSource("path_to_results_directory"));
// Lakukan proses
var results = ImageExtractor.Process(options);
// Dapatkan jalur ke hasil gambar
var imageExtracted = results.ResultCollection[0].ToFile();

Perbaikan Minor

  • Perbaikan internal.
  • Memperbaiki contoh dan petunjuk pada Tiff Converter.
  • Memperkecil durasi optimasi halaman.
  • Memperbaiki: output gambar yang salah pada konversi PDF ke PNG.
  • Memperbaiki: karakter Cina tidak tampil dengan benar saat konversi PDF ke PNG.
  • Meningkatkan: kinerja selama konversi PDF ke HTML.
 Indonesia