v26.1

新機能 PDF Extractor のプロパティ抽出

  • PDF のプロパティを抽出: タイトル、著者、サブジェクト、キーワード、ページ数。
  • Class PdfExtractor: PDF プロパティ抽出用メソッド Extract を追加。
  • Class ExtractPropertiesOptions: PdfExtractor プラグインの PDF プロパティ抽出オプションを表すクラス。
  • Class PdfProperties: PDF ドキュメントのプロパティとメタ情報を表すクラス。
  • Interface IHaveInput: 単一入力データを持つオプションで使用。
  • Class OptionsWithInput: 単一入力データを持つオプションで使用。
  • 完全に無料で機能します。

使用例:

PDF ファイルからプロパティ(タイトル、著者、サブジェクト、キーワード、ページ数)を抽出する方法を示します。

// Create ExtractPropertiesOptions object to set input file
var options = new ExtractPropertiesOptions("path_to_your_pdf_file.pdf");
// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(options);
var title = pdfProperties.Title;
var author = pdfProperties.Author;
var subject = pdfProperties.Subject;
var keywords = pdfProperties.Keywords;
var numberOfPages = pdfProperties.NumberOfPages;

使用例:

PDF ストリームからプロパティ(タイトル、著者、サブジェクト、キーワード、ページ数)を抽出する方法を示します。

// Create ExtractPropertiesOptions object to set input stream
var stream = File.OpenRead("path_to_your_pdf_file.pdf");
var options = new ExtractPropertiesOptions(stream);
// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(options);
var title = pdfProperties.Title;
var author = pdfProperties.Author;
var subject = pdfProperties.Subject;
var keywords = pdfProperties.Keywords;
var numberOfPages = pdfProperties.NumberOfPages;

使用例:

最も簡潔な形で PDF ファイルからプロパティを抽出する方法を示します。

// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(new ExtractPropertiesOptions("path_to_your_pdf_file.pdf"));

改良点

  • HTML から PDF への変換で画像の代替テキストをサポート
  • PDF から PDFA1b へのコンプライアンス対応

修正されたバグ

  • PDF ファイルの最適化を試みたときにエラーが発生する問題
  • フォームフィールドの垂直位置合わせの問題
  • フォームフィールドで日本語テキストが正しく表示されない問題の修正
  • HTML から PDF への変換でのテーブルフォーマット問題
  • PDF を PDF/A に変換する前にサイズを最適化すると出力が破損する問題
  • PDF から DOC への変換でテーブルが正しく表示されない問題
  • PDF から Excel への変換で出力ファイルのフォーマット問題
  • PDF から HTML への変換中に ArgumentException が発生する問題
  • PDF から HTML への変換で一部のリンクが欠落する問題
  • PDF を HTML に変換した際にテキストが欠落する問題
2026/09/07
 日本語