v26.1
新機能 PDF Extractor のプロパティ抽出
- PDF のプロパティを抽出: タイトル、著者、サブジェクト、キーワード、ページ数。
- Class PdfExtractor: PDF プロパティ抽出用メソッド
Extractを追加。 - Class ExtractPropertiesOptions: PdfExtractor プラグインの PDF プロパティ抽出オプションを表すクラス。
- Class PdfProperties: PDF ドキュメントのプロパティとメタ情報を表すクラス。
- Interface IHaveInput: 単一入力データを持つオプションで使用。
- Class OptionsWithInput: 単一入力データを持つオプションで使用。
- 完全に無料で機能します。
使用例:
PDF ファイルからプロパティ(タイトル、著者、サブジェクト、キーワード、ページ数)を抽出する方法を示します。
// Create ExtractPropertiesOptions object to set input file
var options = new ExtractPropertiesOptions("path_to_your_pdf_file.pdf");
// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(options);
var title = pdfProperties.Title;
var author = pdfProperties.Author;
var subject = pdfProperties.Subject;
var keywords = pdfProperties.Keywords;
var numberOfPages = pdfProperties.NumberOfPages;使用例:
PDF ストリームからプロパティ(タイトル、著者、サブジェクト、キーワード、ページ数)を抽出する方法を示します。
// Create ExtractPropertiesOptions object to set input stream
var stream = File.OpenRead("path_to_your_pdf_file.pdf");
var options = new ExtractPropertiesOptions(stream);
// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(options);
var title = pdfProperties.Title;
var author = pdfProperties.Author;
var subject = pdfProperties.Subject;
var keywords = pdfProperties.Keywords;
var numberOfPages = pdfProperties.NumberOfPages;使用例:
最も簡潔な形で PDF ファイルからプロパティを抽出する方法を示します。
// Perform the process and get Properties
var pdfProperties = PdfExtractor.Extract(new ExtractPropertiesOptions("path_to_your_pdf_file.pdf"));改良点
- HTML から PDF への変換で画像の代替テキストをサポート
- PDF から PDFA1b へのコンプライアンス対応
修正されたバグ
- PDF ファイルの最適化を試みたときにエラーが発生する問題
- フォームフィールドの垂直位置合わせの問題
- フォームフィールドで日本語テキストが正しく表示されない問題の修正
- HTML から PDF への変換でのテーブルフォーマット問題
- PDF を PDF/A に変換する前にサイズを最適化すると出力が破損する問題
- PDF から DOC への変換でテーブルが正しく表示されない問題
- PDF から Excel への変換で出力ファイルのフォーマット問題
- PDF から HTML への変換中に ArgumentException が発生する問題
- PDF から HTML への変換で一部のリンクが欠落する問題
- PDF を HTML に変換した際にテキストが欠落する問題