zpdf

速度とメモリコピーの少なさを重視した、Zig製のPDFテキスト抽出ライブラリです。初期のアルファ段階で、PDFから文字を取り出すために使います。

Xで共有ライセンス: CC0-1.0

概要

zpdfは、Zigで書かれたPDFテキスト抽出ライブラリです。ファイルをメモリマップで読み、可能な限りデータのコピーを避け、アリーナ割り当てによるストリーミングでテキストを取り出します。複数の圧縮フィルタとフォントエンコーディングを扱い、相互参照テーブルとストリームを解析し、タグ付きPDFの構造ツリーも読めます。READMEでは初期のアルファ版とされています。

主な特長

  • メモリマップで可能な限りゼロコピーで読む
  • FlateDecode、ASCII85、ASCIIHex、LZW、RunLengthに対応
  • WinAnsi、MacRoman、ToUnicodeのエンコーディングを扱う
  • 構造ツリーの抽出と、構造化PDFのMarkdown出力
  • 厳格または寛容なエラー処理を選べる

こんな人・用途に

PDFから高速にテキストを取り出したいZig開発者向けです。初期のアルファ版のため、未対応の部分があり得ます。

アップストリーム
Lulzx/zpdf
GitHubのフォーク
Guo-astro/zpdf
アップストリームのスター数
922
カテゴリ
ドキュメント・メディア・コンテンツ
言語
Zig
ライセンス
CC0-1.0
フォーク日
2025-12-31
同期状態
同期済み最終同期 2026-09-29