Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/pymupdf/pymupdf4llm
/ types & classes
Types & classes
10 in github.com/pymupdf/pymupdf4llm
⨍
Functions
159
◇
Types & classes
10
↓ 5 callers
Class
PDFMarkdownReader
Read PDF files using PyMuPDF library.
pymupdf4llm/pymupdf4llm/llama/pdf_markdown_reader.py:17
↓ 2 callers
Class
IdentifyHeaders
Compute data for identifying header text. All non-white text from all selected pages is extracted and its font size noted as a rounded value.
pymupdf4llm/pymupdf4llm/helpers/pymupdf_rag.py:70
↓ 1 callers
Class
LayoutBox
pymupdf4llm/pymupdf4llm/helpers/document_layout.py:632
↓ 1 callers
Class
PageLayout
pymupdf4llm/pymupdf4llm/helpers/document_layout.py:650
↓ 1 callers
Class
Parameters
pymupdf4llm/pymupdf4llm/helpers/pymupdf_rag.py:225
↓ 1 callers
Class
ParsedDocument
pymupdf4llm/pymupdf4llm/helpers/document_layout.py:663
↓ 1 callers
Class
_ProgressBar
pymupdf4llm/pymupdf4llm/helpers/progress.py:19
↓ 1 callers
Class
my_app
examples/GUI/browser-app.py:73
Class
LayoutEncoder
pymupdf4llm/pymupdf4llm/helpers/document_layout.py:786
Class
TocHeaders
Compute data for identifying header text. This is an alternative to IdentifyHeaders. Instead of running through the full document to identify
pymupdf4llm/pymupdf4llm/helpers/pymupdf_rag.py:174