PDF-to-HTML-Processor
索引说明:本页内容为本站爬虫自动索引的第三方平台公开页面元信息,本平台不存储、不缓存任何资源文件。点击下方按钮将跳转至第三方网站平台访问,访问第三方资源链接需要 VIP 权限。
资源简介
PDF-to-HTML-Processor是一个处理pdf文件的项目,用于将PDF文件转换为HTML格式,并提取文本、图片、元数据等信息。它使用fitz和BeautifulSoup库来实现PDF的读取和HTML的生成。最终以生成器的方式输出一个个和langchain中Document类相同的对象。
- 资源类型
- 文档
- 第三方域名
- github.com
- 索引时间
- 2026-08-04 04:00
开通 VIP 后访问第三方资源
访问第三方资源链接需要 VIP 权限。注册与搜索永久免费,VIP 仅用于访问第三方链接。