找到 4 个与"data-extraction"相关的项目
相关分类: 开发者工具 (2)
用于网页抓取和浏览器自动化的 Node.js/TypeScript 库,旨在构建能够抵御反爬检测的可靠爬虫。
文档解析库,将 PDF、Word 文档等格式转换为适用于 LLM 和 RAG 流水线的干净结构化数据。
库,通过函数调用 API 和 Pydantic 模型校验,从大语言模型获取可靠的结构化数据输出。
快速的高层次 Python 网页抓取与爬虫框架,用于从网站中提取结构化数据。