由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名
extraction
话题找到数量
firecrawl/firecrawl
面向AI的网页数据API——将整个网站转换为LLM就绪的Markdown或结构化数据🔥
firecrawl/pdf-inspector
用于PDF检查、分类和文本提取的快速Rust库。智能检测扫描版与文本版PDF,以实现智能路由决策。
firecrawl/firecrawl-mcp-server
🔥 官方 Firecrawl MCP 服务器 - 为 Cursor、Claude 及其他 LLM 客户端添加强大的网络爬取功能
apache/tika
Apache Tika 工具包可检测并提取超过千种文件类型(如 PPT、XLS 和 PDF)的元数据和文本
HoshinoSuzumi/chronoframe
自托管个人相册应用,支持在线照片管理与相册创建,具备实况照片解析、EXIF数据读取、地理位置识别及探索地图功能。
us/crw
Fast, lightweight Firecrawl/Tavily alternative in Rust. Web scraper, crawler & search API with MCP server for AI agents. Drop-in Firecrawl-compatible API (/scrape, /crawl, /search). 2.3x faster than Tavily, 1.5x faster than Firecrawl in 1K-URL benchmarks. 6 MB RAM, single binary. Self-host or use managed cloud.
yfedoseev/pdf_oxide
Python与Rust最快的PDF库。支持文本提取、图像提取、Markdown转换、PDF创建与编辑。平均耗时0.8毫秒,比行业领先产品快5倍,在3830份PDF测试中通过率100%。采用MIT/Apache-0双协议。
mrshu/github-statuses
“缺失的GitHub状态页面”——一种基于Flat Data方法对GitHub状态进行历史记录尝试
shootthesound/Fizgig
Krea 2, MiniMax & Klein 9B LoRA - LoKR Studio — train, profile, repair, and extract Krea 2, Flux 2 Klein 9B & MiniMax LoRAs & LoKRs