Find a file
Russell Ballestrini 6dab26d6fa Initial neopig: async media crawler with MD5 deduplication
- Multi-target concurrent crawling support
- Content-addressable vault storage (MD5 hash)
- SQLite database with page context for searchability
- Live SERP with real-time polling feed (/live)
- URI naming convention (media_uri, page_uri)
- GIF and image object-fit: contain for proper display
2025-12-21 17:26:42 -05:00
.gitignore Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
async_web_fetcher.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
Caddyfile Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
Caddyfile.direct Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
database.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
Makefile Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
neopig.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
requirements.txt Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
serp.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
storage.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00
test_crawl.py Initial neopig: async media crawler with MD5 deduplication 2025-12-21 17:26:42 -05:00