Skip to main content
Content Discovery
Created bymhmdiaa-trickest
Last updated8/12/2024

Input Parameters

file
required
List of urls
string
Maximum crawling depth
Header(s) to include in HTTP requests
boolean
Enable headless browser mode (default: false)
file
List of URLs, paths, or regular expressions to include in crawling
string
Maximum number of requests to send per second per machine
file
Header(s) to include in HTTP requests
file
List of URLs, paths, or regular expressions to exclude from crawling

Outputs

url-detailsurls

Discover Paths via Crawling

Description

Crawl a list of web server URLs to discover endpoints and form a comprehensive map of each asset on your attack surface.

Features

  • Supports headless browser crawling for more accurate spidering.
  • Parses JavaScript code to discover additional endpoints and hidden paths.
  • Can crawl thousands of web servers simulataneously.

Inputs

Required

  • urls: a list of URLs

Optional

  • depth: Maximum crawling depth (default: 5)
  • headless: Enable headless browser mode (default: false)
  • header: Header(s) to include in HTTP requests
  • header-file: File with header(s) to include in HTTP requests
  • rate-limit: Maximum number of requests to send per second per machine (default: 300)

Outputs

  • urls: List of discovered URLs.
  • url-details: JSONLines records of URL discovery details.

Changelog

  • v1.0.0
    • Initial release
  • v1.1.0
    • Added header-file input
  • v1.2.0
    • Support exporting non-GET requests to the url-details output
    • Automatically extract forms and fetch requests from crawled pages
    • Submit POST requests using sample data
    • Extend url-details format to support method, body, body_parameters, and query_parameters fields