早漏なゴミ回答が蔓延しそうなので、、、クソの役にも立たないヒントを書いてやる

静的リンク抽出は出来ないこともないし、動的でもheadlessなブラウザを使えば出来ないことはない
ただその場合は現実的にLinuxならpythonなどのscript言語などで実装することになる
より簡単なのはwgetを使って静的リンクを再帰的に辿って全ファイルを取得してしまうこと
取得した上で、DocumentRootと比較して不要なファイルをリストアップするのが恐らく楽