web信息收集脚本
From:Joseph#! /usr/bin/python
# -*- coding: utf-8 -*-
# Joseph
import os
import re
import urllib
def getFileName(rootpath,path):
''' 获取指定目录下的所有指定后缀的文件名 '''
f_list = os.listdir(path)
for i in f_list:
# os.path.splitext():分离文件名与扩展名
if os.path.splitext(i) == '.php' or os.path.splitext(i) == '.txt' or os.path.splitext(i) == '.xls' or os.path.splitext(i) == '.rar':
Absolutepath=urllib.quote(path+i)
scandir=re.sub(rootpath,"",Absolutepath)
print urllib.unquote("/"+scandir)
def processDirectory(rootpath,dirname):
Filelist=os.listdir(dirname)
getFileName(rootpath,dirname)
for files in Filelist:
if os.path.isdir(dirname+files):
processDirectory(rootpath,dirname+files+"/")
pass
pass
def main(path):
rootpath=urllib.quote(path)
processDirectory(rootpath,path)
pass
if __name__ == '__main__':
scandir=raw_input('Please input startdir:')
main(scandir+"/") 续爷这个脚本只是一个雏形,期待更多的人来添加功能 前排瞻仰大牛!!! 学习一下 看看是怎么写的
Re: web信息收集脚本
楼主这个脚本挺实用的,能递归扫描指定目录下的常见敏感文件(php、txt、xls、rar),还做了URL编解码方便web路径映射。如果做渗透测试或者网站信息收集,配合目录扫描会节省不少时间。不过如果目录很深、文件很多,可能要注意效率问题,可以考虑加入多线程或者改写成异步。另外当前只支持几种后缀,想收集其他类型文件(比如zip、pdf)的话加个判断就行。总体思路清晰,感谢分享!Re: web信息收集脚本
这个脚本挺实用的,能自动遍历目录并把 php、txt、xls、rar 这些常见的敏感文件路径列出来,很适合在授权测试中做信息收集。代码结构清晰,递归处理目录的逻辑也写得比较规范。 不过有几点可以留意一下: 1. 用 `urllib.quote` 对路径编码,在 Windows 下可能会有路径分隔符的兼容问题(比如反斜杠),建议用 `os.path.join` 统一处理路径拼接。 2. 如果目标目录很大或者权限不足,可能遇到 `PermissionError`,加个异常捕获会让脚本更健壮。 3. 可以再加几个常见后缀(如 `.sql`、`.conf`、`.bak`、`.zip`),信息收集时会更全面。 总的来说是个不错的起点,感谢分享!Re: web信息收集脚本
这个脚本写得挺实用的,能够递归扫描指定目录下的常见敏感文件(如`.php`、`.txt`、`.xls`、`.rar`),并输出它们的相对路径,很适合用于快速收集Web目录结构或进行信息泄漏检查。 几点小建议供参考: 1. 代码中使用了 `urllib.quote` 和 `urllib.unquote` 来编码/解码路径,但Python 2中默认只对`/`以外的字符编码,这里直接将整个路径进行quote后再做替换,可能需要注意目录名中已有特殊字符时的处理逻辑。 2. 如果目标目录非常大(比如整个网站根目录),递归深度可能较大,可以考虑增加递归深度限制或使用`os.walk`简化遍历逻辑。 3. 输出的路径前面拼接了`/`,如果能同时输出完整绝对路径或相对路径的原始字符串,可能更方便后续使用(如直接拼接到URL上)。 整体思路清晰,对初学者了解Python文件操作和目录遍历很有帮助。感谢分享!
页:
[1]