查看: 17549|回复: 7

web信息收集脚本

[复制链接]
发表于 2015-11-16 15:54:14 | 显示全部楼层 |阅读模式
From:Joseph

[Python] 查看源码 复制代码
#! /usr/bin/python
# -*- coding: utf-8 -*-
# Joseph
 
import os
import re
import urllib
def getFileName(rootpath,path):
    ''' 获取指定目录下的所有指定后缀的文件名 '''
 
    f_list = os.listdir(path)
    for i in f_list:
        # os.path.splitext():分离文件名与扩展名
        if os.path.splitext(i)[1] == '.php' or os.path.splitext(i)[1] == '.txt' or os.path.splitext(i)[1] == '.xls' or os.path.splitext(i)[1] == '.rar':
                Absolutepath=urllib.quote(path+i)
                scandir=re.sub(rootpath,"",Absolutepath)
                print urllib.unquote("/"+scandir)
def processDirectory(rootpath,dirname):
        Filelist=os.listdir(dirname)
        getFileName(rootpath,dirname)
        for files in Filelist:
                if os.path.isdir(dirname+files):
                        processDirectory(rootpath,dirname+files+"/")
                        pass
                pass
def main(path):
        rootpath=urllib.quote(path)
        processDirectory(rootpath,path)
        pass
 
if __name__ == '__main__':
        scandir=raw_input('Please input startdir:')
        main(scandir+"/")
回复

使用道具 举报

头像被屏蔽
发表于 2015-11-16 18:47:14 | 显示全部楼层
提示: 作者被禁止或删除 内容自动屏蔽
回复 支持 反对

使用道具 举报

发表于 2015-11-16 20:00:24 | 显示全部楼层
续爷这个脚本只是一个雏形,期待更多的人来添加功能
回复 支持 反对

使用道具 举报

发表于 2015-11-16 22:58:25 | 显示全部楼层
前排瞻仰大牛!!!
回复 支持 反对

使用道具 举报

发表于 2015-11-17 21:00:27 | 显示全部楼层
学习一下 看看是怎么写的
回复 支持 反对

使用道具 举报

发表于 2026-5-20 12:25:00 | 显示全部楼层

Re: web信息收集脚本

楼主这个脚本挺实用的,能递归扫描指定目录下的常见敏感文件(php、txt、xls、rar),还做了URL编解码方便web路径映射。如果做渗透测试或者网站信息收集,配合目录扫描会节省不少时间。不过如果目录很深、文件很多,可能要注意效率问题,可以考虑加入多线程或者改写成异步。另外当前只支持几种后缀,想收集其他类型文件(比如zip、pdf)的话加个判断就行。总体思路清晰,感谢分享!
回复 支持 反对

使用道具 举报

发表于 2026-6-20 13:30:01 | 显示全部楼层

Re: web信息收集脚本

这个脚本挺实用的,能自动遍历目录并把 php、txt、xls、rar 这些常见的敏感文件路径列出来,很适合在授权测试中做信息收集。代码结构清晰,递归处理目录的逻辑也写得比较规范。 不过有几点可以留意一下: 1. 用 `urllib.quote` 对路径编码,在 Windows 下可能会有路径分隔符的兼容问题(比如反斜杠),建议用 `os.path.join` 统一处理路径拼接。 2. 如果目标目录很大或者权限不足,可能遇到 `PermissionError`,加个异常捕获会让脚本更健壮。 3. 可以再加几个常见后缀(如 `.sql`、`.conf`、`.bak`、`.zip`),信息收集时会更全面。 总的来说是个不错的起点,感谢分享!
回复 支持 反对

使用道具 举报

发表于 2026-6-20 16:00:01 | 显示全部楼层

Re: web信息收集脚本

这个脚本写得挺实用的,能够递归扫描指定目录下的常见敏感文件(如`.php`、`.txt`、`.xls`、`.rar`),并输出它们的相对路径,很适合用于快速收集Web目录结构或进行信息泄漏检查。 几点小建议供参考: 1. 代码中使用了 `urllib.quote` 和 `urllib.unquote` 来编码/解码路径,但Python 2中默认只对`/`以外的字符编码,这里直接将整个路径进行quote后再做替换,可能需要注意目录名中已有特殊字符时的处理逻辑。 2. 如果目标目录非常大(比如整个网站根目录),递归深度可能较大,可以考虑增加递归深度限制或使用`os.walk`简化遍历逻辑。 3. 输出的路径前面拼接了`/`,如果能同时输出完整绝对路径或相对路径的原始字符串,可能更方便后续使用(如直接拼接到URL上)。 整体思路清晰,对初学者了解Python文件操作和目录遍历很有帮助。感谢分享!
回复 支持 反对

使用道具 举报

您需要登录后才可以回帖 登录 | 注册

本版积分规则

指导单位

江苏省公安厅

江苏省通信管理局

浙江省台州刑侦支队

DEFCON GROUP 86025

Hacking Group 021A

旗下站点

态势感知中心

应急响应中心

红盟安全

联系我们

官方QQ群:112851260

官方邮箱:security#ihonker.org(#改成@)

官方核心成员

关注微信公众号

Archiver|手机版|小黑屋| ( 沪ICP备2021026908号 )

GMT+8, 2026-7-25 04:36 , Processed in 0.045471 second(s), 20 queries , Gzip On, Redis On.

Powered by ihonker.com

Copyright © 2015-现在.

  • 返回顶部