(转载)操作ip定位

php读取操作IP地址数据库文件QQWry.dat

分享到      发表于 2013-07-24 04:55  0条评论           867 次浏览          所属分类:PHP

我们统计流量的时候需要可以获取用户ip,根据用户ip之后可以通过纯ip真数据库QQWry.dat,获取出用户IP 所在的地理位置,这样可以做出更有意义的统计信息. QQWry.dat请自行搜索下载.

下面看下如何解析QQWry.dat文件:

首先看看QQWry.Data文件的内容结构 ,以及解读方式 。

一、文件结构
文件主要分三个结构
1、文件头,8个字节;
2、数据记录区,不定长度;
3、索引区,长度为 7 的整数倍;

二、文件头
文件头的8个字节分两部分,每个部分4个字节,分别指定了索引区的开始地址和结束地址。所以可以通过两个地址的差值 除 7 后 加 1 可以计算出总的记录数。

二、记录区
记录区的数据需要通过索引区的数据来获得各个数据的起始位置;本区数据记录了IP地址的结束地址和地区字符串;所有地区字符串都以 0×00 为结束。

三、索引区
检索IP对应的地区,关键就是找到IP起始地址对应的索引内容。一个IP索引数据包含7个字节,前4个字节是IP地址起始值,后3个字节是对应的IP数据 记录在文件内的偏移地址;IP数据记录中,前 4 个字节是IP结束地址;紧跟的数据有两种模式: 0×01 模式 和 0×02 模式。

0×01模式,即在IP数据的第5个字节是 0×01,则在后面的 3 个字节是国家地区数据的偏移地址;国家地区数据包括国家和地区这两个字符串。即
—————————————————————
4字节 | 3字节 重定向 0x NN NN NN -> 国家地区数据的文件偏移地址
—————————————————————

0×02模式,即在IP数据的第5个字节是 0×02,则在后面的 3 个字节是国家数据的偏移地址,地区数据是再往后的字符串,以 0×00 截至。即
—————————————————————————–
4字节 | 3字节 重定向 0x NN NN NN -> 国家数据的文件偏移地址 | 地区字符串 | 0×00
—————————————————————————–

对于 0×01 模式所得到的 国家地区数据中,它可能又带有一个重定向结构,即
————————————–
国家字符串 | 0×00 | 地区字符串 | 0×00
————————————–

————————————————————————-
国家字符串 | 0×00 | 0×02 | 3字节 0x NN NN NN -> 地区字符串的文件偏移地址
————————————————————————-

对于前一种情况,比较简单,直接读出两个字符串数据就可以了;对于后一种情况,需要再次重定向到地区字符串的偏移地址,然后读取到 0×00 为字符串结尾。

对于这种采取地址映射实际字符串值的方式,主要作用是避免重复记录字符串值。在整个IP地址库文件中,有太多相同字符串记录了,采用 3 字节的映射地址要比重复记录字符串值节省太多空间了。

IP 地理位置查询类

 
 
  
  
  
  
  1. <?php




  2. /**


  3.  * IP 地理位置查询类


  4.  *


  5.  * @author 马秉尧


  6.  * @version 1.5


  7.  * @copyright 2005 CoolCode.CN


  8.  */


  9. class IpLocation {


  10.     /**


  11.      * QQWry.Dat文件指针


  12.      * @var resource


  13.      */


  14.     var $fp;


  15.     /**


  16.      * 第一条IP记录的偏移地址


  17.      * @var int


  18.      */


  19.     var $firstip;


  20.     /**


  21.      * 最后一条IP记录的偏移地址


  22.      * @var int


  23.      */


  24.     var $lastip;


  25.     /**


  26.      * IP记录的总条数(不包含版本信息记录)


  27.      * @var int


  28.      */


  29.     var $totalip;


  30.     /**


  31.      * 构造函数,打开 QQWry.Dat 文件并初始化类中的信息


  32.      * @param string $filename


  33.      * @return IpLocation


  34.      */


  35.     function __construct($filename = "qqwry.dat") {


  36.         $this->fp = 0;


  37.         if (($this->fp = @fopen($filename, 'rb')) !== false) {


  38.             $this->firstip = $this->getlong();


  39.             $this->lastip = $this->getlong();


  40.             $this->totalip = ($this->lastip - $this->firstip) / 7;


  41. //注册析构函数,使其在程序执行结束时执行


  42.             register_shutdown_function(array(&$this, '__construct'));


  43.         }


  44.     }


  45.     /**


  46.      * 返回读取的长整型数


  47.      * @access private


  48.      * @return int


  49.      */


  50.     function getlong() {


  51. //将读取的little-endian编码的4个字节转化为长整型数


  52.         $result = unpack('Vlong', fread($this->fp, 4));


  53.         return $result['long'];


  54.     }


  55.     /**


  56.      * 返回读取的3个字节的长整型数


  57.      *


  58.      * @access private


  59.      * @return int


  60.      */


  61.     function getlong3() {


  62. //将读取的little-endian编码的3个字节转化为长整型数


  63.         $result = unpack('Vlong', fread($this->fp, 3).chr(0));


  64.         return $result['long'];


  65.     }


  66.     /**


  67.      * 返回压缩后可进行比较的IP地址


  68.      *


  69.      * @access private


  70.      * @param string $ip


  71.      * @return string


  72.      */


  73.     function packip($ip) {


  74. // 将IP地址转化为长整型数,如果在PHP5中,IP地址错误,则返回False,


  75. // 这时intval将Flase转化为整数-1,之后压缩成big-endian编码的字符串


  76.         return pack('N', intval(ip2long($ip)));


  77.     }


  78.     /**


  79.      * 返回读取的字符串


  80.      *


  81.      * @access private


  82.      * @param string $data


  83.      * @return string


  84.      */


  85.     function getstring($data = "") {


  86.         $char = fread($this->fp, 1);


  87.         while (ord($char) > 0) { // 字符串按照C格式保存,以结束


  88.             $data .= $char; // 将读取的字符连接到给定字符串之后


  89.             $char = fread($this->fp, 1);


  90.         }


  91.         return $data;


  92.     }


  93.     /**


  94.      * 返回地区信息


  95.      *


  96.      * @access private


  97.      * @return string


  98.      */


  99.     function getarea() {


  100.         $byte = fread($this->fp, 1); // 标志字节


  101.         switch (ord($byte)) {


  102.             case 0: // 没有区域信息


  103.                 $area = "";


  104.                 break;


  105.             case 1:


  106.             case 2: // 标志字节为1或2,表示区域信息被重定向


  107.                 fseek($this->fp, $this->getlong3());


  108.                 $area = $this->getstring();


  109.                 break;


  110.             default: // 否则,表示区域信息没有被重定向


  111.                 $area = $this->getstring($byte);


  112.                 break;


  113.         }


  114.         return $area;


  115.     }


  116.     /**


  117.      * 根据所给 IP 地址或域名返回所在地区信息


  118.      * @access public


  119.      * @param string $ip


  120.      * @return array


  121.      */


  122.     function getlocation($ip) {


  123.         if (!$this->fp) return null; // 如果数据文件没有被正确打开,则直接返回空


  124.         $location['ip'] = gethostbyname($ip); // 将输入的域名转化为IP地址


  125.         $ip = $this->packip($location['ip']); // 将输入的IP地址转化为可比较的IP地址


  126. // 不合法的IP地址会被转化为255.255.255.255


  127. // 对分搜索


  128.         $l = 0; // 搜索的下边界


  129.         $u = $this->totalip; // 搜索的上边界


  130.         $findip = $this->lastip; // 如果没有找到就返回最后一条IP记录(QQWry.Dat的版本信息)


  131.         while ($l <= $u) { // 当上边界小于下边界时,查找失败


  132.             $i = floor(($l + $u) / 2); // 计算近似中间记录


  133.             fseek($this->fp, $this->firstip + $i * 7);


  134.             $beginip = strrev(fread($this->fp, 4)); // 获取中间记录的开始IP地址


  135. // strrev函数在这里的作用是将little-endian的压缩IP地址转化为big-endian的格式


  136. // 以便用于比较,后面相同。


  137.             if ($ip < $beginip) { // 用户的IP小于中间记录的开始IP地址时


  138.                 $u = $i - 1; // 将搜索的上边界修改为中间记录减一


  139.             }


  140.             else {


  141.                 fseek($this->fp, $this->getlong3());


  142.                 $endip = strrev(fread($this->fp, 4)); // 获取中间记录的结束IP地址


  143.                 if ($ip > $endip) { // 用户的IP大于中间记录的结束IP地址时


  144.                     $l = $i + 1; // 将搜索的下边界修改为中间记录加一


  145.                 }


  146.                 else { // 用户的IP在中间记录的IP范围内时


  147.                     $findip = $this->firstip + $i * 7;


  148.                     break; // 则表示找到结果,退出循环


  149.                 }


  150.             }


  151.         }


  152. //获取查找到的IP地理位置信息


  153.         fseek($this->fp, $findip);


  154.         $location['beginip'] = long2ip($this->getlong()); // 用户IP所在范围的开始地址


  155.         $offset = $this->getlong3();


  156.         fseek($this->fp, $offset);


  157.         $location['endip'] = long2ip($this->getlong()); // 用户IP所在范围的结束地址


  158.         $byte = fread($this->fp, 1); // 标志字节


  159.         switch (ord($byte)) {


  160.             case 1: // 标志字节为1,表示国家和区域信息都被同时重定向


  161.                 $countryOffset = $this->getlong3(); // 重定向地址


  162.                 fseek($this->fp, $countryOffset);


  163.                 $byte = fread($this->fp, 1); // 标志字节


  164.                 switch (ord($byte)) {


  165.                     case 2: // 标志字节为2,表示国家信息又被重定向


  166.                         fseek($this->fp, $this->getlong3());


  167.                         $location['country'] = $this->getstring();


  168.                         fseek($this->fp, $countryOffset + 4);


  169.                         $location['area'] = $this->getarea();


  170.                         break;


  171.                     default: // 否则,表示国家信息没有被重定向


  172.                         $location['country'] = $this->getstring($byte);


  173.                         $location['area'] = $this->getarea();


  174.                         break;


  175.                 }


  176.                 break;


  177.             case 2: // 标志字节为2,表示国家信息被重定向


  178.                 fseek($this->fp, $this->getlong3());


  179.                 $location['country'] = $this->getstring();


  180.                 fseek($this->fp, $offset + 8);


  181.                 $location['area'] = $this->getarea();


  182.                 break;


  183.             default: // 否则,表示国家信息没有被重定向


  184.                 $location['country'] = $this->getstring($byte);


  185.                 $location['area'] = $this->getarea();


  186.                 break;


  187.         }


  188.         if ($location['country'] == " CZ88.NET") { // CZ88.NET表示没有有效信息


  189.             $location['country'] = "未知";


  190.         }


  191.         if ($location['area'] == " CZ88.NET") {


  192.             $location['area'] = "";


  193.         }


  194.         return $location;


  195.     }


  196.     /**


  197.      * 析构函数,用于在页面执行结束后自动关闭打开的文件。


  198.      *


  199.      */


  200.     function __desctruct() {


  201.         if ($this->fp) {


  202.             fclose($this->fp);


  203.         }


  204.         $this->fp = 0;


  205.     }


  206. }


你可能感兴趣的:((转载)操作ip定位)