| 网站首页 | 业界新闻 | 小组 | 威客 | 人才 | 下载频道 | 博客 | 代码贴 | 在线编程 | 编程论坛
欢迎加入我们,一同切磋技术
用户名:   
 
密 码:  
共有 678 人关注过本帖
标题:c语言正则表达式匹配URL问题
只看楼主 加入收藏
mapeijiansss
Rank: 1
等 级:新手上路
帖 子:7
专家分:0
注 册:2014-3-19
结帖率:33.33%
收藏
已结贴  问题点数:20 回复次数:2 
c语言正则表达式匹配URL问题
自己用socket写了一个小程序去获取网站的源代码后,用pcre去获取网站的URL
,有以下疑问:
部分源码:
[code=c]pcre *re;

    const char *error;

    int erroffset;

    int  ovector[5000];

    int  rc, i;  

    char  pattern [] = "http://([\\w-]+\\.)+[\\w-]+(/[\\w- ./?%%&=]*)?";

    if(NULL == (re = pcre_compile(pattern,0,&error,&erroffset,NULL)))

    {

        printf("%d:%s\n", erroffset,error);

        return 1;

    }

    rc = pcre_exec(re,NULL,sendbuf,strlen(sendbuf),0,0,ovector,5000);

    if (rc < 0) {                     //如果没有匹配,返回错误信息     

        if (rc == PCRE_ERROR_NOMATCH) printf("Sorry, no match ...\n");     

        else printf("Matching error %d\n", rc);     

        pcre_free(re);     

        return 1;     

    }

    for (i = 0; i < rc; i++) {             //分别取出捕获分组 $0整个正则公式
$1第一个()     

        char *substring_start = sendbuf + ovector[2*i];     

        int substring_length = ovector[2*i+1] - ovector[2*i];     

        printf("$%2d: %.*s\n", i, substring_length, substring_start);  

        }

    pcre_free(re);    [/code]

执行结果为:
$ 0: http://s1.
$ 1: bdstatic.
$ 2: /r/www/cache/static/global/img/icons_4879d3b8.png
但是我用网上的正则表达式测试工具一样的正则表达式一样的文本出现的结果如下:
http://s1.
http://s1.
http://s1.
http://s1.
http://www.baidu.com/img/sug_bd.png
http://s1.
http://www.baidu.com/
http://www.baidu.com/s?
http://www.baidu.com/s?
http://www.baidu.com/gaoji/preferences.html
。。。。
问什么会有这么大的差别啊。
搜索更多相关主题的帖子: c语言 表达式 return 源代码 
2014-03-19 16:04
fragileeye
Rank: 5Rank: 5
等 级:职业侠客
威 望:2
帖 子:107
专家分:387
注 册:2011-5-21
收藏
得分:20 
标准c有正则?还有,你调用的库是什么?
2014-03-20 10:13
mapeijiansss
Rank: 1
等 级:新手上路
帖 子:7
专家分:0
注 册:2014-3-19
收藏
得分:0 
回复 楼主 mapeijiansss
pcre库
2014-03-20 14:51
快速回复:c语言正则表达式匹配URL问题
数据加载中...
 
   



关于我们 | 广告合作 | 编程中国 | 清除Cookies | TOP | 手机版

编程中国 版权所有,并保留所有权利。
Powered by Discuz, Processed in 0.024117 second(s), 9 queries.
Copyright©2004-2024, BCCN.NET, All Rights Reserved