新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → 关于spider的链接分析 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 12492 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 关于spider的链接分析 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     panye123 帅哥哟,离线,有人找我吗?
      
      
      等级:大二(研究C++)
      文章:10
      积分:214
      门派:XML.ORG.CN
      注册:2005/5/27

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给panye123发送一个短消息 把panye123加入好友 查看panye123的个人资料 搜索panye123在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看panye123的博客楼主
    发贴心情 关于spider的链接分析

    最近需要写一个蜘蛛程序,但看了一段时间后发现,网上的很多网页的链接存在相对url或者是javascript生成的链接,请问像下面的相对url如何处理
       
       比如 http:///www.ieee.org.cn/info/Searchmore.asp?id=1(只是比方)的网页中有相对地址     /cs/a.html和Searchmore.asp?id=2 其相应的绝对url分别为 http:///www.ieee.org.cn/cs/a.htmlhttp:///www.ieee.org.cn/info/Searchmore.asp?id=2请问这样的情况怎么分析?
       还有就是javascript生成的联接。请高手指明一下思路。谢谢

       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/10/21 17:40:00
     
     mzq_bim 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:3
      积分:69
      门派:XML.ORG.CN
      注册:2006/6/16

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给mzq_bim发送一个短消息 把mzq_bim加入好友 查看mzq_bim的个人资料 搜索mzq_bim在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看mzq_bim的博客2
    发贴心情 
    做出来了吗?正在关注同一个问题
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/12/1 14:04:00
     
     soufz 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:1
      积分:58
      门派:XML.ORG.CN
      注册:2006/12/27

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给soufz发送一个短消息 把soufz加入好友 查看soufz的个人资料 搜索soufz在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看soufz的博客3
    发贴心情 
    我们已经都实现了。
    看看:http://www.soufz.com
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/12/27 16:42:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2025/7/3 18:46:13

    本主题贴数3,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    62.500ms