新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> 搜索引擎, 信息分类与检索, 语义搜索, Lucene, Nutch, GRUB, Larbin, Weka
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 Web挖掘技术 』 → 一位数据挖掘成功人士 给 数据挖掘在读研究生 的建议 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 675081 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 一位数据挖掘成功人士 给 数据挖掘在读研究生 的建议 举报  打印  推荐  IE收藏夹 
       本主题类别: 信息检索 | 数据挖掘 | 科研生涯    
     DMman 帅哥哟,离线,有人找我吗?魔羯座1984-1-11
      
      
      威望:1
      头衔:数据挖掘青年
      等级:研二(Pi-Calculus看得一头雾水)(版主)
      文章:803
      积分:5806
      门派:W3CHINA.ORG
      注册:2007/4/9

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给DMman发送一个短消息 把DMman加入好友 查看DMman的个人资料 搜索DMman在『 Web挖掘技术 』 的所有贴子 点击这里发送电邮给DMman 访问DMman的主页 引用回复这个贴子 回复这个贴子 查看DMman的博客楼主
    发贴心情 一位数据挖掘成功人士 给 数据挖掘在读研究生 的建议

    来自 http://blogger.org.cn/blog/more.asp?name=idmer&id=15785#53359

    关于数据挖掘领域的研究   
       
    数据挖掘者 发表于 2006-6-23 12:26:02  

    这个是我回复北京某大学一位研究生的eMail,讨论数据挖掘领域研究选题的一些个人观点,欢迎大家批评指正。

    原信:(2006-6-7)
    ====================================

    师兄:

         你好
         我所学专业为数据挖掘,很想在这方面有所作为,但是一段时间发现效果不佳,我觉得我对整个领域不是很了解,师兄能否谈谈如何经过怎样的努力,才可能在两年后,三年后有高水平的论文和研究成果出来呢?能否谈谈您当前学习的方法和数据挖掘领域就业的想法呢?

        My honor to have your reading, really.


        ohmyfuture
        北京邮电大学计算机学院
    回复:(2006-6-12)
    ====================================

    ohmyfuture,

      最近一直很忙,抱歉回信晚了。

      关于数据挖掘方面的研究,我原来也走过一些弯路。其实从数据挖掘的起源可以发现,它并不是一门崭新的科学,而是综合了统计分析、机器学习、人工智能、数据库等诸多方面的研究成果而成,同时与专家系统、知识管理等研究方向不同的是,数据挖掘更侧重于应用的层面。

      因此来说,数据挖掘融合了相当多的内容,试图全面了解所有的细节会花费很长的时间。因此我建议你的第一步是用大概三个月的时间了解数据挖掘的几个常用技术:分类、聚类、预测、关联分析、孤立点分析等等。这种了解是比较粗的,目标是明白这些技术是用来干什么的,典型的算法大致是怎样的,以及在什么情况下应该选用什么样的技术和算法。

      经过初步了解之后,就要进入选题的阶段,选择自己感兴趣的某个具体方向,然后通读该方向的经典论文(综述、主要发展方向、应用成果)。选题阶段可能会花费较长的时间,比如一年。此时,要逐渐明确突破点,也就是将来你论文的创新点。创新对于研究来说非常重要,一方面该创新的确比原来的方法要好,另一方面该创新的确具有实用的价值。

      随后,就要来实现自己的想法。通常对于硕士论文来说,需要建立原型系统,进行试验,并用试验结果来支持自己的论文主题。原型系统就是对自己创新点的实现,需要很好地设计和开发。需要注意的是,原型系统的建立和开发商用系统不同,需要体现比较好的理论基础。也就是说,原型系统并不是简单地用于实现功能,而是将你的一整套理论付诸实现。这种理论基础也将会包含在你的论文中,以体现论文的理论高度。

      原型系统的搭建以及产生令人信服试验结果,这个过程一般需要至少一年的时间。所以要集中精力于核心部分(体现论文创新点的部分),外围的界面等等不应投入太多的精力,以免进度失控。

      最后是论文的整理和写作了。建议你在之前的阶段中逐步先写出一些篇幅较短的论文(用于发在期刊、会议上),比如综述、体系框架、算法内核、应用等等。这样在最后写毕业论文时就有了足够多的内容,会写得更好更快一些。

      以上只是泛泛而谈。其实我觉得其中的关键点在于选题,而选题的好坏取决于你对数据挖掘研究现状的了解、你的兴趣和专长、以及该方向在应用上的意义。建议你和导师、同行多交流,能够让自己的方向更清晰。

      至于数据挖掘领域的就业,应该来说还是前景不错的。如果你对研究有兴趣,象微软研究院、Google、高校研究所都是不错的地方;如果你对实际应用有兴趣,很多大的公司包括IBM、Accenture、亚信等等都有相应的人力需求,当然一些甲方的单位比如证券、保险、金融等等单位也都需要分析人才。

    Best Regards,
    Sunstone Zhang

    [此贴子已经被作者于2007-6-8 19:27:26编辑过]

       收藏   分享  
    顶(2)
      




    ----------------------------------------------
    数据挖掘青年 http://blogger.org.cn/blog/blog.asp?name=DMman
    纪录片之家 (很多纪录片下载)http://www.jlpzj.com/?fromuid=137653

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/8 10:06:00
     
     sangyei 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:0
      积分:64
      门派:XML.ORG.CN
      注册:2006/10/27

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给sangyei发送一个短消息 把sangyei加入好友 查看sangyei的个人资料 搜索sangyei在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看sangyei的博客2
    发贴心情 
    有启发性,前人的经验可以让后人少走弯路.
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/14 17:00:00
     
     eyounx 帅哥哟,离线,有人找我吗?金牛座1982-5-3
      
      
      威望:9
      等级:大四(GRE考了1400分!)(版主)
      文章:272
      积分:1260
      门派:GOOGLEBBS.NET
      注册:2005/3/12

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给eyounx发送一个短消息 把eyounx加入好友 查看eyounx的个人资料 搜索eyounx在『 Web挖掘技术 』 的所有贴子 访问eyounx的主页 引用回复这个贴子 回复这个贴子 查看eyounx的博客3
    发贴心情 
    看到有人说写综述,想说一声,综述是由一个领域的前瞻性大师写的,综述不仅仅是简单的把以前别人的工作总结一下,要对这个领域有深刻的理解,才能理出发展得脉络,指出潜在得问题和前景。刚入门几年的学生写不了好综述,写出来得也没有人看,如果是投到比较有名的杂志会议上,反而会对作者产生不利的影响。

    ----------------------------------------------
    member of LAMDA, CS, NJU
    http://lamda.nju.edu.cn/
    http://lamda.nju.edu.cn/yuy

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/14 17:15:00
     
     zhou123456 美女呀,离线,快来找我吧!
      
      
      等级:大一(猛啃高等数学)
      文章:14
      积分:120
      门派:XML.ORG.CN
      注册:2007/5/26

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给zhou123456发送一个短消息 把zhou123456加入好友 查看zhou123456的个人资料 搜索zhou123456在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看zhou123456的博客4
    发贴心情 
    谢谢,学习了
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/14 18:02:00
     
     zhengfrance 帅哥哟,离线,有人找我吗?
      
      
      等级:大二(研究C++)
      文章:36
      积分:224
      门派:XML.ORG.CN
      注册:2007/3/29

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给zhengfrance发送一个短消息 把zhengfrance加入好友 查看zhengfrance的个人资料 搜索zhengfrance在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看zhengfrance的博客5
    发贴心情 
    to eyounx:
    引用
    看到有人说写综述,想说一声,综述是由一个领域的前瞻性大师写的,综述不仅仅是简单的把以前别人的工作总结一下,要对这个领域有深刻的理解,才能理出发展得脉络,指出潜在得问题和前景。刚入门几年的学生写不了好综述,写出来得也没有人看,如果是投到比较有名的杂志会议上,反而会对作者产生不利的影响。

    说的很对

    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/15 15:05:00
     
     vipsupply 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:12
      积分:102
      门派:XML.ORG.CN
      注册:2007/6/18

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给vipsupply发送一个短消息 把vipsupply加入好友 查看vipsupply的个人资料 搜索vipsupply在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看vipsupply的博客6
    发贴心情 
    找到出路了
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/6/18 13:55:00
     
     lovezhou_2006 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:6
      积分:118
      门派:XML.ORG.CN
      注册:2007/7/7

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给lovezhou_2006发送一个短消息 把lovezhou_2006加入好友 查看lovezhou_2006的个人资料 搜索lovezhou_2006在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看lovezhou_2006的博客7
    发贴心情 
    谢谢大师们!!
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/7/7 9:57:00
     
     nana_2007 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:2
      积分:62
      门派:XML.ORG.CN
      注册:2007/7/7

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给nana_2007发送一个短消息 把nana_2007加入好友 查看nana_2007的个人资料 搜索nana_2007在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看nana_2007的博客8
    发贴心情 
    我的毕业设计打算做数据挖掘,不过我现在还什么都不会呢
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/7/7 20:04:00
     
     clentor 帅哥哟,离线,有人找我吗?
      
      
      等级:大一(高数修炼中)
      文章:12
      积分:107
      门派:XML.ORG.CN
      注册:2007/7/5

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给clentor发送一个短消息 把clentor加入好友 查看clentor的个人资料 搜索clentor在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看clentor的博客9
    发贴心情 
    现在研究生教育哪给你这么多时间在论文上....
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/7/9 9:08:00
     
     lly6614 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:5
      积分:86
      门派:XML.ORG.CN
      注册:2007/7/16

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给lly6614发送一个短消息 把lly6614加入好友 查看lly6614的个人资料 搜索lly6614在『 Web挖掘技术 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看lly6614的博客10
    发贴心情 
    目前的我,一开始的选题不是很好,费时费力,最后老师建议改变一下想法。
    看来有时选择比努力更重要。
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2007/7/16 21:49:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 Web挖掘技术 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/3/28 15:18:34

    本主题贴数85,分页: [1] [2] [3] [4]... [9]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    128.906ms