新书推介:《语义网技术体系》
作者:瞿裕忠,胡伟,程龚
   XML论坛     W3CHINA.ORG讨论区     计算机科学论坛     SOAChina论坛     Blog     开放翻译计划     新浪微博  
 
  • 首页
  • 登录
  • 注册
  • 软件下载
  • 资料下载
  • 核心成员
  • 帮助
  •   Add to Google

    >> Biomatics, Gene Ontology(基因本体)
    [返回] 中文XML论坛 - 专业的XML技术讨论区计算机技术与应用『 生物信息学 』 → 超级难题应该没人做得出 查看新帖用户列表

      发表一个新主题  发表一个新投票  回复主题  (订阅本版) 您是本帖的第 11146 个阅读者浏览上一篇主题  刷新本主题   树形显示贴子 浏览下一篇主题
     * 贴子主题: 超级难题应该没人做得出 举报  打印  推荐  IE收藏夹 
       本主题类别:     
     北大我来了 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:1
      积分:75
      门派:XML.ORG.CN
      注册:2006/6/13

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给北大我来了发送一个短消息 把北大我来了加入好友 查看北大我来了的个人资料 搜索北大我来了在『 生物信息学 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看北大我来了的博客楼主
    发贴心情 超级难题应该没人做得出

    二进制指纹向量丢失位计算
    基因表达谱是一个二维实数数组[aij]n*m,用来表达生物探针与实际DNA片段的匹配情况。在癌症DNA诊断与DNA克隆分类应用中,必须将基因表达谱进行数据分类。
    基因表达谱分类实际是基因表达数据向量的分类,分类原则为:将[aij]n*m看作m个n维实数向量,若两个向量十分类似,即可归为一类。可将基因表达谱转化为n位二进制序列集合F={X1,…,Xm}{0,1}n,“能够转化为相同二进制序列的实数向量归为同一类”。但在实数向量到二进制序列的转化中,某些二进制位难以确定其0/1取值,这样的二进制位称为丢失位。转化得到的可能带有丢失位的二进制向量又称为指纹向量。不含有丢失位的指纹向量称为结果向量。
    必须确定指纹向量中丢失位的0/1取值,才能完全确定基因表达谱的分类结果。丢失位确定后,有多少个结果向量,基因表达谱即分为几类,基因表达普分类可看作指纹向量分类,同类指纹向量可得到相同的结果向量。按照以往经验,结果向量越少,则分类结果越准确。因此可通过“结果向量最少”为目标计算指纹向量中丢失位取值。例如有指纹向量集F={X1=00N01, X2=N0101, X3=0N00N, X4=01N00},其中N表示丢失位,最少可将X划分成两类,{X1,X2}一类,对应的实际结果向量为00101,{X3, X4}分为一类,对应的实际结果向量为01000。在实际应用中,指纹向量出现丢失位是必然的,但每个指纹向量中丢失位数不可能太多。因此问题如下:
    (1)假设每个指纹向量中最多含有一个丢失位,试设计算法计算给定指纹向量中丢失位取值,使结果向量数最少。
    (2)下面给出两组指纹向量。每个指纹向量均为20位,其中一位为丢失位。试用你的方法分别计算两组向量的丢失位,给出得到的结果向量。


    由于题目数据过大,只给出一部分数据了

    指纹向量集1
    FPbegin
    000N1111101010000100
    000111111010100001N0
    00011111101010N00100
    00011111N01010000100
    000111N1101010000100
    由于题目数据过大,只给出一部分数据了,关键是方法嘛,请大家努力提供方法!


       收藏   分享  
    顶(0)
      




    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/6/13 15:07:00
     
     北大我来了 帅哥哟,离线,有人找我吗?
      
      
      等级:大一新生
      文章:1
      积分:75
      门派:XML.ORG.CN
      注册:2006/6/13

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给北大我来了发送一个短消息 把北大我来了加入好友 查看北大我来了的个人资料 搜索北大我来了在『 生物信息学 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看北大我来了的博客2
    发贴心情 
    哈哈,果然没人解得出,我想了很长时间,一直觉得是NP问题
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/6/15 13:12:00
     
     谢小荼 美女呀,离线,快来找我吧!
      
      
      等级:大一新生
      文章:1
      积分:59
      门派:XML.ORG.CN
      注册:2006/6/30

    姓名:(无权查看)
    城市:(无权查看)
    院校:(无权查看)
    给谢小荼发送一个短消息 把谢小荼加入好友 查看谢小荼的个人资料 搜索谢小荼在『 生物信息学 』 的所有贴子 引用回复这个贴子 回复这个贴子 查看谢小荼的博客3
    发贴心情 
    不懂,好晕
    点击查看用户来源及管理<br>发贴IP:*.*.*.* 2006/6/30 22:27:00
     
     GoogleAdSense
      
      
      等级:大一新生
      文章:1
      积分:50
      门派:无门无派
      院校:未填写
      注册:2007-01-01
    给Google AdSense发送一个短消息 把Google AdSense加入好友 查看Google AdSense的个人资料 搜索Google AdSense在『 生物信息学 』 的所有贴子 访问Google AdSense的主页 引用回复这个贴子 回复这个贴子 查看Google AdSense的博客广告
    2024/4/27 9:42:12

    本主题贴数3,分页: [1]

    管理选项修改tag | 锁定 | 解锁 | 提升 | 删除 | 移动 | 固顶 | 总固顶 | 奖励 | 惩罚 | 发布公告
    W3C Contributing Supporter! W 3 C h i n a ( since 2003 ) 旗 下 站 点
    苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》
    46.875ms