生物信息学中的不确定和分类问题.ppt

上传人:小飞机 文档编号:6369057 上传时间:2023-10-21 格式:PPT 页数:19 大小:2.35MB
返回 下载 相关 举报
生物信息学中的不确定和分类问题.ppt_第1页
第1页 / 共19页
生物信息学中的不确定和分类问题.ppt_第2页
第2页 / 共19页
生物信息学中的不确定和分类问题.ppt_第3页
第3页 / 共19页
生物信息学中的不确定和分类问题.ppt_第4页
第4页 / 共19页
生物信息学中的不确定和分类问题.ppt_第5页
第5页 / 共19页
点击查看更多>>
资源描述

《生物信息学中的不确定和分类问题.ppt》由会员分享,可在线阅读,更多相关《生物信息学中的不确定和分类问题.ppt(19页珍藏版)》请在三一办公上搜索。

1、生物信息学中的不确定性和分类问题,邹 权(博士、副教授)厦门大学数据挖掘实验室http:/,提纲,生物信息学和机器学习的关系一些生物信息学中的分类问题microRNA识别蛋白质功能预测基因表达数据分析全基因组关联分析总结,生物信息学,人类基因组计划数据存储-数据库数据分析-数据挖掘Olson M V.Human genetics:Dr Watsons base pairsJ.Nature,2008,452(7189):819-820.HapMap计划/1000 Genome计划大数据,生物信息学中的我国计算机学者,算法阶段(1990-2000)朱大铭、姜涛、卜东波标注阶段(2000-2008)

2、王晓龙、朱小燕等系统分析阶段(2008-2013)李衍达、张学工等大规模数据处理阶段(2010-now)华大基因,一些生物信息学中的分类问题,microRNA识别蛋白质功能预测基因表达数据分析全基因组关联分析,microRNA识别,2006年诺贝尔奖-RNA干扰机制CCCCUCUAUUCACAAUUGUUUGGAACUCAGUUUUGUGAUUAUUCUAUCAUUGCCAGGGAGUUUGUGUGGUUGCAUCAGGGG,microRNA分类相关论文,Chenghai Xue,Fei Li,Tao He,Guo-Ping Liu,Yanda Li,Xuegong Zhang.Classif

3、ication of real and pseudo microRNA precursors using local structure-sequence features and support vector machine.BMC Bioinformatics.2005.6:310(google scholar引用271次,截至2014.8.2)Peng Jiang,Haonan Wu,Wenkai Wang,Wei Ma,Xiao Sun,Zuhong Lu.MiPred:classification of real and pseudo microRNA precursors usin

4、g random forest prediction model with combined features.Nucleic Acids Research.2007,35:W339-W344(google scholar引用239次,截至2014.8.2)Leyi Wei,Minghong Liao,Yue Gao,Rongrong Ji,Zengyou He,Quan Zou.Improved and promising identification of human microRNAs by incorporating a high-quality negative Set.IEEE/A

5、CM Transactions on Computational Biology and Bioinformatics.2014,11(1):192-201,microRNA与疾病的关系,图挖掘相似度度量、不确定性参考文献Jiang Q,Hao Y,Wang G,et al.Prioritization of disease microRNAs through a human phenome-microRNAome networkJ.BMC Systems Biology,2010,4(Suppl 1):S2.Xuan P,Han K,Guo M,et al.Prediction of mic

6、roRNAs associated with human diseases based on weighted k most similar neighborsJ.PloS one,2013,8(8):e70204.,一些生物信息学中的分类问题,microRNA识别蛋白质功能预测基因表达数据分析全基因组关联分析,蛋白质功能预测,问题输入:蛋白质序列,进行聚类、分类特殊蛋白识别-不平衡分类亚细胞定位-多类分类酶和多功能酶-多类,少量多标记功能预测-多示例、多标记二级结构、结构域-标注、HMM难点特征提取分类器,一些生物信息学中的分类问题,microRNA识别蛋白质功能预测基因表达数据分析全基因组关联分析,基因表达数据分析,14/57,聚类,分类,双聚类,一些生物信息学中的分类问题,microRNA识别蛋白质功能预测基因表达数据分析全基因组关联分析,全基因组关联分析(GWAS),GWAS,难点高维小样本SNP-SNP相互作用结果的可解释性前景疾病的遗传机理遗传育种(作物、养殖),总结,机器学习在寻找生物信息学应用-分类、聚类、降维、不确定性结果的解释和验证生物实验验证文献验证生物信息学在寻找机器学习数据量在增大统计学无法满足精度需要,邹权,Email:,敬请指正!,

展开阅读全文
相关资源
猜你喜欢
相关搜索
资源标签

当前位置:首页 > 生活休闲 > 在线阅读


备案号:宁ICP备20000045号-2

经营许可证:宁B2-20210002

宁公网安备 64010402000987号