生物信息学的概念及其发展历史课件.ppt
- 【下载声明】
1. 本站全部试题类文档,若标题没写含答案,则无答案;标题注明含答案的文档,主观题也可能无答案。请谨慎下单,一旦售出,不予退换。
2. 本站全部PPT文档均不含视频和音频,PPT中出现的音频或视频标识(或文字)仅表示流程,实际无音频或视频文件。请谨慎下单,一旦售出,不予退换。
3. 本页资料《生物信息学的概念及其发展历史课件.ppt》由用户(晟晟文业)主动上传,其收益全归该用户。163文库仅提供信息存储空间,仅对该用户上传内容的表现方式做保护处理,对上传内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知163文库(点击联系客服),我们立即给予删除!
4. 请根据预览情况,自愿下载本文。本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
5. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007及以上版本和PDF阅读器,压缩文件请下载最新的WinRAR软件解压。
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 生物 信息学 概念 及其 发展 历史 课件
- 资源描述:
-
1、第十章:统计学习与推理普通高等教育“十二五”规划教材生物信息学生物信息学Bioinformatics第一节 统计学习与推理基础一、fisher经典参数统计理论fisher把判别分析、回归分析和密度估计问题等表达为特定参数化模型的参数估计问题,并提出了估计所有模型未知参数的方法最大似然法。二、经典非线性法ANN(artificial neural network)三、小样本统计学习理论(一)VC维(二)推广性的界对各种类型的函数集,统计学习理论系统地研究了其经验风险与期望风险之间的关系,即推广性的界。(三)结构风险最小(四)小样本与转导推理四、基于概率的方法基于概率的方法主要包括贝叶斯(Baye
2、s)推理及隐马尔可夫模型(hidden Markov model,HMM),其中贝叶斯推理需利用来源于经验和历史资料的先验信息。第二节 统计模型与参数推断一、参数估计量的评选标准(一)无偏性参数估计量的期望值与参数真值是相等的,这种性质称为无偏性。具有无偏性的估计量称为无偏估计量。(二)有效性(三)相合性(四)充分性与完备性二、最小二乘估计三、最大似然估计(一)似然函数对于离散型随机变量,似然函数是多个独立事件的概率函数的乘积,该乘积是概率函数值,它是关于总体参数的函数。例:一只大口袋里有红、白、黑3种球,采用复置抽50次,得到红、白、黑3种球的个数分别为12、24、14,根据多项式的理论建立
3、似然函。(二)最大似然估计所谓最大似然估计就是指使似然函数值为最大以获得总体参数估计的方法。例:求红、白、黑球实例中 的最大似然估计值。第三节 聚类分析、主成分分析与Fisher判别一、聚类分析(一)数据变换(二)亲疏程度测度(三)系统聚类方法:最短距离法、最长距离法、中间距离法、重心距离法、类平均法、可变类平均法、可变法、离差平方和法。二、主成分分析(一)基本原理主成分分析(PCA)是把多个指标化为少数几个综合指标的一种统计分析方法。(二)分析步骤1)原始数据的标准化2)样本矩阵的相关系数矩阵3)特征向量4)选择主成分三、Fisher判别基于Fisher准则,判别的结果应使两组间别最大,使每
展开阅读全文