关键词不能为空

当前您在: 主页 > 数学 >

数学初中联赛2000年全国数学建模竞赛A题题目

作者:高考题库网
来源:https://www.bjmy2z.cn/gaokao
2020-11-19 23:13
tags:数学建模竞赛, 数学, 自然科学

-中国江苏

2020年11月19日发(作者:瞿晓铧)
2000年全国大学生数学建模竞赛题目
A题 DNA序列分类
2000年6月 ,人类基因组计划中DNA全序列草图完成,预计2001年可以完
成精确的全序列图,此后人类将拥有 一本记录着自身生老病死及遗传进化的全部
信息的“天书”。这本大自然写成的“天书”是由4个字符A ,T,C,G按一定
顺序排成的长约30亿的序列,其中没有“断句”也没有标点符号,除了这4个字符表示4种碱基以外,人们对它包含的“内容”知之甚少,难以读懂。破译这
部世界上最巨量信息 的“天书”是二十一世纪最重要的任务之一。在这个目标中,
研究DNA全序列具有什么结构,由这4个 字符排成的看似随机的序列中隐藏着什
么规律,又是解读这部天书的基础,是生物信息学(Bioinf ormatics)最重要的
课题之一。
虽然人类对这部“天书”知之甚少,但也发现了D NA序列中的一些规律性
和结构。例如,在全序列中有一些是用于编码蛋白质的序列片段,即由这4个字
符组成的64种不同的3字符串,其中大多数用于编码构成蛋白质的20种氨基酸。
又例如,在 不用于编码蛋白质的序列片段中,A和T的含量特别多些,于是以某
些碱基特别丰富作为特征去研究DN A序列的结构也取得了一些结果。此外,利
用统计的方法还发现序列的某些片段之间具有相关性,等等。 这些发现让人们相
信,DNA序列中存在着局部的和全局性的结构,充分发掘序列的结构对理解DNA< br>全序列是十分有意义的。目前在这项研究中最普通的思想是省略序列的某些细
节,突出特征,然后 将其表示成适当的数学对象。这种被称为粗粒化和模型化的
方法往往有助于研究规律性和结构。
作为研究DNA序列的结构的尝试,提出以下对序列集合进行分类的问题:
1)下面有20个已知类别的人工制造的序列(见下页),其中序列标号1—10
为A类,11-20 为B类。请从中提取特征,构造分类方法,并用这些已知类别的
序列,衡量你的方法是否足够好。然后用 你认为满意的方法,对另外20个未标
明类别的人工序列(标号21—40)进行分类,把结果用序号( 按从小到大的顺
序)标明它们的类别(无法分类的不写入):
A类 ; B类 。
请详细描述你的方法,给出计算程序。如果你部分地使用了现成的分类方法,
也要将方法名称准确注明。
这40个序列也放在如下地址的网页上,用数据文件Art-model-data 标识,在网
上下载。
2)在同样网址的数据文件Nat-model-data 中给出了 182个自然DNA序列,
它们都较长。用你的分类方法对它们进行分类,像1)一样地给出分类结果。
提示:衡量分类方法优劣的标准是分类的正确率,构造分类方法有许多途径,例
如提取序列的某 些特征,给出它们的数学表示:几何空间或向量空间的元素等,
然后再选择或构造适合这种数学表示的分 类方法;又例如构造概率统计模型,然
后用统计方法分类等。



-人人看


-氧化沟


-莨菪


-钢片琴


-胝


-大决战电影


-浒苔


-20岁



本文更新与2020-11-19 23:13,由作者提供,不代表本网站立场,转载请注明出处:https://www.bjmy2z.cn/gaokao/448275.html

2000年全国数学建模竞赛A题题目的相关文章