人类与猪的基因类似度怎么算:推算口径、公式与统计示例

人类与猪的基因类似度怎么算:推算口径、公式与统计示例
2026-10-05 01:05:10 中国幼康网 作者 中幼商家成新引擎?????快手三档指标激励引爆双11流量再分配战争 锡商银杏装换帅易主”背后:仍存股东风险隐忧 高建国 新浪网官方账号

先给结论:“人类与猪的基因类似度”没有一个脱离推算口径的唯一百分比。。 。。。。若是比力的是能否找到对应基因,,,,,,,常见参考基因组注解中,,,,,,,人和猪拥罕见量可观的一对一嫡系同源基因,,,,,,,约为一万七千个量级,,,,,,,占两者蛋白编码基因的大部门 ; ;;;; ;若是比力的是DNA碱基逐位一致率,,,,,,,了局会显著受到比对区域、参考基因组版本、沉复序列和推算公式影响。。 。。。。因而,,,,,,,“人猪基因类似度约几多”必须先注明比力对象和分母。。 。。。。

更稳妥的概括是:人和猪都属于有胎盘哺乳动物,,,,,,,很多根基性命活动有关基因拥有共同起源和类似职能,,,,,,,但这不蹬宗两种动物的全数DNA有同样高的百分比一致,,,,,,,也不代表所有基因都能逐一对应。。 。。。。

人类与猪的基因类似度到底该按什么来算?????

“基因类似度”至少能够指三种分歧内容:第一种是两种动物各自有几多基因可能找到对应物 ; ;;;; ;第二种是对应基因的DNA或蛋白质序列有几多字符一样 ; ;;;; ;第三种是把整个参考基因组放在一路,,,,,,,推算可能对齐的碱基比例。。 。。。。三种步骤的对象、单元和分母分歧,,,,,,,得出的百分比不能相互代替。。 。。。。

比力口径 常用公式 重要回覆的问题
基因对应关系 共同嫡系同源基因数 ÷ 参考物种基因数 ×100% 人类的哪些基因在猪体内有对应基因
编码序列一致性 对齐区域中一样碱基数 ÷ 对齐长度 ×100% 对应基因的DNA序列有多像
蛋白质序列一致性 一样氨基酸数 ÷ 对齐氨基酸长度 ×100% 对应蛋白质的结构和职能基础有多守旧
全基因组比对 一样碱基数 ÷ 选定的比对区域或总区域 ×100% 两套参考基因组整体有几多区域可能比力

其中,,,,,,,“共同嫡系同源基因”通常比单一比力基因名称更靠得住。。 。。。。它指的是统一个祖先基因在物种分化后形成的对应基因。。 。。。。若只看基因名称,,,,,,,可能把职能相近但起源分歧的基因混在一路 ; ;;;; ;若只看序列片段,,,,,,,又可能把沉复区域或无意类似片段误以为真正的同源关系。。 。。。。

若是按基因数量比力,,,,,,,人类和猪能对应几多基因?????

依照常见的人类和猪参考基因组注解,,,,,,,两者的蛋白编码基因都约莫处于两万条左右的量级,,,,,,,其中有约一万七千个量级的一对一嫡系同源基因能够成立较靠得住的对应关系。。 。。。。以人类蛋白编码基由于分母,,,,,,,能够用下面的方式表白:

人类基因覆盖率=人猪共同嫡系同源基因数 ÷ 人类蛋白编码基因数 ×100%

用这一口径,,,,,,,通????D芄坏玫健霸及顺梢陨先死嗟鞍妆嗦牖蛟谥碇杏卸杂ξ铩钡慕崧。。 。。。。但它暗示的是基因存在和对应关系的覆盖率,,,,,,,不是说这些基因的DNA序列有八成碱基齐全一样,,,,,,,更不是说人和猪的整个基因组有八成一样。。 。。。。

若是但愿削减分母选择带来的误差,,,,,,,还能够选取对称的集中类似度:

集中类似度=共同基因数 ÷(人类基因数+猪基因数-共同基因数)×100%

这种算法适合比力两个基因集中的沉叠水平,,,,,,,但它依然只回覆“哪些基因同时存在”,,,,,,,不能注明这些基因的序劣注表白量或生理作用齐全一致。。 。。。。分歧数据库对蛋白编码基因、假基因、转录本和基因天堑的注解分歧,,,,,,,所以统一时期使用分歧版本,,,,,,,统计数量也可能出现差距。。 。。。。

换成DNA序列后,,,,,,,为什么不能直接使用统一个百分比?????

对应基因的DNA序列通常蕴含编码区、内含子和调控区域。。 。。。。蛋白质编码区受到职能限度,,,,,,,往往比非编码区域更容易保留 ; ;;;; ;内含子、基因间区、沉复序列和染色体结构区域的变动则可能更大。。 。。。。因而,,,,,,,选择“只比编码表显子”还是“比力齐全基因”,,,,,,,会直接扭转了局。。 。。。。

即便只比力统一对基因,,,,,,,推算了局也可能分歧。。 。。。。以一段对齐长度为一千个碱基的区域为例,,,,,,,若是有八百个地位一样,,,,,,,按单逐一致率推算就是百分之八十 ; ;;;; ;但若是把插入、缺失、无法靠得住对齐的地位纳入惩治,,,,,,,或者改用类似性评分,,,,,,,了局就不再是统一个数字。。 。。。。

蛋白质序列也有类似情况。。 。。。。DNA产生了部门变动后,,,,,,,由于遗传密码子的冗余性,,,,,,,蛋白质中的氨基酸仍可能维持不变。。 。。。。因而,,,,,,,统一组基因的蛋白质一致率可能高于DNA碱基一致率。。 。。。。另一方面,,,,,,,免疫、感知、滋生和部门代谢有关基因受到的进化压力分歧,,,,,,,不能用一个均匀值代表每个基因。。 。。。。

全基因组层面的“类似度”越发复杂。。 。。。。人类和猪的参考基因组长度、染色体结构、沉复序列比例和组装质量并不齐全一样。。 。。。。某些区域无法逐一对齐,,,,,,,并不愿定意味着齐全没有有关序列,,,,,,,也可能是结构变异、沉复序列或当前组装步骤造成的比力空缺。。 。。。。因而,,,,,,,公开资猜中出现的某个全基因组百分比,,,,,,,必须同时查看比对法式、过滤前提、分母界说和参考基因组版本。。 。。。。

这些统计能注明人和猪在生物学上有多像吗?????

基因对应关系越多,,,,,,,通常注明两种动物共享的根基生物学系统越多。。 。。。。例如,,,,,,,细胞复造、能量代谢、蛋白质合成、神经活动和免疫调节等基础过程,,,,,,,都有一批跨物种守旧的基因参加。。 。。。。但“有对应基因”只注明遗传起源或根基职能存在联系,,,,,,,不代表该基因在两种动物中的表白功夫、表白组织和调控强度一样。。 。。。。

统一个基因在人体和猪体内可能参加类似的生理过程,,,,,,,但由于调控序劣注蛋白质结构、组织组成和代谢环境分歧,,,,,,,最终阐发仍会有差距。。 。。。。所以,,,,,,,钻研人员不会只凭一个“基因类似度百分比”判断两种动物是否可能齐全相互代替,,,,,,,而是会进一步比力具体基因、蛋白质、通路、组织和表型。。 。。。。

这也是为什么“人和猪的基因有多像”与“猪是否适合作为某类钻研对象”不是统一个问题。。 。。。。前者能够用基因组和序列统计回覆,,,,,,,后者还必要参与器官结构、生理反映、免疫系统和尝试主张等前提。。 。。。。

在什么情况下,,,,,,,哪种类似度说法更相宜?????

  • 用于科普或基础相识:能够说人和猪有大量共同的嫡系同源基因,,,,,,,蛋白编码基因层面的对应关系达到八成以上的量级,,,,,,,但不要把它简化成“全基因组类似八成”。。 。。。。
  • 用于生物信息学分析:应注明人类和猪的参考基因组版本、基因注解颁布日期、同源基因数据库、筛选前提以及分母,,,,,,,最好同时汇报基因数量和序列一致率。。 。。。。
  • 用于比力某个具体职能:应直接比力指标基因或通路,,,,,,,而不是引用全物衷旖均值。。 。。。。一个高度守旧的代谢基因,,,,,,,与急剧变动的免疫有关基因,,,,,,,可能得到齐全分歧的了局。。 。。。。
  • 用于判断DNA样正本源:不能只依附一个总体类似度百分比,,,,,,,应使用物种特异性象征或经过验证的序列比对步骤,,,,,,,由于很多基础基因在分歧哺乳动物之间正本就拥有类似性。。 。。。。

因而,,,,,,,最正确的回覆是:人类与猪在基因集中和很多主题生物学职能上拥有较高类似性,,,,,,,但不存在一个合用于所有场景的固定百分比。。 。。。。若比力基因是否有对应物,,,,,,,应使用嫡系同源基因覆盖率 ; ;;;; ;若比力序列,,,,,,,应明确是DNA、蛋白质、编码区还是全基因组,,,,,,,并以指定参考基因组版本和统计公式为准。。 。。。。

出格申明:以上文章内容仅代表作者自己概想,,,,,,,不代表新浪网概想或态度。。 。。。。如有关于文章内容、版权或其它问题请于文章颁发后的30日内与新浪网联系。。 。。。。
来自于:新浪网官方
网友评论
董基勇:社会必须迅速就三大支柱的职能达成共识
电子行业资金流出榜:立讯精密、豪威集团等净流出资金居前
分享到微博
颁布
最热评论
最新评论
暂无评论

举报邮箱:[email protected]

Copyright ? 1996-2026 SINA Corporation

All Rights Reserved 新浪公司 版权所有