下载APP
交汇点新闻APP
交汇点新闻APP二维码

扫码下载

新华报业网微信
新华报业网微信二维码

扫码关注

人类与狗猪亲缘关系:它们究竟有多近?

DNA对比图中的“相似度”,通常表示两份样本在被检测的遗传标记、碱基位点或DNA片段上有多大程度符合设定的匹配规则。但它不是一个统一标准,也不等于“亲缘关系概率”。同样写着“相似度”的结果,可能比较的是位点一致性、共享DNA片段、遗传距离,或与某个祖源人群的接近程度。要正确理解,必须先看图表的比较对象、计算范围和指标名称。

DNA对比图里的“相似度”到底在比较什么?

一张DNA对比图一般不会把两个人的全部遗传信息简单相除,而是从特定检测范围中提取可比较的内容,再用比例、分数、距离或概率呈现结果。常见含义主要有以下几类:

  • 位点匹配比例:比较指定遗传标记上是否相同,适合说明检测区域内有多少位点符合。
  • 共享DNA片段:观察两份样本是否拥有连续的相同片段,常用于亲属关系分析。共享片段的长度、数量和分布,往往比一个总分更有参考意义。
  • STR或SNP结果的匹配程度:亲子鉴定、法医学或基因分型可能使用不同类型的标记。图上的“匹配”不一定代表整条染色体完全相同。
  • 遗传距离或祖源接近度:将个人样本与参考人群、地区或数据库进行比较,表示统计上的接近,不直接等于两人存在近亲关系。
  • 亲缘关系概率:这是根据多个位点、假设关系和统计模型计算出的概率或似然指标,不能与普通的“DNA相似度百分比”混用。

因此,看到“相似度较高”时,先不要直接解释为“血缘关系较近”。更准确的说法是:在这张图采用的检测范围和算法下,两份样本呈现出较多共同特征。至于这些共同特征能否支持亲子、兄弟姐妹或其他关系,还要看报告使用的专门模型。

为什么同一对样本会出现不同的相似度?

不同平台、不同检测项目甚至同一项目的不同图表,可能给出不一样的分数,原因通常不在于DNA本身发生了变化,而在于比较范围和计算方式不同。

影响因素 它改变了什么 阅读时应关注什么
检测标记数量 参与比较的位点越多,结果覆盖范围可能越广 看报告写明的是少量标记、STR、SNP,还是更大范围的测序数据
比较对象 亲子、兄弟姐妹、双胞胎和祖源参考人群使用的判断逻辑不同 先确认图表是在比较亲缘关系,还是比较祖源或样本特征
统计模型 同一组数据可能被换算成比例、分数、距离或概率 优先查看指标定义,不要只比较数字大小
参考数据库 祖源或人群分析会受到参考样本构成影响 看参考地区、样本范围和平台说明
样本质量 缺失位点、污染或检测失败可能影响匹配结果 检查是否标注了有效位点数量、缺失数据或质量提示

例如,图表把“共享片段”显示为颜色深浅时,深色可能代表共享片段较多,也可能代表某个区域的匹配分数更高;如果没有图例和指标说明,仅凭颜色无法判断实际含义。图中的百分比也必须确认分母是什么:是全部检测位点、有效位点、共享片段长度,还是与参考人群的相似程度。

不同使用场景下,应该选择哪一种相似度?

想判断是否存在亲子关系

不要优先看泛化的“DNA相似度”。亲子鉴定应重点查看检测采用的遗传标记、亲子关系概率、似然比以及报告的正式结论。父母与子女会共享部分遗传信息,但“共享较多”只是生物学现象,不能单独替代亲子关系计算。

如果报告只展示一张颜色对比图,却没有亲子关系概率、检测位点说明或结论栏,那么这张图通常只能作为可视化展示,不能据此作出正式认定。

想区分兄弟姐妹、半同胞或其他亲属

这类问题应优先看共享DNA片段的数量、长度和分布,以及报告是否分别计算了全同胞、半同胞、叔侄或其他关系的可能性。兄弟姐妹之间的遗传共享并不是固定不变的,实际结果会受到遗传重组影响,因此不能只拿一个“相似度百分比”套用固定关系。

当多个关系选项都存在一定可能性时,应选择提供关系似然比较、共享片段分析和样本质量说明的报告,而不是只选择分数最高的图表。

想了解两个人的祖源或人群接近度

这时“相似度”通常是个人样本与参考人群之间的统计接近度。它可以帮助理解两人的祖源构成是否接近,却不能直接证明两人是近亲。两个人都被归入相近祖源区域,可能是因为参考人群相同,并不代表两人之间存在可确认的家族关系。

选择这类结果时,应重点看参考数据库覆盖哪些地区、使用了什么分析类别,以及平台是否把“祖源接近”与“亲缘匹配”分开呈现。

想比较同卵双胞胎或高度相近的样本

同卵双胞胎通常会表现出非常接近的遗传特征,但检测目的不同,图表仍可能出现少量差异。差异可能来自检测范围、样本质量、分析误差,或检测的是会随环境和年龄变化的表观遗传信息,而不是稳定的遗传序列。因此,不能只根据一张普通相似度图判断样本是否属于双胞胎。

读到一个相似度数字后,先看哪几项?

可以按照“指标名称—比较范围—关系模型—最终结论”的顺序阅读。若图表明确写出“有效位点匹配率”,就把它理解为检测区域内的位点比较;若写出“共享片段”,就重点观察片段的数量、长度和分布;若写出“祖源相似度”,就把它理解为与参考人群的接近程度;若写出“亲缘概率”,则要进一步确认它对应的是哪一种假设关系。

  1. 先确认样本:看图中两份DNA分别来自谁,是否存在样本编号混淆。
  2. 再确认指标:找“匹配位点、共享片段、遗传距离、亲缘概率”等定义。
  3. 查看检测范围:确认比较的是全部数据、部分标记,还是经过筛选的有效位点。
  4. 对照使用场景:亲子关系看亲子模型,亲属分析看共享片段,祖源分析看参考人群。
  5. 最后看正式结论:如果图表数字与报告文字不一致,以检测机构对指标和关系假设的解释为准。

例如,图中只有“相似度87%”,没有单位、检测范围和指标定义时,先不要把它解释成兄弟姐妹、亲子或其他关系。应回到原始报告查看图例和方法说明;如果仍没有定义,就只能判断为“在该平台的某项比较规则下较为接近”,不能进一步推导具体血缘关系。

相似度高,能不能直接说明两个人是亲属?

不能直接说明。人类个体本来就共享大量基础遗传信息,而不同关系的样本也可能在有限检测区域内出现较高匹配。相似度高只能说明共同特征较多;只有当检测标记、关系假设、统计模型和样本质量都适合时,结果才可能支持某种亲缘判断。

相反,相似度较低也不能脱离检测条件单独下结论。若检测范围很小、有效位点不足,或图表比较的是祖源而不是亲缘,数字就不能用于排除特定关系。最合适的选择原则是:想判断什么关系,就选择针对该关系设计的指标,而不是选择看起来更高的相似度数字。

人类与狗猪亲缘关系:它们究竟有多近?
人类与狗猪亲缘关系:它们究竟有多近?
责编:刘虎
版权和免责声明

版权声明:凡来源为“交汇点、新华日报及其子报”或电头为“新华报业网”的稿件,均为新华报业网独家版权所有,未经许可不得转载或镜像;授权转载必须注明来源为“新华报业网”,并保留“新华报业网”的电头。

免责声明:本站转载稿件仅代表作者个人观点,与新华报业网无关。稿件内容请读者仅作参考,并自行核实相关信息。