DNA: 人类的终极U盘

简介:




导读

DNA是一种双链结构的分子,主要功能是长期性的资讯储存,被喻为“蓝图”或“食谱”。DNA不仅紧凑而且复杂,因此,从理论上来说,1克DNA就能将互联网巨头谷歌和脸谱上所有海量数据囊括其中,且还有富裕空间。

扪心自问一下,我们存储在硬盘或移动闪存内的信息可以保存多久呢?5年?10年?还是更久?

据美国有线电视新闻网(CNN)近日报道,目前,一家名为Backblaze的在线备份服务商正在同时运行2.5万个硬盘,它们希望借此将这个问题查个水落石出。尽管该调查目前仅仅进行了5年,但研究结果表明,4年的损耗率就高达22%。Backblaze公司表示,有些服务器的寿命可能有10多年,而有些则不足1年。但不管怎样,存储设备无法永远存在。

因此,科学家们开始四处寻觅,希望找到能使数据存续数百万年之久的存储方法。

DNA或成终极数据存储器

瑞士苏黎世理工学院的研究人员相信,答案可能就在每个活体细胞都有的数据存储系统:脱氧核糖核酸(DNA)内。DNA是一种双链结构的分子,主要功能是长期性的资讯储存,被喻为“蓝图”或“食谱”。DNA不仅紧凑而且复杂,因此,从理论上来说,1克DNA就能将互联网巨头谷歌和脸谱上所有海量数据囊括其中,且还有富裕空间。

研究人员表示,这1克DNA能容纳455EB(艾字节)的数据,相当于4550GB字节的数据,而5EB就相当于至今全世界人类所讲过的话语。

化石作用让DNA长期保存

众所周知,化石作用让古生物化石中的DNA在特殊条件下可以被保存下来,人们可以从中获得动物的整个基因组。迄今为止,科学家们已经对11万年前的北极熊和70万年前的马的基因组进行了提取和测序。

苏黎世理工学院化学和应用生物科学系讲师罗伯特•格拉斯表示,DNA也存在着巨大的问题,那就是它会很快降解。格拉斯在接受CNN采访时表示:“我们已经发现了使DNA非常稳定的简单方法,希望能找到办法,将DNA的高存储密度和稳定性这两个属性结合起来,应用于数据存储方面。”

格拉斯说:“就目前的情况来看,化石中的DNA最多能保存70万年,不过,也有人推断能在化石骨头内发现存在时间长达百万年之久的遗传物质。我们已经证明,我们制造出的DNA和信息存储的衰变速度同化石DNA的相同,因此,我们或能得到大约100万年的存储时间。”

考古学领域的最新发现也进一步刷新了人们对DNA保存能力的认知。据媒体报道,2013年年底,古生物学家从一根来自西班牙的40万年前的股骨中提取出了DNA,这些化石是上世纪90年代从西班牙北部一处叫做“骨坑”(Sima de los Huesos)的地方发掘出来的,这段DNA是公开发表的最古老的人类DNA,将此前纪录提前了足足30万年。其中的神奇之处在于,这个DNA能在墓穴这个相对来说比较寒冷但非冰冻的环境下存活下来。

格拉斯说:“还有很多谜题有待解开,我们希望进一步弄清楚DNA的衰变机制。”

人工模拟化石作用

现在,我们都知道,水和氧气是DNA生存的敌人。在一个试管中且暴露在空气中的DNA只能存活2年到3年;而将DNA密封在一个玻璃(一个无菌且中性的环境)内并对其进行冷却,可以增加其生存几率。

研究人员解释道,人工办法其实也模拟了自然界中发生的现象,如果化石能让DNA处于寒冷、干燥且密封的状态,那么,微型玻璃圆球也能让双链中包含的信息数千年毫发无伤。格拉斯说:“溶胶—凝胶技术可以利用小分子制造固体物质,因此,我们能借用这一过程制造出包围DNA分子的玻璃。”

该研究可与科幻大片《侏罗纪公园》相媲美。在《侏罗纪公园》中,研究人员利用琥珀中吸食恐龙血液的蚊子,最终克隆出恐龙,并建造了一个侏罗纪时代公园。不过,格拉斯说,通过琥珀内的史前昆虫来获得史前DNA,这一想法并不靠谱。他说:“最好的DNA来源是陶瓷和干燥的物体,因此,牙齿、骨头甚至蛋壳更有可能。”

成本有望不断降低

迄今为止,该研究团队通过仅仅保存83KB的数据来对最新方法进行测试。格拉斯介绍说:“我们保存了两个大文件,一个是《1921年瑞士联邦宪章》;另一个是阿基米德重写本。我们希望通过存储这些文件来证明,我们的方法不仅有用,而且很重要。”

他推断,在1万年内,信息是可读的;而如果在冰冻状态下,可以存储100万年之久。据悉,为这86KB的信息编码的成本大约为2000美元,目前来看有点昂贵,但格拉斯乐观地认为,医学分析领域取得的进步很有可能让成本大幅降低。

格拉斯说:“人类基因组测序的价格已经从几年前的数百万美元下降到现在的数百美元。现在,似乎到了我们将医学分析和基因组分析领域取得的进步整合进信息技术领域的时刻了,一旦如此,整个信息技术将呈现出崭新的面貌。”


原文发布时间为:2015-05-14


本文来自云栖社区合作伙伴“大数据文摘”,了解相关信息可以关注“BigDataDigest”微信公众号

相关文章
|
5月前
|
数据采集 机器学习/深度学习 人工智能
Python+AI实战:从零构建智能图像识别系统(一)
教程来源 https://yyvgt.cn/category/jiulishi.html 本文详解如何用Python从零构建生产级智能商品分类系统,涵盖数据采集、增强、模型训练(ResNet/EfficientNet/ViT)、优化、ONNX/TensorRT部署、FastAPI服务、A/B测试与持续学习全链路,直面真实AI落地挑战。
|
人工智能 自然语言处理 安全
基于LlamaIndex实现CodeAct Agent:代码执行工作流的技术架构与原理
CodeAct是一种先进的AI辅助系统范式,深度融合自然语言处理与代码执行能力。通过自定义代码执行代理,开发者可精准控制代码生成、执行及管理流程。本文基于LlamaIndex框架构建CodeAct Agent,解析其技术架构,包括代码执行环境、工作流定义系统、提示工程机制和状态管理系统。同时探讨安全性考量及应用场景,如软件开发、数据科学和教育领域。未来发展方向涵盖更精细的代码生成、多语言支持及更强的安全隔离机制,推动AI辅助编程边界拓展。
942 3
基于LlamaIndex实现CodeAct Agent:代码执行工作流的技术架构与原理
|
SQL 分布式计算 关系型数据库
|
存储 关系型数据库 MySQL
double ,FLOAT还是double(m,n)--深入解析MySQL数据库中双精度浮点数的使用
本文探讨了在MySQL中使用`float`和`double`时指定精度和刻度的影响。对于`float`,指定精度会影响存储大小:0-23位使用4字节单精度存储,24-53位使用8字节双精度存储。而对于`double`,指定精度和刻度对存储空间没有影响,但可以限制数值的输入范围,提高数据的规范性和业务意义。从性能角度看,`float`和`double`的区别不大,但在存储空间和数据输入方面,指定精度和刻度有助于优化和约束。
2388 5
|
存储 运维 分布式计算
面经:HDFS分布式文件系统原理与故障排查
【4月更文挑战第10天】本文深入剖析了HDFS的底层原理和面试重点,包括HDFS的架构(NameNode、DataNode、Secondary NameNode)、文件读写流程、高级特性(快照、Erasure Coding、Federation、High Availability)以及故障排查方法。通过HDFS Shell命令示例,加强理解,并对比了HDFS与其他分布式文件系统的优缺点。掌握这些知识将有助于求职者在面试中脱颖而出,应对HDFS相关技术考察。
1076 3
|
编译器 C++ 容器
【C++进阶】深入STL之vector:深入研究迭代器失效及拷贝问题
【C++进阶】深入STL之vector:深入研究迭代器失效及拷贝问题
|
负载均衡 Java 微服务
Java错误:com.netflix.client.ClientException: Load balancer does not have available server for client
Java错误:com.netflix.client.ClientException: Load balancer does not have available server for client
|
缓存 搜索推荐 Java
go包管理速通,一篇文章就够了,再也不用担心因为不会导包被辞退
最近在看一些go语言相关的书,发现了一个有意思的事情:其中一本书最新印刷的版本是2017年3月,而golang包管理的后起之秀go module伴随go1.11于2018年8月诞生
2884 0
go包管理速通,一篇文章就够了,再也不用担心因为不会导包被辞退
|
存储 缓存 前端开发
微机原理与接口技术 微处理器架构详解
本文主要详解微处理器的架构。从微处理器的分类开始,到微处理器的历史、冯·诺依曼结构、哈佛结构等进行了细致地分析与总结。
1156 1
微机原理与接口技术 微处理器架构详解
|
光互联 网络架构 异构计算
BOSHIDA 电源模块的主要特性
电源模块是可以直接贴装在印刷电路板上的电源供应器,其特点是可为专用集成电路(ASIC)、数字信号处理器 (DSP)、微处理器、存储器、现场可编程门阵列 (FPGA) 及其他数字或模拟负载提供供电。一般来说,这类模块称为负载点 (POL) 电源供应系统或使用点电源供应系统 (PUPS)。由于模块式结构的优点甚多,因此模块电源广泛用于交换设备、接入设备、移动通讯、微波通讯以及光传输、路由器等通信领域和汽车电子、航空航天等。

热门文章

最新文章