中国工程院院士沈昌祥:构建多层次、高质量的多重防御大数据防护体系

简介:

ZD至顶网CIO与应用频道 01月16日 北京消息:近日,由中国信息技术服务产业联盟主办,工业和信息化部软件与集成电路促进中心承办的第六届中国信息技术服务产业年会召开,探讨新常态和互联网+下信息技术服务产业的发展思路。

中国工程院院士沈昌祥认为,等级保护完全适合于大数据的处理,不同重要程度采取不同的管理安全措施来达到保障,全过程增加信息安全保障能力的。

中国工程院院士沈昌祥:构建多层次、高质量的多重防御大数据防护体系

中国工程院院士沈昌祥

以下为演讲实录:

大家已经知道了没有网络安全就没有国家安全。大数据已经成为信息行业的热题,大家都以大数据来处理各种问题。大数据的安全问题是当务之急,它是什么?我们所说大数据是什么东西?我们一定要搞清楚大数据不光是数据大,我们应该抓住大数据的实质是什么?所以我们说大数据不光是数据量大就叫大数据。现在社会上流行的每家每户都是大数据源,数据源大了就叫大数据?

我说不是,我说大数据不光是数据大,是一个数量特征不是一个单元,是多元异构的数据量大。请注意是来自多方面多单位,多行业的数据集合,数据大就叫大数据。

第二数据种类非常之多,而且就这一块因此构成了非结构化的这样的结构。结构破坏了,因为来自多方异构的。

第三因此这些数据几乎各家各户不需要这些数据,数据作为各单位已经没有价值了是垃圾,因此它本身的价值的密度很低,但是垃圾里面有金矿可以梳理出很有用的东西来。

第四我们要处理快,实时处理,不要让垃圾堆山,把有用的知识,有的规律归纳出来就够了。

简单比喻一下我们综合处理各家各户不需要的数据,没有价值的数据,收集起来重新处理再深度挖掘,发现一些规律性东西,事实性的东西,战略性的传播,我们要把大数据含义搞清楚,把真正大数据影响说清楚。通俗解释就是数据垃圾的综合处理。因此,大家想想从垃圾数据收集中间处理、挖掘,然后它的成果出来了,有价值东西出来以后,如何处理?如何保护?如何分配?发挥它的效应,全过程都要注重它的安全,网络安全、系统处理安全、供应链安全再加上数据安全才发挥体现。怎么办?我们从两个方面考虑。一个要纳入社会管理体系,也就是等级保护,等级保护完全适合于我们大数据的处理。等级保护我们可以这么看,不同重要程度采取不同的管理安全措施来达到保障。因此说我们全过程增加信息安全保障能力的。

我们分为五级:

第一级大家自己处理可以了,最低的,叫做自主的。

第二级一定范围的,不是自己个人说了算,一个单位说了算,所以我们叫单位的自主级,也就是说一个单位好多人用,好多人处理,你要做一个记录,我们叫做审计。

第三级涉及到社会秩序公共利益,那就不是单位说了算了,要系统说了算,也就是人要定权限,强制访问控制,也就是一个单位有保密系统定级,由它规定它的访问规则。第三级为安全标识保护级。

第四级我们叫做结构化保护级。太重要了涉及到重大特别严重的社会秩序公共利益的损害,或者严重影响国家之间的安全。比如说像电网,它破坏以后社会停电了等等。因此我们要标识强制访问控制,什么人访问什么事?保密性有了还不行,要严格管理,没有可以旁入的,我们保密标识还不行,要加固,结构化严密管理。

第五级影响国家严重安全要更严格更实时提供保障。第五级为访问验证保护级。

我们一级一级增强来进行保障全过程全系统。我们首先要定级然后要建设然后测评然后运维管理一系列的规定。

我们等级保护是要有制度性的,更重要构建等于保护大数据终身防护的体系结构,从技术上解决问题。所以说我们应加快构建多层次、高质量的多重防御大数据防护体系。

第一是加大数据资源、环境、系统保护。建设多重多元的防护、多级互联的体系结构,确保大数据处理环境的可信。垃圾处理如果处理工厂出了问题这是祸害。

第二要加强处理流程控制,你处理过程内部人员出了问题,一切都完蛋了,要提高计算结点自我免疫能力。

第三要加强全局层面安全机制。等级保护由不同的访问规则确定的,制定数据控制的策略,梳理数据处理的流程,建立安全的数据处理模式。

第四加强技术平台支持下的安全管理。我们要基于安全策略进行管理,应该与业务处理流程严密结合,监控与我们平时相关管理制度相结合。

总体来说我们要做到可信、可控、可管。这样做以后大数据处理过程攻击人进不去,进去以后有用的大数据也拿不到,尤其是处理结果拿不到,我们是加密的。你拿到以后也看不懂无用,你进去以后系统和信息改不了,系统工作瘫不成,攻击行为赖不掉。

怎么构建积极防御?我们说要可信免疫、主动防御。大数据我前面讲了过程相当复杂,每一个环节都有安全问题,靠银钱封堵查杀老三样,防火墙、IBS、杀病毒不解决问题,防不胜防。

我们要可信计算来解决问题。可信计算指得是一般计算一般防护,使计算结果总是与预期一样,全程可侧可控不被干扰。说的更白一点它是防护运算并行的我们叫免疫计算模式。

是一种运算和防护并存的主动免疫的新计算模式,具有身份识别、状态度量、保密存储等功能。及时识别自己和非己成分。有害物质消灭破坏它。

早期60年代以前到70年代以前是大型计算机,都用过的,相互之间要打架,相互之间要干扰,采取很多可靠性措施,后来觉得太复杂了,做小一点,于是出现了小型机,小型机不光解决可信计算问题,而且它可以实务处理。70年代用诺娃小型机进行电话转报,因此可用性出现了。再小一点出现了PC机,个人计算机,我给你提供资源和别人没有关系,因此简化计算机,这是对精细化有作用。

没有实践就联网了,一联网以后你的也是我的,我的也是你的,下面又打架了,因此计算机结构的简化措施就形成了根本问题。PC机就相当于一个生下来的孩子没有免疫系统一样,因此这个孩子只能生活在无菌的状态下,要杀病毒,这孩子免疫太差了,把门关起来,严禁进去。可见这是不解决问题的,因此我们在现有简单计算机几何螺旋式上升,又回到大型多元结构上进行防护了。我这个图是PC机结构很简单,右边我们要加免疫系统。

这样做了以后就可以在体系结构上、操作行为上、资源配置上,数据存储上,策略管理上不会被篡改是可信的。构建成为这么一个科学的体系结构,积极主动三重防护框架。我们结构是非常科学非常先进的。

我们重新体现以访问控制为核心,实行主体按策略规则访问不同等级数据,确保全程的和控。推行最小权限管理原则,尤其是高等级的系统实行三权分离管理体制,确保数据资源可管。

原文发布时间为:2016年1月16日
本文来自云栖社区合作伙伴至顶网,了解相关信息可以关注至顶网。
相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
机器学习/深度学习 算法 大数据
构建数据中台,为什么“湖仓一体”成了大厂标配?
在大数据时代,数据湖与数据仓库各具优势,但单一架构难以应对复杂业务需求。湖仓一体通过融合数据湖的灵活性与数据仓的规范性,实现数据分层治理、统一调度,既能承载海量多源数据,又能支撑高效分析决策,成为企业构建数据中台、推动智能化转型的关键路径。
|
SQL 分布式计算 大数据
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
本文深入介绍 Hive 与大数据融合构建强大数据仓库的实战指南。涵盖 Hive 简介、优势、安装配置、数据处理、性能优化及安全管理等内容,并通过互联网广告和物流行业案例分析,展示其实际应用。具有专业性、可操作性和参考价值。
大数据新视界 --大数据大厂之Hive与大数据融合:构建强大数据仓库实战指南
|
传感器 人工智能 大数据
高科技生命体征探测器、情绪感受器以及传感器背后的大数据平台在健康监测、生命体征检测领域的设想与系统构建
本系统由健康传感器、大数据云平台和脑机接口设备组成。传感器内置生命体征感应器、全球无线定位、人脸识别摄像头等,搜集超出现有科学认知的生命体征信息。云平台整合大数据、云计算与AI,处理并传输数据至接收者大脑芯片,实现实时健康监测。脑机接口设备通过先进通讯技术,实现对健康信息的实时感知与反馈,确保身份验证与数据安全。
|
存储 分布式计算 物联网
美的楼宇科技基于阿里云 EMR Serverless Spark 构建 LakeHouse 湖仓数据平台
美的楼宇科技基于阿里云 EMR Serverless Spark 建设 IoT 数据平台,实现了数据与 AI 技术的有效融合,解决了美的楼宇科技设备数据量庞大且持续增长、数据半结构化、数据价值缺乏深度挖掘的痛点问题。并结合 EMR Serverless StarRocks 搭建了 Lakehouse 平台,最终实现不同场景下整体性能提升50%以上,同时综合成本下降30%。
1287 58
|
分布式计算 Shell MaxCompute
odps测试表及大量数据构建测试
odps测试表及大量数据构建测试
|
存储 SQL 分布式计算
MaxCompute x 聚水潭:基于近实时数仓解决方案构建统一增全量一体化数据链路
聚水潭作为中国领先的电商SaaS ERP服务商,致力于为88,400+客户提供全链路数字化解决方案。其核心ERP产品助力企业实现数据驱动的智能决策。为应对业务扩展带来的数据处理挑战,聚水潭采用MaxCompute近实时数仓Delta Table方案,有效提升数据新鲜度和计算效率,提效比例超200%,资源消耗显著降低。未来,聚水潭将进一步优化数据链路,结合MaxQA实现实时分析,赋能商家快速响应市场变化。
554 0
|
SQL 存储 HIVE
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
本文整理自鹰角网络大数据开发工程师朱正军在Flink Forward Asia 2024上的分享,主要涵盖四个方面:鹰角数据平台架构、数据湖选型、湖仓一体建设及未来展望。文章详细介绍了鹰角如何构建基于Paimon的数据湖,解决了Hudi入湖的痛点,并通过Trino引擎和Ranger权限管理实现高效的数据查询与管控。此外,还探讨了湖仓一体平台的落地效果及未来技术发展方向,包括Trino与Paimon的集成增强、StarRocks的应用以及Paimon全面替换Hive的计划。
2141 1
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
|
SQL 存储 HIVE
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
鹰角基于 Flink + Paimon + Trino 构建湖仓一体化平台实践项目
1128 2
|
存储 分布式计算 大数据
基于阿里云大数据平台的实时数据湖构建与数据分析实战
在大数据时代,数据湖作为集中存储和处理海量数据的架构,成为企业数据管理的核心。阿里云提供包括MaxCompute、DataWorks、E-MapReduce等在内的完整大数据平台,支持从数据采集、存储、处理到分析的全流程。本文通过电商平台案例,展示如何基于阿里云构建实时数据湖,实现数据价值挖掘。平台优势包括全托管服务、高扩展性、丰富的生态集成和强大的数据分析工具。