京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代下,需要什么样的冷存储
智能互联网时代,数据正在以几何级的数量爆炸增长,如何存储并管理这些海量数据,是很多企业面临的一个难题。如果采用传统通用型服务器存储策略,这意味着要建设庞大的数据中心系统,导致存储成本极速攀升。
对于那些云服务提供商而言,大量不断增长的数据例如图片等都属于不经常访问,但却又无法删除的,即使客户很久不会访问这些信息,但依然不能随意删除,并且不允许停机归档,也无法实现洪峰数据控制。对于这些不常访问的“冷”数据,如果我们能把他们迁移到一个专为冷数据而设计的低成本存储层中,将能大幅降低费用。
哪些数据需要冷存储?
冷存储主要用于那些备份、灾难恢复、存档、社交媒体等应用领域。这些数据都有一个共通的特性,较低的访问频率,并且需要最大限度的降低其存储成本,同时要求随时可访问。例如用户在社交媒体上存储的大量图片信息,以及法律电子取证要求已存档的数据必须在特定的时间范围内可用。因此,这就要求云服务提供商以及企业必须确保数据的完整性,以及及时的访问权限。
备份对于企业而言至关重要,因为需要备份的数据通常是企业有效运营所需要的信息,如果这些信息无法在特定时间范围回复,将严重影响企业业务。
存档对于企业运营以及提高工作效率必不可少,通常,企业并不需要快速访问已经存档的数据。但检索已经存档的数据可能要花费大量的时间,并且随着企业业务的增长,数据量持续增加,同时这些数据要存储长达几十年甚至更长的时间,这会给存储带来极大的压力。
灾难恢复,热备用暂难恢复服务在云中提供了专业的备用基础设施和数据,这意味着在发生灾难时,可以立即切换到云中。通过冷存储服务,可以消除企业在灾难中数据保护的某些流程,降低成本和复杂性。同时,企业需要快速的重构数据文件,还原应用程序,以最快的速度恢复系统正常运行。
社交媒体,智能互联网时代,大量的社交数据产生,用户通常查看新发布的照片,而对于那些旧的数据,则鲜有人问之。对于照片、视频等这些非结构化数据通常会占用大量存储空间,并且增长速度远远超过其他类型的数据。如果将这些旧的数据迁移到冷存储中,可以大幅降低运营成本。同时提供社交媒体服务的企业必须保护这些数据的隐私安全。
我们需要什么样的冷存储?
对于大部分创业公司而言,通常在公司创立初期,很难将业务细分的非常明确,大部分都会选用通用服务器来做存储,但随着业务的不断扩张,就会考虑将很多计算型节点分离出来。对于那些重要的数据希望在运行的更快的SSD 或PCIE SSD上,而对那些历史数据、日志则希望不要太占用现有服务器存储资源。因此,业务需要进行分层。
如何进行分层?在要确保性能不能有大幅损失的同时降低存储费用,特别是对于那些图片存储,对于一些云服务提供商而言,这一点尤其重要。因为根据其业务类型,就要求及时客户很久没有访问这些数据,也不能随意删除。另外一点非常重要的则是,其业务没有明显的周期性,不像其他行业,如金融等,每天固定时间开市闭市,可以进行数据维护;也没有周期性的数据洪峰,无法做出数据洪峰控制。
如何满足上述需求?联想的冷存储产品不失为一个理想的选择。
联想4U60盘位、双节点的冷存储业务服务器SD600,每节点拥有2个2.5寸系统盘插槽,可以通过更换连接两节点间EXPB槽位的DB卡,实现服务器在HA (High Availability)、Zoning以及 Single Node (JBOD)三种模式下的工作方式。
通过采用联想SD600可以顺利的帮助企业将计算分析业务与数据存储业务分离,当存储服务器的硬件资源主要用于数据存储,数据块为大块数据时,相信SD600将是您最优的选择。因为对并发进程较少的业务来说,每个进程的性能更依赖于CPU的主频。不难看出,存储业务对cores间的进程切换需求很低,对单core的主频性能要求较高。那么经过优化过的Avago磁盘主控芯片,与高频E3 CPU的搭配,将会更好的为您提供数据存储业务。
可灵活选配的联想冷存储
联想SD600在HA 模式下,当对数据的实时可用能力有较高要求时,可以通过增加一张HA DB card来实现两个节点间的高可用。同时,因为需要用到SAS接口的双通道,需要存储池内的60块盘都是SAS磁盘。当需要降低归档服务器、文件服务器、图片服务器等温冷数据服务器的成本时,可以选用Zoning和Single Node模式。Zoning模式即划分给每个节点30块磁盘做存储池,将SD600变为4U2N服务器使用。Single Node模式可以有效降低互联网公司的图片存储、日志归档、音视频存储业务的硬件建设成本。此外,该模式下一个节点将带起60块SATA硬盘。目前联想推广的最佳实践案例包含6T 7.2k 企业级硬盘/8T 5.9k 企业级云盘。
此外,联想SD600在可靠性和兼容性方面实现了最佳平衡,可以满足RHEL、SUSE、windows、Ubuntu各种业务需求。其采用双排9风扇交叉风向设计,具备了更好的散热效果,满足服务器45℃高温下连续工作的要求,更适合苛刻的数据中心环境。与E5通用服务器相比,联想SD600的TCO至少降低了10%,耗电量降低了8%。同时,仅从数据的存取角度来看,1颗高主频能超线程到8 Thread的E3-1231 v3在相同内存与网络环境的情况下,在客户实际的使用中发现,相比2颗E5-2609 v3数据传输速度会提高10-20%。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05数据治理是数字化时代企业实现数据价值最大化的核心前提,而CDA(Certified Data Analyst)数据分析师作为数据全生命周期的核心 ...
2026-03-05在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04