CN106919465B - 用于存储系统中多重数据保护的方法和装置 - Google Patents

用于存储系统中多重数据保护的方法和装置 Download PDF

Info

Publication number
CN106919465B
CN106919465B CN201510983346.2A CN201510983346A CN106919465B CN 106919465 B CN106919465 B CN 106919465B CN 201510983346 A CN201510983346 A CN 201510983346A CN 106919465 B CN106919465 B CN 106919465B
Authority
CN
China
Prior art keywords
storage device
session
asynchronous replication
information
storage
Prior art date
Legal status (The legal status is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the status listed.)
Active
Application number
CN201510983346.2A
Other languages
English (en)
Other versions
CN106919465A (zh
Inventor
骆渊
徐宁
马思超
商秋
梁韶聪
Current Assignee (The listed assignees may be inaccurate. Google has not performed a legal analysis and makes no representation or warranty as to the accuracy of the list.)
EMC Corp
Original Assignee
EMC IP Holding Co LLC
Priority date (The priority date is an assumption and is not a legal conclusion. Google has not performed a legal analysis and makes no representation as to the accuracy of the date listed.)
Filing date
Publication date
Application filed by EMC IP Holding Co LLC filed Critical EMC IP Holding Co LLC
Priority to CN201510983346.2A priority Critical patent/CN106919465B/zh
Priority to US15/382,830 priority patent/US10324813B2/en
Publication of CN106919465A publication Critical patent/CN106919465A/zh
Priority to US16/443,344 priority patent/US10860445B2/en
Application granted granted Critical
Publication of CN106919465B publication Critical patent/CN106919465B/zh
Active legal-status Critical Current
Anticipated expiration legal-status Critical

Links

Images

Classifications

    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F11/00—Error detection; Error correction; Monitoring
    • G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
    • G06F11/16—Error detection or correction of the data by redundancy in hardware
    • G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
    • G06F11/2053—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant
    • G06F11/2056—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring
    • G06F11/2069—Management of state, configuration or failover
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F11/00—Error detection; Error correction; Monitoring
    • G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
    • G06F11/14—Error detection or correction of the data by redundancy in operations
    • G06F11/1446—Point-in-time backing up or restoration of persistent data
    • G06F11/1448—Management of the data involved in backup or backup restore
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F11/00—Error detection; Error correction; Monitoring
    • G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
    • G06F11/16—Error detection or correction of the data by redundancy in hardware
    • G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
    • G06F11/2053—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant
    • G06F11/2056—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring
    • G06F11/2058—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring using more than 2 mirrored copies
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F11/00—Error detection; Error correction; Monitoring
    • G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
    • G06F11/16—Error detection or correction of the data by redundancy in hardware
    • G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
    • G06F11/2053—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant
    • G06F11/2056—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring
    • G06F11/2071—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring using a plurality of controllers
    • G06F11/2074—Asynchronous techniques
    • G—PHYSICS
    • G06—COMPUTING OR CALCULATING; COUNTING
    • G06F—ELECTRIC DIGITAL DATA PROCESSING
    • G06F11/00—Error detection; Error correction; Monitoring
    • G06F11/07—Responding to the occurrence of a fault, e.g. fault tolerance
    • G06F11/16—Error detection or correction of the data by redundancy in hardware
    • G06F11/20—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements
    • G06F11/2053—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant
    • G06F11/2056—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring
    • G06F11/2071—Error detection or correction of the data by redundancy in hardware using active fault-masking, e.g. by switching out faulty elements or by switching in spare elements where persistent mass storage functionality or persistent mass storage control functionality is redundant by mirroring using a plurality of controllers
    • G06F11/2076—Synchronous techniques

Landscapes

  • Engineering & Computer Science (AREA)
  • Theoretical Computer Science (AREA)
  • Quality & Reliability (AREA)
  • Physics & Mathematics (AREA)
  • General Engineering & Computer Science (AREA)
  • General Physics & Mathematics (AREA)
  • Information Retrieval, Db Structures And Fs Structures Therefor (AREA)
  • Retry When Errors Occur (AREA)

Abstract

本公开的实施例提出了用于存储系统中的多重数据保护的方法和装置。该存储系统包括第一存储设备、第二存储设备和第三存储设备,该方法包括:在该第一存储设备和该第二存储设备之间建立同步复制会话,以将该第一存储设备的数据同步复制到该第二存储设备;在该第一存储设备和该第三存储设备之间建立异步复制会话,以将该第一存储设备的数据异步复制到该第三存储设备;以及在该第一存储设备出现故障时,通过在该第二存储和该第三设备之间建立异步复制会话来恢复该异步复制。根据本公开的实施例的方法或装置,能够同时利用同步复制和异步复制技术来提供本地和远程多重数据保护。

Description

用于存储系统中多重数据保护的方法和装置
技术领域
本公开的实施例涉及数据存储系统,并且更具体地涉及用于多重数据保护的方法和装置。
背景技术
在数据存储系统中,为了提高数据的安全性和可用性,可以同时存储数据的多个备份。例如,可以通过镜像视图技术将数据从一个存储设备复制到另一存储设备。目前数据复制可以通过同步复制或者异步复制技术来进行。
同步复制是网络附属存储(NAS)在本地局域网(LAN)或广域网络(WAN)上通过块(Block)复制技术而产生多个数据同步复件的技术。同步复制的优点是数据同步保护时延小,恢复点目标(RPO)等于0。因此当生产数据中心发生灾难事件时,不会造成数据丢失;不足之处在于只在相对短距离(例如10Km)内工作。因此,同步复制适用于恢复时间目标(RTO)低的应用。
相对于同步复制而言,在异步复制技术中,在将数据复制到辅站点之前存在更长的时延。异步复制能够支持更远的距离,例如100Km。
因此,同步复制和异步复制各有优缺点,适用于不同的场景。在目前的存储系统中,还没有支持同步复制和异步复制共存的技术方案。
发明内容
为了改善数据保护,本公开的实施例提出了用于存储系统中的数据保护的方法和装置。
下面给出了对各实施例的简要概述,以提供对各种实施例的一些方面的基本理解。该概述不旨在标识关键元素的要点或描述各种实施例的范围。其唯一目的在于以简化形式呈现一些概念,作为对后述更具体描述的前序。
本公开的第一方面提供了一种用于存储系统中的多重数据保护的方法,该存储系统包括第一存储设备、第二存储设备和第三存储设备,该方法包括:在该第一存储设备和该第二存储设备之间建立同步复制会话,以将该第一存储设备的数据同步复制到该第二存储设备;在该第一存储设备和该第三存储设备之间建立异步复制会话,以将该第一存储设备的数据异步复制到该第三存储设备;以及在该第一存储设备出现故障时,通过在该第二存储和该第三设备之间建立异步复制会话来恢复该异步复制。
在一个实施例中,将该第一存储设备的数据同步复制到该第二存储设备可以包括:将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息也同步到该第二存储设备;并且该方法进一步包括:在该第二存储设备和该第三存储设备之间建立异步复制会话之前,从该第二存储设备中清除关于该第一存储设备和该第三存储设备之间的异步复制会话的部分信息。
在另一实施例中,从该第二存储设备中清除关于该第一存储设备和该第三存储设备之间的异步复制会话的信息可以包括:从同步复制到该第二存储设备的数据中识别该第一存储设备和该第三设备之间的异步复制会话的会话签名,以及从该第二存储设备中清除由该会话签名所指示的异步复制会话的信息。在又一实施例中,该会话签名可以包括会话标识符和文件系统标识符,并且从该第二存储设备中清除由该会话签名所指示的异步复制会话的信息可以包括:在该会话签名所包括的文件系统标识符与从该第一存储设备导入到该第二存储设备中的控制路径数据库中的内部文件系统检查点标识符匹配时,从该第二存储设备中清除由该会话标识符所指示的异步复制会话的信息。
在一个实施例中,将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息也同步到该第二存储设备可以包括:将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为数据的一部分同步到该第二存储设备;或者将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为内部文件系统检查点的一部分同步到该第二存储设备。
在另一实施例中,在该第二存储设备和该第三设备之间建立异步复制会话可以包括:向该第二存储设备加载文件系统;以及在该第二存储设备和该第三存储设备之间建立文件系统级的异步复制会话。
在一个实施例中,该方法可以进一步包括:在该第一存储设备出现故障时,通过将该第一存储设备和该第二存储设备在该同步复制会话中的角色互换来进行失效切换;以及在该第一存储设备从故障恢复期间,从该第一存储设备中清除与该同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件以保证该第一存储设备重启后的文件系统加载过程不因文件系统的不匹配而导致系统循环重启。在另一实施例中,更新存储设备的配置文件可以包括:修改原有的配置文件中的文件系统加载项。
本公开的第二方面提供了一种用于存储系统中的多重数据保护的装置,该存储系统包括第一存储设备、第二存储设备和第三存储设备,该装置包括:同步复制单元,被配置为在该第一存储设备和该第二存储设备之间建立同步复制会话,以将该第一存储设备的数据同步复制到该第二存储设备;异步复制单元,被配置为在该第一存储设备和该第三存储设备之间建立异步复制会话,以将该第一存储设备的数据异步复制到该第三存储设备;以及异步复制恢复单元,被配置为在该第一存储设备出现故障时,通过在该第二存储和该第三设备之间建立异步复制会话来恢复该异步复制。
在一个实施例中,同步复制单元可以进一步被配置为将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息也同步到该第二存储设备;并且该装置可以进一步包括:第一清除单元,被配置为在该第二存储设备和该第三存储设备之间建立异步复制会话之前,从该第二存储设备中清除关于该第一存储设备和该第三存储设备之间的异步复制会话的部分信息。
在另一实施例中,第一清除单元可以进一步包括:识别单元,被配置为从同步复制到该第二存储设备的数据中识别该第一存储设备和该第三设备之间的异步复制会话的会话签名,以及信息清除单元,被配置为从该第二存储设备中清除由该会话签名所指示的异步复制会话的信息。在又一实施例中,会话签名可以包括会话标识符和文件系统标识符,并且该信息清除单元可以进一步被配置为:在该会话签名所包括的文件系统标识符与从该第一存储设备导入到该第二存储设备中的控制路径数据库中的内部文件系统检查点标识符匹配时,从该第二存储设备中清除由该会话标识符所指示的异步复制会话的信息。
在另一实施例中,该同步复制单元进一步被配置为通过以下方式之一将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息也同步到该第二存储设备:将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为数据的一部分同步到该第二存储设备;或者将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为内部文件系统检查点的一部分同步到该第二存储设备。
在又一实施例中,异步复制单元进一步被配置为通过以下方式在该第二存储设备和该第三设备之间建立异步复制会话:向该第二存储设备加载文件系统;以及在该第二存储设备和该第三存储设备之间建立文件系统级的异步复制会话。
在一个实施例中,该装置可以进一步包括:失效切换单元,被配置为在该第一存储设备出现故障时,通过将该第一存储设备和该第二存储设备在该同步复制会话中的角色互换来进行失效切换;以及文件更新单元,被配置为在该第一存储设备从故障恢复期间,从该第一存储设备中清除与该同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件以保证该第一存储设备重启后的文件系统加载过程不因文件系统的不匹配而导致系统循环重启。在另一实施例中,文件更新单元可以被配置为通过修改原有的配置文件中的文件系统加载项来更新存储设备的配置文件。
本公开的第三方面提供了一种装置,该装置包括至少一个处理器;以及包括计算机程序代码的至少一个存储器,其中该至少一个存储器和该计算机程序代码被配置为:与该至少一个处理器一起,促使该装置执行根据本公开的第一方面的方法。
根据本公开的实施例的方法或装置,能够同时利用同步复制和异步复制技术来提供本地和远程多重数据保护。
尽管在附图中通过示例的方式示出了特定的实施例,然而,应当理解,本文的具体实施例的描述不意在将实施例限制为所公开的具体形式。
附图说明
从下文的公开内容和权利要求中,本公开的目的、优点和其他特征将变得更加明显。这里仅出于示例的目的,参考附图来给出优选实施例的非限制性描述,在附图中:
图1示出了根据本公开的实施例的用于存储系统中的多重数据保护的方法的流程图;
图2a-图2b示出了根据本公开的实施例的在第一存储设备故障前和故障期间数据保护的示意图;以及
图3示出了根据本公开的实施例的装置的示例性结构图。
具体实施方式
在以下描述中,出于说明的目的而阐述许多细节。然而,本领域普通技术人员将认识到可以在不使用这些具体细节的情况下实现本公开的实施例。因此,本公开不旨在于受限于所示实施例、而是将被赋予与本文描述的原理和特征一致的最宽的范围。
应当理解,术语“第一”、“第二”等仅被用来将一个元素与另一个元素区分开来。而实际上第一元素也能够被称为第二元素,反之亦然。另外还应当理解“包括”,“包含”仅被用来说明所陈述的特征、元素、功能或者部件的存在,然而并不排除存在一个或者多个其他的特征、元素、功能或者部件。
为了便于解释,本文的一些实施例将以EMCTM公司的VNX2产品为例来介绍相应的方法或装置,然而,如本领域技术人员可以理解的,本公开的实施例绝不限于应用于VNX2产品,而是可以被应用于任何存在类似问题的存储系统中。
如前所述,在现有技术中并不存在使同步复制和异步复制共存的解决方案。例如,在VNX2存储产品中,可以提供复制器V2(简称为Repv2)用于异步复制,或者提供虚拟数据移动器(简称为VDM)同步用于同步复制。
为使同步复制和异步复制共存、以同时利用两者的优点,将面临诸多问题,例如,如何使同步复制和异步复制在存储系统中协作、如何在发生故障时恢复会话等。
为了解决以上问题中的至少一些问题,本公开的实施例提出了用于存储系统中的多重数据保护的方法。图1中示出了该方法100的示例性流程图。该存储系统包括第一存储设备、第二存储设备、和第三存储设备。其中该存储系统可以是,但不限于,VNX2存储系统,并且其中的存储设备可以是(但不限于)存储阵列。
如图1所示,该方法100包括,在S101,在第一存储设备和第二存储设备之间建立同步复制会话,以将第一存储设备的数据同步复制到第二存储设备;这意味着第一存储设备的数据能够以低延时复制到第二存储设备。在S102,在第一存储设备和第三存储设备之间建立异步复制会话,以将第一存储设备的数据异步复制到第三存储设备;由于异步复制的较大时延,这意味着第三存储设备中保存的第一存储设备的信息可能不是最新的。在S103,在第一存储设备出现故障时,通过在第二存储和第三设备之间建立异步复制会话来恢复异步复制。
图2a-图2b中示意性地示出利用该方法100的存储系统在故障前和故障期间数据保护的示意图。
通过该方法,提供了存储系统中的本地和远程双重数据保护,例如文件保护。如本领域技术人员能够理解的,本方法还可以应用于具有更多存储设备的存储系统。通过该方法,提供了同步复制和异步复制协作的机制,并且,使得在第一存储设备发生故障时,能够将同步地保存在第二存储设备中的、第一设备的数据异步复制到第三存储设备。
在一个实施例中,在块S103中,在第一存储设备出现故障时,在该第二存储设备和该第三设备之间建立异步复制会话可以包括:向第二存储设备加载文件系统;以及在第二存储设备和第三存储设备之间建立文件系统级的异步复制会话。
目前还没有如方法100该的同时利用同步复制和异步复制的解决方案。以传统VNX2产品为例,由于以下原因中的至少一些原因,其目前不能够支持同步复制和异步复制的共存:
1.传统的VNX2中,可同步复制的VDM不能够创建文件系统(FS)级的异步复制Repv2会话。如果在存储设备A和存储设备B之间建立了同步复制,同时在存储设备A和存储设备C之间建立了异步复制,则在存储设备A发生故障时,同步复制将从存储设备A向存储设备B进行失效切换。这导致VDM的文件系统数据被同步到存储设备B侧,并且网络附属存储数据库(NASDB)将从NASDB副本控制逻辑单元号(Control LUN)导入。然而由于在存储设备B的数据路径数据库(例如,保存卷)中存在来自存储设备A的关于设备A和设备C之间的异步复制会话(Repv2)的信息,导致不能够在存储设备B的VDM中加载文件系统。
2.这种情况下,在存储设备B中的、从存储设备A中同步来的FS Repv2是断裂的,而且该Repv2无法通过传统的nas_replicate命令来删除,因为同步复制特征(Syncrep)仅将VDM数据失效切换到存储设备B,该VDM数据包括VDM根文件系统和用户文件系统,但是不包括操作系统DART的根文件系统。因此,在存储设备B中,DART的根文件系统中的数据库NameDB中未存储Repv2会话信息。
3.在Syncrep失效切换发生后,原有的源存储设备(即,A)从故障中恢复。这时,由于失效切换后该存储设备A处于备用状态,其LUN块处于只读状态,在设备启动过程中装载LUN块上的文件系统将出现失败而导致设备循环重启。
可选地,为了利用现有的存储设备(例如VNX2)来实施本地和远程双重数据保护,在一些实施例中,在方法100的块S101,可以将第一存储设备中的、关于第一存储设备和第三存储设备之间的异步复制会话的信息(例如Repv2信息)也同步到第二存储设备。在这些实施方式中,该方法100可以进一步包括:在块S104,在该第二存储设备和该第三存储设备之间建立异步复制会话之前,从该第二存储设备中清除关于该第一存储设备和该第三存储设备之间的异步复制会话的部分信息。该实施例能够强制删除第二存储设备中的、不利于在第二设备和第三设备之间建立异步会话的信息。
在一个实施例中,在块S101,可以将第一存储设备中的、关于第一存储设备和第三存储设备之间的异步复制会话的信息作为数据的一部分同步到第二存储设备;或者将作为内部文件系统检查点的一部分同步到第二存储设备。
在另一实施例中,在利用以上所述的VNX2存储产品来实施该方法时,为了能够在第二存储设备的VDM中加载文件系统,可以在块S104中,从第二设备中清除关于第一和第三存储设备之间的异步复制会话的信息中影响文件加载的信息。而对于不影响文件系统加载的其余信息,可以保留。强制删除的信息例如可以是关于第一存储设备和第三存储设备之间的断裂的Repv2的信息,该信息通过传统的nas_replicate命令是无法删除的。
如本领域技术人员能够理解的,在S104中所清除的信息可以根据该所应用于的存储系统的不同而不同,并且对于某些存储系统,可以不需要该清除操作。
在另一实施例中,在块S104中从第二存储设备中清除关于第一存储设备和第三存储设备之间的异步复制会话的信息可以包括:从同步复制到第二存储设备的数据中识别第一存储设备和第三设备之间的异步复制会话的会话签名,以及从第二存储设备中清除由该会话签名所指示的异步复制会话的信息。
在又一实施例中,会话签名可以包括会话标识符(Session ID)和文件系统标识符(FS ID),并且,在块S104中,可以在该会话签名所包括的FS ID与从第一存储设备导入到第二存储设备中的控制路径数据库(例如,网络附属系统数据库NASDB)中的内部文件系统检查点标识符(CheckPoint FS ID)匹配时,从第二存储设备中清除由该会话标识符所指示的异步复制会话的信息。再例如,可以通过将存储在第二存储设备的保存卷(Save Volume)中的信息与存储在第二存储设备中的控制站的NASDB中的信息进行匹配、计算正确的DART,并且利用合适的参数使DART删除断裂的Repv2。在删除Repv2之后,文件系统可以被加载到第二存储设备的VDM中,以继续提供数据服务。
如本领域技术人员能够理解的,在另外的实施例中,从第二存储设备中清除的信息也可以由其他标识所指示,例如连接ID,目标地址ID等。
在一个实施例中,该方法100还可以包括,在块S105,在第一存储设备出现故障时,通过将第一存储设备和第二存储设备在同步复制会话中的角色互换来进行失效切换。例如,角色互换可以是在所述同步复制会话中将第二存储设备的数据同步复制到第一存储设备。作为示例,失效切换可以包括将第一存储设备由活动状态转为备用状态,同时将第二存储设备由备用状态转为活动状态。
在块S106,在第一存储设备从故障恢复期间,从第一存储设备中清除与该同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件。这有助于确保第一存储设备重启后的文件系统加载过程不会由于文件系统的不匹配而导致系统循环重启。在一个实施例中,可以通过修改原有的配置文件中的文件系统加载项来更新存储设备的配置文件。
如上所述,在未应用本公开的方法100时,在第一存储设备失效切换发生后,一旦该第一存储设备从故障中恢复,则在第一存储设备重启后试图加载文件系统时,可能出现循环重启。这是因为失效切换后第一存储设备处于备用状态,其LUN块处于只读状态,但是其VDM中有加载的文件系统,因此重启后执行加载文件系统的写操作将触发重启。而利用本公开的方法100的一些实施例,可以通过在不进行与DART的互联的情况下,清除第一存储设备的控制站中与同步会话有关的文件系统NASDB表项,来解决该问题。控制站可以建立新的配置文件(例如,boot.cfg),例如通过修改原有的配置文件中的文件系统加载项来建立新的配置文件;从而在DART重启后,能够根据新的配置文件来加载文件系统,从而避免循环重启。
以下参考附图3描述用于存储系统中的多重数据保护的装置300的结构。装置300所适用的存储系统包括多个存储设备,例如第一存储设备、第二存储设备和第三存储设备。例如该存储系统可以是(但是并不限于)VNX2系统。装置300可以执行参考图1所述的方法100,但是不限于执行该方法100。同样该方法100可以由装置300执行,但是不限于由装置300执行。例如方法100的至少一些操作可以由其它的装置来执行。
在一个实施例中,该装置300包括同步复制单元301,被配置为在该第一存储设备和该第二存储设备之间建立同步复制会话,以将该第一存储设备的数据同步复制到该第二存储设备;异步复制单元302,被配置为在该第一存储设备和该第三存储设备之间建立异步复制会话,以将该第一存储设备的数据异步复制到该第三存储设备;以及异步复制恢复单元303,被配置为在该第一存储设备出现故障时,通过在该第二存储和该第三设备之间建立异步复制会话来恢复该异步复制。
在一个实施例中,单元301-303可以被配置为执行参考图1所述的方法100的步骤S101-S103。因此,参考方法100进行的相关描述在此同样适用。
在一个实施例中,同步复制单元301进一步被配置为将第一存储设备中的、关于第一存储设备和第三存储设备之间的异步复制会话的信息也同步到该第二存储设备;并且该装置300可以进一步包括:第一清除单元304,被配置为在该第二存储设备和该第三存储设备之间建立异步复制会话之前,从该第二存储设备中清除关于该第一存储设备和该第三存储设备之间的异步复制会话的部分信息。
在一个实施例中,以上参考方法100该的块S104的操作在此同样适用于第一清除单元304,因此不再赘述。
在另一实施例中,第一清除单元可以进一步包括:识别单元3041,被配置为从同步复制到该第二存储设备的数据中识别该第一存储设备和该第三设备之间的异步复制会话的会话签名,以及信息清除单元3042,被配置为从该第二存储设备中清除由该会话签名所指示的异步复制会话的信息。
在又一实施例中,会话签名可以包括会话标识符和文件系统标识符,并且信息清除单元3042可以进一步被配置为:在该会话签名所包括的文件系统标识符与从该第一存储设备导入到该第二存储设备中的控制路径数据库中的内部文件系统检查点标识符匹配时,从该第二存储设备中清除由该会话标识符所指示的异步复制会话的信息。
作为一个示例,同步复制单元301可以进一步被配置为通过以下方式之一将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息也同步到该第二存储设备:将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为数据的一部分同步到该第二存储设备;或者将该第一存储设备中的、关于该第一存储设备和该第三存储设备之间的异步复制会话的信息作为内部文件系统检查点的一部分同步到该第二存储设备。
作为另一示例,异步复制单元302可以进一步被配置为通过以下方式在该第二存储设备和该第三设备之间建立异步复制会话:向该第二存储设备加载文件系统;以及在该第二存储设备和该第三存储设备之间建立文件系统级的异步复制会话。
附加地或者替代地,装置300可以包括失效切换单元305,被配置为在该第一存储设备出现故障时,通过将该第一存储设备和该第二存储设备在该同步复制会话中的角色互换来进行失效切换;以及文件更新单元306,被配置为在该第一存储设备从故障恢复期间,从该第一存储设备中清除与该同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件以保证该第一存储设备重启后的文件系统加载过程不因文件系统的不匹配而导致系统循环重启。
在一个实施例中,文件更新单元被配置为通过修改原有的配置文件中的文件系统加载项来更新存储设备的配置文件。
在一个实施例中,以上参考方法100所述的块S105-S106的操作在此同样分别适用于单元305和306,因此不再赘述。
如本领域技术人员能够理解的,装置300还可以包括图3中未示出的其它单元;并且在一些实施例中,图3中的某些单元可以被省略。
在提出本公开的实施例的方法和装置之前,在存储系统中不存在本地和远程多重数据保护的解决方案。例如,利用VNX Repv2进行的数据保护是非同步的,并且在灾难发生时,在目标存储设备侧可能会存在数据丢失。而对于通过VNX同步复制VDM进行保护的数据,其具有距离限制(例如40km)。因此,只能够依赖从例如实验室停电之类的故障中恢复。而如果例如地震或者洪水等大范围的灾难发生,则由于距离较近,两个存储设备站点可能都将遭受灾难影响,并导致两个存储设备均无法工作,从而导致数据服务中断。
利用本公开的实施例的方法和装置,能够提供本地和远程复制的共存,例如使VNX中同步复制和异步复制共存。这使得能够提供实时数据保护,也能够实现几百公里的距离的数据保护。根据一些实施例,异步复制的恢复中能够利用同步复制会话技术来避免初始复制阶段并缩短恢复时间。利用一些实施例,能够同时提供文件级和块级数据保护的综合的解决方案。
通过本公开的一些实施例的方法和/装置,用户能够针对VDM创建同步会话,并且针对VDM中加载的文件系统创建Repv2会话。
通过本公开的一些实施例的方法和/装置,存储系统能够在灾难发生时提供VDM的同步复制的失效切换,并且在失效切换后恢复FS异步复制会话,从而提供本地和远程多重数据保护。
本领域技术人员将容易地认识到,各种上述各种方法中的块或者步骤可以通过编程的计算机来执行。在本公开中,一些实施例还意在涵盖程序存储系统,例如,数字数据存储介质。这是机器或计算机可读的并且编码机器可执行或计算机可执行的指令程序。其中,该指令执行上述方法的一些或所有步骤。程序存储系统可以是,例如,数字存储器、诸如磁盘和磁带的磁存储介质、硬盘驱动器或光学可读数字数据存储介质。该实施例还意在涵盖编程为执行该上述方法的步骤的计算机。一些实施例还意在涵盖一种装置,该装置包括至少一个处理器;以及至少一个包括计算机程序代码的存储器,其中该至少一个存储器和该计算机程序代码被配置为:与该至少一个处理器一起,促使该装置执行方法100。
在附图中示出的装置的各种元件的功能,可以通过使用软件、专用硬件以及与适当软件相关联的能够执行软件的硬件、或者固件、或者其结合来提供。当由处理器提供时,该功能可以由单个专用处理器、由单个共享处理器或由多个单独的处理器来提供。此外,术语“处理器”可以包括但不限于,数字信号处理器(DSP)硬件、网络处理器、专用集成电路(ASIC)、现场可编程门阵列(FPGA),用于存储软件的只读存储器(ROM)、随机存取存储器(RAM)和非易失性存储装置。还可以包括其他常规和/或定制的硬件。
本领域技术人员应当理解,说明书和附图仅仅说明本公开的实施例的原理。因此,应当理解,本领域的技术人员将能够设计出各种布置,虽然这里没有明确地描述或示出,但是该布置体现本公开的实施例的原理并且被包括在本公开的实施例的精神和范围内。此外,这里阐述的所有示例主要旨在明确仅用于教学目的,以帮助读者理解本公开的实施例的原理和发明人贡献的用于促进本领域的概念,并且应被解释为不限于这些具体阐释的示例和条件。而且,这里阐述本公开的实施例的原理、方面和实施例的所有阐述及其具体示例也意在包含其等同物。

Claims (15)

1.一种用于存储系统中的多重数据保护的方法,所述存储系统包括第一存储设备、第二存储设备和第三存储设备,所述方法包括:
在所述第一存储设备和所述第二存储设备之间建立同步复制会话,以将所述第一存储设备的数据同步复制到所述第二存储设备;
在所述第一存储设备和所述第三存储设备之间建立异步复制会话,以将所述第一存储设备的数据异步复制到所述第三存储设备;以及
在所述第一存储设备出现故障时,通过在所述第二存储和所述第三设备之间建立异步复制会话来恢复所述异步复制,
在所述第一存储设备出现故障时,通过在所述同步复制会话中将所述第二存储设备的数据同步复制到所述第一存储设备来进行失效切换;以及
在所述第一存储设备从故障恢复期间,从所述第一存储设备中清除与所述同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件。
2.根据权利要求1所述的方法,其中
将所述第一存储设备的数据同步复制到所述第二存储设备包括:将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息同步到所述第二存储设备;并且
所述方法进一步包括:在所述第二存储设备和所述第三存储设备之间建立异步复制会话之前,从所述第二存储设备中清除关于所述第一存储设备和所述第三存储设备之间的异步复制会话的部分信息。
3.根据权利要求2所述的方法,其中从所述第二存储设备中清除关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息包括:
从同步复制到所述第二存储设备的数据中识别所述第一存储设备和所述第三设备之间的异步复制会话的会话签名,以及
从所述第二存储设备中清除由所述会话签名所指示的异步复制会话的信息。
4.根据权利要求3所述的方法,其中
所述会话签名包括会话标识符和文件系统标识符,并且
从所述第二存储设备中清除由所述会话签名所指示的异步复制会话的信息包括:
在所述会话签名所包括的文件系统标识符与从所述第一存储设备同步复制到所述第二存储设备中的控制路径数据库中的内部文件系统检查点标识符匹配时,从所述第二存储设备中清除由所述会话标识符所指示的异步复制会话的信息。
5.根据权利要求2所述的方法,其中将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息同步到所述第二存储设备包括:
将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息作为数据的一部分同步到所述第二存储设备;或者
将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息作为内部文件系统检查点的一部分同步到所述第二存储设备。
6.根据权利要求1所述的方法,其中在所述第二存储设备和所述第三设备之间建立异步复制会话包括:
向所述第二存储设备加载文件系统;以及
在所述第二存储设备和所述第三存储设备之间建立文件系统级的异步复制会话。
7.根据权利要求1所述的方法,其中更新存储设备的配置文件包括:修改原有的配置文件中的文件系统加载项。
8.一种用于存储系统中的多重数据保护的装置,所述存储系统包括第一存储设备、第二存储设备和第三存储设备,所述装置包括:
同步复制单元,被配置为在所述第一存储设备和所述第二存储设备之间建立同步复制会话,以将所述第一存储设备的数据同步复制到所述第二存储设备;
异步复制单元,被配置为在所述第一存储设备和所述第三存储设备之间建立异步复制会话,以将所述第一存储设备的数据异步复制到所述第三存储设备;异步复制恢复单元,被配置为在所述第一存储设备出现故障时,通过在所述第二存储和所述第三设备之间建立异步复制会话来恢复所述异步复制;
失效切换单元,被配置为在所述第一存储设备出现故障时,通过在所述同步复制会话中将所述第二存储设备的数据同步复制到所述第一存储设备来进行失效切换;以及
文件更新单元,被配置为在所述第一存储设备从故障恢复期间,从所述第一存储设备中清除与所述同步复制会话相关的控制路径数据库信息,并更新存储设备配置文件。
9.根据权利要求8所述的装置,其中所述同步复制单元进一步被配置为将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息也同步到所述第二存储设备;并且
所述装置进一步包括:
第一清除单元,被配置为在所述第二存储设备和所述第三存储设备之间建立异步复制会话之前,从所述第二存储设备中清除关于所述第一存储设备和所述第三存储设备之间的异步复制会话的部分信息。
10.根据权利要求9所述的装置,其中所述第一清除单元进一步包括:
识别单元,被配置为从同步复制到所述第二存储设备的数据中识别所述第一存储设备和所述第三设备之间的异步复制会话的会话签名,以及
信息清除单元,被配置为从所述第二存储设备中清除由所述会话签名所指示的异步复制会话的信息。
11.根据权利要求10所述的装置,其中所述会话签名包括会话标识符和文件系统标识符,并且所述信息清除单元进一步被配置为:
在所述会话签名所包括的文件系统标识符与从所述第一存储设备同步复制到所述第二存储设备中的控制路径数据库中的内部文件系统检查点标识符匹配时,从所述第二存储设备中清除由所述会话标识符所指示的异步复制会话的信息。
12.根据权利要求9所述的装置,其中,所述同步复制单元进一步被配置为通过以下方式之一将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息也同步到所述第二存储设备:
将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息作为数据的一部分同步到所述第二存储设备;或者
将所述第一存储设备中的、关于所述第一存储设备和所述第三存储设备之间的异步复制会话的信息作为内部文件系统检查点的一部分同步到所述第二存储设备。
13.根据权利要求8所述的装置,其中所述异步复制单元进一步被配置为通过以下方式在所述第二存储设备和所述第三设备之间建立异步复制会话:
向所述第二存储设备加载文件系统;以及
在所述第二存储设备和所述第三存储设备之间建立文件系统级的异步复制会话。
14.根据权利要求8所述的装置,其中所述文件更新单元被配置为通过修改原有的配置文件中的文件系统加载项来更新存储设备的配置文件。
15.一种用于存储系统中多重数据保护的装置,所述装置包括至少一个处理器;以及包括计算机程序代码的至少一个存储器,其中所述至少一个存储器和所述计算机程序代码被配置为:与所述至少一个处理器一起,促使所述装置执行根据权利要求1-7中任一权利要求所述的方法。
CN201510983346.2A 2015-12-24 2015-12-24 用于存储系统中多重数据保护的方法和装置 Active CN106919465B (zh)

Priority Applications (3)

Application Number Priority Date Filing Date Title
CN201510983346.2A CN106919465B (zh) 2015-12-24 2015-12-24 用于存储系统中多重数据保护的方法和装置
US15/382,830 US10324813B2 (en) 2015-12-24 2016-12-19 Methods and devices for multi-level data protection in a storage system
US16/443,344 US10860445B2 (en) 2015-12-24 2019-06-17 Methods and devices for multi-level data protection in a storage system

Applications Claiming Priority (1)

Application Number Priority Date Filing Date Title
CN201510983346.2A CN106919465B (zh) 2015-12-24 2015-12-24 用于存储系统中多重数据保护的方法和装置

Publications (2)

Publication Number Publication Date
CN106919465A CN106919465A (zh) 2017-07-04
CN106919465B true CN106919465B (zh) 2021-03-16

Family

ID=59086548

Family Applications (1)

Application Number Title Priority Date Filing Date
CN201510983346.2A Active CN106919465B (zh) 2015-12-24 2015-12-24 用于存储系统中多重数据保护的方法和装置

Country Status (2)

Country Link
US (2) US10324813B2 (zh)
CN (1) CN106919465B (zh)

Families Citing this family (8)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
CN106919465B (zh) 2015-12-24 2021-03-16 伊姆西Ip控股有限责任公司 用于存储系统中多重数据保护的方法和装置
US10411892B2 (en) * 2015-12-28 2019-09-10 International Business Machines Corporation Providing encrypted personal data to applications based on established policies for release of the personal data
CN111125001A (zh) * 2018-10-31 2020-05-08 伊姆西Ip控股有限责任公司 快照复制方法、电子设备和计算机程序产品
US10795787B1 (en) * 2018-10-31 2020-10-06 EMC IP Holding Company LLC Disaster recovery for software defined network attached storage using storage array asynchronous data replication
US10795786B1 (en) * 2018-10-31 2020-10-06 EMC IP Holding Company LLC Disaster recovery for software defined network attached storage using storage array synchronous data replication
CN112307013B (zh) * 2019-07-30 2025-01-24 伊姆西Ip控股有限责任公司 用于管理应用系统的方法、设备和计算机程序产品
CN111309803B (zh) * 2020-01-17 2023-03-14 西安奥卡云数据科技有限公司 基于资源使用率的智能远程复制系统
US11803571B2 (en) 2021-02-04 2023-10-31 Hewlett Packard Enterprise Development Lp Transfer of synchronous and asynchronous replication

Citations (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US7225307B2 (en) * 2004-05-04 2007-05-29 International Business Machines Corporation Apparatus, system, and method for synchronizing an asynchronous mirror volume using a synchronous mirror volume
CN101030154A (zh) * 2006-01-25 2007-09-05 国际商业机器公司 将应用重新定位到拓扑上位于远程计算系统的系统和方法
CN103814360A (zh) * 2013-12-12 2014-05-21 华为技术有限公司 数据复制方法及存储系统

Family Cites Families (4)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US7437598B2 (en) * 2004-12-23 2008-10-14 Xiv Ltd. System, method and circuit for mirroring data
US7702953B2 (en) * 2007-01-04 2010-04-20 International Business Machines Corporation Storage management in cascaded replication of data
US9348715B2 (en) * 2014-03-20 2016-05-24 Netapp Inc. Storage device health status synchronization
CN106919465B (zh) 2015-12-24 2021-03-16 伊姆西Ip控股有限责任公司 用于存储系统中多重数据保护的方法和装置

Patent Citations (3)

* Cited by examiner, † Cited by third party
Publication number Priority date Publication date Assignee Title
US7225307B2 (en) * 2004-05-04 2007-05-29 International Business Machines Corporation Apparatus, system, and method for synchronizing an asynchronous mirror volume using a synchronous mirror volume
CN101030154A (zh) * 2006-01-25 2007-09-05 国际商业机器公司 将应用重新定位到拓扑上位于远程计算系统的系统和方法
CN103814360A (zh) * 2013-12-12 2014-05-21 华为技术有限公司 数据复制方法及存储系统

Also Published As

Publication number Publication date
US10324813B2 (en) 2019-06-18
US20190303256A1 (en) 2019-10-03
CN106919465A (zh) 2017-07-04
US20170185497A1 (en) 2017-06-29
US10860445B2 (en) 2020-12-08

Similar Documents

Publication Publication Date Title
US8271447B1 (en) Mirroring metadata in a continuous data protection environment
US8694700B1 (en) Using I/O track information for continuous push with splitter for storage device
US8332687B1 (en) Splitter used in a continuous data protection environment
US7308545B1 (en) Method and system of providing replication
JP4668763B2 (ja) ストレージ装置のリストア方法及びストレージ装置
US9697092B2 (en) File-based cluster-to-cluster replication recovery
US11080148B2 (en) Method and system for star replication using multiple replication technologies
US8806274B1 (en) Snapshot assisted synchronous replication
US9672117B1 (en) Method and system for star replication using multiple replication technologies
US11487463B2 (en) Adaptive replication modes in a storage system
US7039661B1 (en) Coordinated dirty block tracking
US10860445B2 (en) Methods and devices for multi-level data protection in a storage system
US10565071B2 (en) Smart data replication recoverer
EP3361383B1 (en) Modifying membership of replication groups via journal operations
WO2014059804A1 (zh) 数据同步方法及系统
US11275764B2 (en) Highly resilient synchronous replication with automatic recovery
CN103905220B (zh) 数据同步处理方法及系统
US20200341861A1 (en) Method, device, and computer-readable storage medium for managing storage system
CN101815099A (zh) 双控磁盘阵列中双控制器配置信息同步的方法和装置
WO2017014814A1 (en) Replicating memory volumes
CN106326030B (zh) 用于存储系统中的软切换的方法和装置
CN109491980A (zh) 一种文件系统远程复制方法、装置、设备及存储介质
US12105605B2 (en) Data replication control for high available system
JP2012230489A (ja) ディスクアレイ装置、同期方法及びプログラム
JP2008129723A (ja) データレプリケーションシステム、データレプリケーション方法、データレプリケーションプログラム

Legal Events

Date Code Title Description
PB01 Publication
PB01 Publication
SE01 Entry into force of request for substantive examination
SE01 Entry into force of request for substantive examination
TA01 Transfer of patent application right

Effective date of registration: 20200424

Address after: Massachusetts, USA

Applicant after: EMC IP Holding Company LLC

Address before: Ma Sazhusaizhou

Applicant before: EMC Corp.

TA01 Transfer of patent application right
GR01 Patent grant
GR01 Patent grant