我已经多次阅读这些协议,我找不到任何可以保证亚马逊不会丢失或损坏您的数据的内容。他们是否做出任何此类保证?我可以信任 S3 作为我的长期备份存储吗?
是否有任何支持NDMP 的开源备份软件?
我正在寻找用于备份大型 NAS 文件服务器的开源软件(或免费软件),它支持 NDMP 协议并使用 NDMP 协议进行备份/恢复。我找不到任何东西,但...
这是我们一直在努力解决的问题。什么备份软件值得它的重量?您是否使用具有所有花里胡哨的企业级应用程序,或者使用一些本地开发的应用程序,例如一些糟糕的 shell 脚本或批处理文件来完成工作?
如果您认为您使用的程序足以分享,请发布链接。
社区维基,所以没有错误的答案。
您在使用 ENCFS 和 SSHFS 进行远程备份方面的经验是什么?
我的主要疑惑是关于长期稳定性。
我们目前运行着一堆物理机器。对于备份,我们一直在使用 dirvish,它本质上是 rsync 的包装器,并以增量方式进行。我们目前正在将一台新机器投入生产,它将运行一大堆虚拟机。理想情况下,我想备份虚拟机映像,而不是从 VM 本身进行文件级备份。考虑到每个图像将是一个巨大的文件,并且在发生任何变化时都需要新的备份,有没有办法逐步执行此操作?别人这里怎么做VM备份的,就当成物理机了?
如果重要的话,我们正在使用 Xen 来实际进行虚拟化。
谢谢
如果只有MyISAM数据库,无论版本如何,只需复制粘贴数据文件夹即可进行备份和恢复?
但是如果有 INNODB 数据库,并且我们确定源和目标版本将相同,那么这种复制和粘贴方法是否可行?
最好避免键入任何命令来进行备份,因为要执行此操作的人以前从未使用过命令行。
我正在寻找替换我们当前的存储。现有系统只是我们 7 年旧域控制器上的 450GB 文件共享,加上来自另一台服务器的另外 150GB。我们将这些映射到客户端机器上的驱动器。两者都备份到一个 400GB 的磁带驱动器。添加一些系统状态和一个 sql server 数据库,每晚备份大约 600GB。这不仅仅是单个磁带可以做的,所以我们目前有一个交错备份,我们每个工作日晚上只从总空间的 1/5 中“完整”加上所有内容的差异。
为了替换这个,我想转到两个专用服务器(主服务器,加上镜像 和备份在一个)。第一个计划是一个用于操作系统的 RAID 1 卷 + 用于数据的 2 个 RAID 10 2TB 卷(4 个磁盘 + 1 个热备用,总共 12 个 1TB 磁盘包括操作系统)。另一个的计划是拥有相同的 12 个 1TB 磁盘(每晚从第一台服务器镜像)。它还将有 2 个 6TB RAID 6 卷(每个 5 个 2TB 磁盘,单独的卷以缩短不可避免的重建时间),我计划使用我们现有的备份执行软件每晚制作差异快照。这将为真正的备份提供历史/世代存储来代替我们的磁带,并且应该有足够的空间来获得大约 30 天的价值(对我们的更改率的简单检查表明我需要大约 3:1 的比率来完成此操作)。第二台服务器将位于校园的远端,以避免需要将任何东西带离现场。
我更愿意购买供应商支持的解决方案,但成本在这里是一个大问题。我知道我可以做我上面描述的事情,总成本约为 13,000 美元(包括操作系统许可,感谢教育机构的学术定价),这远低于我见过的任何商业选项。我在基本机箱、RAID 卡和背板方面有可靠的合作伙伴,所以我知道我在那里得到了很好的设备,而且我知道我需要高质量的 RAID 卡。我之前没有构建过这种规模的服务器,因此我的问题是:
有什么我遗漏的东西让我不必要地对数据丢失敞开心扉吗?在组装、安装和配置服务器时,我应该做什么或避免什么?还没有购买任何东西,所以我愿意接受其他建议——但价格是关键。一些立即引起我注意的项目,我很感激评论:
注意:自从我第一次问这个问题以来,我对这个问题的理解发生了重大变化(请参阅下面的编辑 2),但我保留了原始版本。
我们已经建立了一个异地备份系统(仍在内部测试),通过 ZFS 发送/接收进行数据传输。两端的机器都是 FreeBSD 8.2。总体而言,该设置运行良好。
但是,对于 ZFS 快照流大小,我显然有一些不了解的地方。我很难找到这方面的信息,所以我希望有更多经验的人可以启发我。
在源机器上,我有一个大约 47GB 的文件系统,我需要为其传输快照:
# zfs list -t snapshot -r -s creation stg/serverx
NAME USED AVAIL REFER MOUNTPOINT
(.......)
stg/serverx@20110620 2.88M - 47.1G -
stg/serverx@20110621 2.89M - 47.1G -
stg/serverx@20110622 2.88M - 47.1G -
stg/serverx@20110623 5.44M - 46.6G -
Run Code Online (Sandbox Code Playgroud)
我在远程服务器上已经有了 6/22 的快照,所以我将生成的流发送给它
zfs send -i stg/serverx@20110622 stg/serverx@20110623
Run Code Online (Sandbox Code Playgroud)
这是在另一端毫无问题地接收到的;然而,生成的流超过 80 GB — 几乎是整个源文件系统大小的两倍。
我是否误解了由生成的“USED”列的含义zfs list?我原以为这个快照流是 5.44M 加上一定量的开销。似乎我不太明白什么是开销。
可能有用的信息:我们将每个服务器备份(通过 rsync)到它自己的文件系统。这个特定的流似乎生成了最大的流(相对于文件系统和快照大小)。我怀疑这可能与它是一个邮件服务器有关,所以它的一些内容是非常动态的。但是,我希望这也会显示在“已使用”大小的快照中。
显然,我们可以通过压缩流来节省很多(它可能会减少到原始大小的 12-20%)。即便如此,带宽仍将是我们的限制因素,因此我们想了解是什么让这些流如此庞大,以及我们是否可以采取任何措施来缓解它。
编辑:我忘记了我们在源文件系统上启用了 zfs 压缩。因此,所使用的 47 …
在站点 A 上,我已经成功地在一台主机上设置了一个 bacula 控制器,在我要备份的主机上设置了几个文件守护程序,最后是一个实际存储备份的存储守护程序。
如果灾难袭击了建筑物站点 A,我希望在另一个站点站点 B 上安装第二个存储守护程序。
文件集、导演等将是相同的,除了作业也将存储在其他存储守护程序中。
是否有任何最佳实践?
我目前正在设置和使用我的新 Linux 机器。作为这些事情的新手,我做得很好,但是一个小错误可能会让我把一切都搞砸。我目前已经成功安装了 Apache 和其他一些东西,并且按照我希望的方式工作,我真的不想搞砸环境。
备份实际环境本身的最简单方法是什么,以便我可以在需要时恢复备份副本(使用 Apache 等完全工作)?