我有一台 Fortigate 100D,带有 2 个 BT Business Infinity 光纤连接,用作 WAN1 和 WAN2。
BT 线路各有 5 个静态公共 IP,我的 DNS 通过 CloudFlare 托管,指向 WAN 连接之一上的静态 IP。
(假设您在 mylesgray.com 上执行 nslookup,您将看到 217.45.201.1 作为公共 IP)。
我们希望为我们的 A 记录(用于托管网站、VPN、ssh 等)提供冗余,但显然 2 条 BT 线路有 2 组不同的公共 IP,因此如果 WAN1 出现故障,我们将陷入困境 - 没有故障转移,因为地址是静止的。
我已经查找了外部 DNS 故障转移,但这对我来说似乎很混乱而且非常错误(循环法让我很恼火)。然后任播作为一个选项出现,然而,任播似乎需要整个 /24 块或在某些 ISP 的强制转换中甚至是 /22。我们正在运行企业级路由器,因此使用 BGP 等不是问题。
任何人都可以了解如何在不购买 /22 块 IP 或使用循环 DNS 的情况下实现 DNS A 记录的故障转移吗?
背景:我们在小型办公环境中需要一个 HA 服务器,并且正在寻找 DRBD 来提供它。我们只有大约 100GB 需要在 HA 服务器上,服务器负载将非常低。如果我们存档旧的办公室数据,数据可能每年增加约 10%-25%,如果我们不存档,则每年增加 50%-75%。
重点是我们混合使用消费级和企业级硬件,如果我们不提前计划,这将是一个问题;并且预先构建的优质服务器确实会失败,因此冗余服务器似乎是要走的路。
计划:我们认为最好找到 (2) 台最物有所值的二手服务器并同步它们。我们只需要具备 SATA/SAS 功能的服务器和足够多的驱动器空间。如果您达成交易,这些服务器似乎可以以 100-200 美元(+一些零件和额外驱动器)的价格购买。
从理论上讲,这意味着服务器可能会出现故障,如果我们花几天的时间来解决它,只要我们没有另一个巧合的故障,事情就会一直持续下去,直到我们的 IT 部门(我)能够解决它。我们将使用 Debian 作为操作系统。
一些问题
(A) DRBD 如何处理驱动器或控制器故障?也就是说This在存储驱动程序之前显示DRBD,那么当控制器发生故障并写入脏数据或驱动器发生故障但没有立即崩溃时会发生什么?数据是否镜像到另一台服务器,在这种情况下是否存在跨服务器数据损坏的风险?
(B) DRBD 的失败点是什么;理论上,只要一台服务器启动并运行,就没有问题。但是我们知道存在一些问题,那么使用 DRBD 的失败模式是什么,因为它们中的大多数理论上应该是软件?
如果我们要为此使用两台服务器,那么在每个服务器上运行 VM 并使用 MYSQL 和 Apache 进行数据库和 Web 服务器复制是否合理?(我假设是这样)
DRBD 是否足够可靠?如果不是,则不可靠性是与某些任务隔离的,还是更随机的。搜索发现了有各种问题的人,但这是互联网,似乎坏信息多于好信息。
如果数据通过 LAN 同步,DRBD 是否使用双倍带宽?也就是说,我们是否应该在 NICS 上加倍并进行一些链路聚合和中继?然后也许将它们放在单独电路上的单独路由器和单独房间中的 UPS 上,现在您真的有一些冗余!
就服务器管理而言,这对于办公室来说是否太疯狂了?是否有更简单的 REALTIME 替代方案(理论上 DRBD 似乎很简单)。
我们已经有服务器了。所以在我看来,第二台带有 DRBD 专用驱动器的二手服务器可以很容易地以 150-250 美元左右的价格购买。添加第二个路由器、更多驱动器、更多 NIC(已使用)和 (2) 个 UPS,并且正在谈论 1,000 美元 +/-。那是比较便宜的!我希望这主要是在服务器故障期间为我们争取时间。如今,使用 RAID 似乎更容易处理驱动器故障。其他硬件故障,如控制器、内存或电源,可能需要停机来诊断和修复这些问题。
对我们来说,冗余服务器意味着使用过的硬件变得更加可行,有更多的正常运行时间和更多的灵活性,让我可以在我的日程安排允许时修复问题,而不是不得不停止一切来修复服务器。
希望我没有错过这些问题有易于搜索的答案。我进行了快速搜索,但没有找到我要找的东西。
任何人都可以对 SQL Server 群集的可用选项及其优缺点进行高级概述吗?
使用 Microsoft 群集服务还是 SQL Server 本地群集更好?该选择甚至适用于最新的 SQL Server 版本吗?
当我们的 OpenLDAP 服务器断电时,CentOS 机器的控制台几乎无法使用。
我们尝试使用本地帐户登录,但每个命令都需要几分钟才能返回。即使是简单的命令ls也只是坐在那里。
在 Ubuntu 下,同样的配置,这似乎不是问题。本地帐户的初始登录需要一段时间才能成功,但是一旦您一切正常。
我正在寻找一种缓解问题的方法,并提出了一些想法:
是否有更好的解决方案来使用 LDAP 管理某种冗余/故障转移?
目前在我的服务器上,它们全部或几乎全部都有 2 个网卡,其中一个正在使用。每个网卡当然都连接到单个交换机。
我需要做什么才能使这成为冗余,因为两个 NIC 都被使用并连接到不同的交换机,但将有一个具有自动故障转移功能的 IP。
大多数服务器是运行 Windows Server 2003 或 CentOS/Redhat 5ish 的 Dell Poweredge 服务器。
我以前从未设置过这个,但我猜这个主题有点超出一个服务器故障问题,所以我只是在寻找关键字(比如 NIC 绑定?)、链接、关于这个主题的书籍推荐,以及要注意的问题为了。
我将使用 HAProxy 作为负载平衡器来平衡 3 个应用程序服务器上的请求。但是如果平衡器服务器(HAProxy)在某个时候出现故障怎么办?我正在考虑克隆第一个平衡器,因此如果主要平衡器失败,另一个将取而代之。类似于 HSRP。
是否可以?如果是,如何?
对于那里的系统管理员,我试图了解您如何为小型项目维护冗余服务器。我想到的服务器数量不多,只有两台,但我想到了三个主要的基本服务:HTTP、邮件和 DNS。你如何自动化这种双重性?rsync 是首选工具吗(同样适用于小型项目)?
除了这些任务的常用工具外,对书籍和文章的引用将不胜感激。方法越多越好。
我们目前在具有冗余 ip 连接的位置运行 ASA9。我们很乐意进行配置,ip sla以便 Internet 访问能够在单个运营商中断的情况下继续存在。我知道 ip sla 命令,但是当我尝试预填充所需的 NAT 规则时,第二条规则的添加将覆盖第一条规则。下面是一个例子:
object network NYHQ_GUESTWIRELESS_10.110.6.0_24
nat (NYHQ-GUESTWIRELESS,NYHQ-OUTSIDE_FIOS) dynamic interface
Run Code Online (Sandbox Code Playgroud)
当我尝试添加额外的 nat 规则时,也许
nat (NYHQ-GUESTWIRELESS,NYHQ-OUTSIDE_COGENT) dynamic interface
新规则会覆盖先前存在的规则,如下所示:
object network NYHQ_GUESTWIRELESS_10.110.6.0_24
nat (NYHQ-GUESTWIRELESS,NYHQ-OUTSIDE_COGENT) dynamic interface
Run Code Online (Sandbox Code Playgroud)
有什么方法可以让这两个规则都到位,以便 NAT 可以与我们的 SLA 规则合作,以确保无论使用哪个提供商,NAT 仍能正常工作?
本着冗余和故障转移的精神,我想知道一些为 DR 设置 AWS 弹性负载均衡器的策略,也就是说,这是否真的是一个问题?(单个 ELB 会将 LB 流量传输到 1..* 区域。)
我问是因为在提议的云架构中,单点故障可能是只有一个 ELB。
谢谢你。
如果我在 RAID 1 中有 2 个驱动器,并且 Raid 控制器出现故障,这是否意味着服务器上的网站将在更换控制器之前停机?或者在更换有故障的raid卡之前,一切仍会自动作为软件raid进行吗?