高可用不是技术问题,是取舍问题

大模型流量狂欢下的宕机陷阱

今年年初,国内头部大模型厂商搞了场「免费AI写年报」的拉新活动,上线第三天炸了两次核心服务。 峰值QPS冲到120万,是平日的47倍。备用集群扩容花了整整47分钟才全部拉起。 47分钟,直接丢了12个年付费百万以上的企业客户。相当于这家厂商北方区BD团队一个季度的业绩,直接打了水漂。
2026大模型服务宕机舆情热度统计图
2026大模型服务宕机舆情热度统计图
很多网友骂技术团队运维不力,骂厂商流量预测做的垃圾。其实根本不是那么回事,对吧? 现在大模型厂商抢存量市场抢红了眼,为了抢客户拼了命搞零元体验拉峰值,技术团队要提前预留出应对峰值的高可用冗余,成本直接就炸了。你预留一百倍的闲置资源应对偶尔一次的流量峰值,平时这些资源就只能躺着吃灰,一年下来的成本,直接吃掉一半的毛利。 某头部云厂商的资深架构师私下给我看过一组内部统计:要做到五个九也就是99.999%的高可用,国内企业每年花在 idle 冗余资源上的钱,相当于把整个公司年度研发预算的三成拿去买服务器当备胎摆着,一分钱额外产出都没有。做通用大模型推理服务,多可用区部署的成本比单AZ贵2.8倍,但是峰值可用性只提升了11%。 说白了,你多花了快三倍的钱,换来了几乎感知不到的稳定性提升。

冗余博弈里的本土生意经

说实话,玩高可用玩得最溜的从来不是互联网公司,是做To B生意的云厂商和系统集成商。 前两年我吃饭碰到某股份制银行的CIO,吐槽吐了一桌子。三四年前他们行核心系统上云,云厂商上来就推三地五中心的高可用方案,说国有大行都这么干,你一个股份制银行核心系统不搞这么高规格,出了问题谁担责任? 帽子扣下来,没人敢说不。签字落地,一年光闲置冗余资源的成本就花了两个亿。原来老的两地三中心架构,每年才花八千万,可用性只比新架构低了0.008%,换算下来一年最多宕机不到半小时,对核心业务的影响加起来不到十万块。 这不是交智商税是什么?我当时差点笑喷。
云计算三地五中心高可用架构部署图
云计算三地五中心高可用架构部署图
高可用这套逻辑,其实和二战东线战场的预备队逻辑一模一样:你把八成兵力堆在前线,预备队留少了,被对手撕开一个口子就是全线崩溃;你预备队留了五成,前线打不动对手,一开始就输了。所有把高可用吹成万能解药的,本质都是在劝你多留预备队,多买我的资源而已。 早年华为云抢国内金融云市场,就是靠比阿里云更高的SLA承诺、更严格的故障赔偿条款,撬走了不少原本属于阿里云的大客户。后来阿里云也跟着卷,现在你去问任何一家云厂商,都能拍胸脯给你承诺六个九的可用性,背后是什么?就是把冗余成本全部转嫁到甲方头上,他卖更多的资源,赚更多的利润,真出事了,他顶多赔你几个月的服务费,你亏几个亿的生意,他一分钱不掏。 这就是本土市场的高可用生意经,技术是幌子,卖货是本质。

被PUA的普通从业者

被PUA的普通从业者
被PUA的普通从业者
不过话说回来,被高可用PUA坑得最惨的,还是一线的普通技术从业者和中小创业者。 现在不管是大厂招人还是小公司创业,开口闭口就是几个九的高可用,面试架构师,没做过五个九高可用架构都不好意思进门。创业者刚拿了天使轮,就照着抖音淘宝的标准搭异地多活高可用架构,仿佛不这么做就是技术能力不行,就是项目做不大。 我去年见过一个从拼多多出来的创业者,做本地生活社交,拿了两百万天使轮,一开始就砸了快一百万进去搭高可用架构,每个月光云服务费就四十万,熬了八个月,用户才十万不到,每个月营收才三万块,钱烧完,公司直接关门。 亏透了。没人敢接盘。那个现在还在跑的APP,可用性五个九,有什么用? 绝大多数中国企业,根本不需要五个九的高可用。你开一个线下连锁,十几家店,系统一年宕机一天,能亏你多少钱?你做一个创业项目,死在没有用户的概率,比死在服务宕机的概率高一万倍。 现在整个产业链已经扭成了奇怪的样子:大厂为了技术话语权卷高可用,云厂商为了卖更多资源卷高可用,最后中小公司跟着买单,一线技术从业者996改架构卷可用性,把本来应该用来做产品、做业务的钱和精力,全都砸在了没什么卵用的冗余上。 接下来三年,会有超过一半的中国企业主动砍掉三分之一的高可用预算,活得比之前更滋润。你敢赌吗?
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:高可用不是技术问题,是取舍问题
文章链接:https://www.lfdjt.com/info_23_17040.html