开篇答案
服务器“跑AC或DC”指的是两种完全不同的技术语境:一种是电源标准(交流电AC与直流电DC),另一种是设备告警代码(AC=自动呼叫失败,DC=设备掉线)。 绝大多数用户遇到的“跑AC或DC”,指的都是机房运维和设备告警层面的含义,而不是电工学里的电流方向。
服务器场景下AC和DC到底指什么
很多刚接触服务器运维的人,第一次看到“跑AC/DC”会联想到摇滚乐队,或者以为是电源适配器的问题,这很正常,因为这两个缩写在不同语境下含义完全不同。
电源语境下的交流与直流
在数据中心设计或采购服务器电源时,AC(Alternating Current)指交流电,也就是市电的标准形态,电压通常为220V(国内)。DC(Direct Current)指直流电,常见于电信机房里的-48V直流供电系统,或者某些高压直流(HVDC)供电方案。
行业内很多老机房仍然采用-48V直流供电给通信设备,而IT服务器大多使用交流电源,如果你听到“这台机器跑DC”,在通信行业里大概率说的是设备由直流电源柜供电,而不是插普通插座。
设备告警语境里的AC和DC
在华为、中兴等品牌的数通设备或服务器管理系统中,AC是“Automatic Call”的缩写,DC是“Disconnected”或“Device Call”的简称。 当业务板卡或主控板出现异常,系统会自动发出呼叫上报(AC),如果上报失败,就会在日志中记录一条“AC/DC”错误。
这个AC/DC报错常见于以下场景:
- 服务器主板上的BMC(基板管理控制器)检测到电压异常
- 业务板与主控板之间的通信链路中断
- 电源模块热插拔过程中产生的瞬时冲击
- 设备升级固件后,各板卡之间的握手协议不匹配
当运维群里有人说“这台服务器跑AC或DC了”,大概率是在说机器报错了,而不是在讨论电源类型。
误把告警当电源问题:一个常见误区
我见过不少刚入行的运维新手,第一次看到日志里的“AC/DC”告警,立刻去机房换电源线、换插排,折腾半天发现故障依旧,这个现象非常普遍,因为命名确实有迷惑性。
如何快速判断是哪种“跑AC/DC”
这里给一个简单粗暴的判断路径:

- 查看服务器前面板的指示灯状态,如果电源指示灯正常绿色,但告警灯闪烁,优先考虑设备告警层面
- 登录BMC管理界面,查看传感器读数,如果电压、电流数值都在正常范围内,那就和电没关系
- 检查系统日志里的报错模块,日志里提到“AC/DC”的同时如果伴随“board”或“link down”关键词,基本可以确定是通信或板卡问题
行业共识是,超过八成的“跑AC/DC”报错都指向板卡通信异常或软件层面的误报,真正的硬件供电故障只占很小比例。 但也不能掉以轻心,有些电源模块老化后确实会触发虚假的DC告警,这需要现场排查。
算力设备里的AC/DC还有一层意思
如果你用的是GPU服务器或AI训练集群,最近两年还能听到另一种说法“这台机器跑AC或DC”,指的是加速卡(Accelerator Card)和直连卡(Direct Card)的不同拓扑结构。
- AC形态:加速卡通过PCIe Switch连接到CPU,支持多卡互联
- DC形态:加速卡直接连接到CPU的PCIe通道,延迟更低
这种语境常见于GPU服务器的选型讨论中,国内不少AI公司采购服务器时,会纠结选AC架构还是DC架构,因为这直接关系到推理性能和成本。 如果你在算力租赁群里听到类似说法,大概率是在聊这个。
服务器跑AC或DC怎么排查和解决
既然搞清楚了含义,接下来就是具体的操作路径,以下步骤适用于设备告警场景,也是日常运维中需求量最大的部分。
第一步:确认告警来源
登录服务器的管理口(通常为独立IP),进入命令行或Web界面,执行以下操作:
# 查看系统日志中的AC/DC相关记录 ipmitool sel list | grep -i "AC|DC" # 查看所有传感器状态 ipmitool sdr list
如果sel列表里有明显的“Automatic Call Failed”或类似条目,就确认了是板卡上报失败导致的告警。
第二步:软复位与板卡重新注册
很多AC/DC报错是瞬时性的,硬件本身没坏,这时候可以尝试:
- 在BMC管理界面执行“复位业务板”或“重启板卡”操作
- 如果是双主控设备,尝试主备倒换
- 等待2-3分钟,观察告警是否自动消失

业内专家指出,接近一半的AC/DC误报都能通过软复位清除,不需要拔硬件。
第三步:硬件层面的物理排查
如果软复位无效,就需要物理层面介入了。按以下顺序操作,效率最高:
- 关机并断开电源线,等待30秒让电容放电
- 拔出所有业务板卡,检查金手指是否有氧化发黑痕迹
- 用橡皮擦轻擦金手指,再重新插紧
- 插上电源线后开机,查看告警是否消失
- 如果问题依旧,尝试单板逐个上电,定位故障板卡
这个过程中要特别注意防静电手环的使用,尤其是秋冬干燥季节,静电导致的二次损坏是板卡维修中非常常见的人为故障。
第四步:固件升级与配置回滚
如果物理排查无果,且近期做过固件升级或配置变更,可以考虑回滚操作:
- 备份当前配置文件
- 回滚到升级前的固件版本
- 观察是否仍然报AC/DC错误
据行业公开信息,部分型号的BMC固件在特定版本存在误报AC/DC告警的已知缺陷,升级到修复版本即可解决。
数据中心供电场景下的AC/DC选择
回到电源层面,如果你正在规划机柜供电方案,或者需要理解服务器跑AC或DC在基建层面的区别,可以参考下表对比:
| 对比维度 | 交流供电(AC) | 直流供电(DC) |
|---|---|---|
| 市电兼容性 | 直接用市电,无需转换 | 需要整流设备,减少一次逆变 |
| 传输效率 | 较长距离损耗较大 | 高压直流传输损耗更低 |
| 设备适配 | 绝大多数服务器原厂支持 | 需要定制电源模块或转接 |
| 维护难度 | 标准成熟,工程师都会 | 电信背景团队更熟悉 |
| 成本 | 采购成本较低 | 定制成本高,但长期电费可能节省 |
近年来国内大型云数据中心开始测试240V/336V高压直流供电方案,主要目的是减少传统UPS系统的多次电能转换损耗,但中小型企业自建机房,还是以常规AC供电为主,因为通用性最好,维修时随便找个电工就能处理。

如果真需要维修,费用大概多少
既然涉及到硬件排查,很多用户会关心服务器跑AC或DC维修多少钱,这个价格区间跨度很大,取决于故障范围和是否在保:
- 软件层面的误报重置,通常免费,找厂商远程或自己操作即可
- 单块业务板卡损坏,更换价格在1000-5000元之间,具体看型号
- 主控板故障,更换成本通常3000-8000元起步
- 电源模块损坏,500-2000元不等
需要提醒的是,如果在保修期内,不建议自行拆机维修,直接联系原厂售后走流程,避免因为人为拆解导致保修失效。
相关问答
服务器跑AC或DC在日志里长什么样
典型的日志条目类似于“slot 1 board report AC fail”或“DC link abnormal”,不同厂商的格式有差异,但核心关键词就是“AC”和“DC”组合出现,华为设备常见“AC/DC 0x”开头的十六进制错误码,思科设备则更多表现为“SPA”接口报错,看到这类日志,优先按板卡通信问题处理,而不是断电重启整个机柜。
服务器报AC是什么问题
如果单独报AC,最常见的诱因是主控板与业务板之间的协商超时,业务板在启动过程中没有在规定时间内响应该板注册请求,主控板就上报了自动呼叫失败,这种情况多发生在设备冷启动后,各板卡上电时序不一致导致,解决方法就是等所有板卡完全启动后,执行一次主备倒换或手动复位业务板,让它们重新注册。
跑DC和跑AC在功耗上有明显区别吗
同等负载下,AC供电由于需要经过服务器内部的电源模块转换,转换效率通常在90%-94%之间,而大型数据中心采用高压直流供电时,减少了UPS的逆变环节,整体效率可以提升2-4个百分点,但对于单台服务器而言,这个差异不会在电费账单上体现出来,只有上百台设备规模才值得考虑直流方案。
理解服务器跑AC或DC的关键,是先分清语境再动手排查。 无论是设备告警还是供电架构,掌握基本的判断思路和操作步骤,就能避免很多无效折腾,硬件层面的问题最终还是要靠现场检查来拍板,日志和远程诊断只是第一步。
图片来源于AI模型,如侵权请联系管理员。作者:酷小编,如若转载,请注明出处:https://www.kufanyun.com/ask/866816.html


评论列表(2条)
这篇文章的内容非常有价值,我从中学习到了很多新的知识和观点。作者的写作风格简洁明了,却又不失深度,让人读起来很舒服。特别是这台机器跑部分,给了我很多新的思路。感谢分享这么好的内容!
@萌cyber219:这篇文章写得非常好,内容丰富,观点清晰,让我受益匪浅。特别是关于这台机器跑的部分,分析得很到位,给了我很多新的启发和思考。感谢作者的精心创作和分享,期待看到更多这样高质量的内容!