四台比别的机器烫的 iPhone
有个做 TikTok 矩阵的团队,去年夏天遇到过一件事。
他们发现架子上有四台 iPhone 比同批其他机器明显烫,第一反应是怀疑刚改过的脚本有问题,回滚了两个版本,还是烫。
查了两天,最后把其中一台拆开——电池已经鼓起来了。那四台是同一批买的,只用了十一个月。
后来复盘,最大的问题不是没及时发现,而是顺序搞反了:先怀疑软件,最后才怀疑硬件。如果第一天就拿一台出来摸一下电池,两天能省下来。
站内已经有一篇讲长期运行对设备影响的,那篇讲的是怎么让设备不容易坏——屏幕亮度怎么控、散热怎么安排、轮换机制怎么设、线材怎么选。那是预防。
这篇讲的是另一半:已经坏了,怎么办。 预防可以慢慢做,而设备出问题的那一刻,你需要的是「先做什么、再做什么」。而且大部分人在这个时刻的判断是错的——不是做得不够,是顺序反了。
三种故障,三条不同的判断路径
设备架上的问题,看起来五花八门,归一下类其实只有三种:
- 连不上:电脑识别不到、中控里显示离线、时好时坏。
- 异常发热:明显比同批设备烫,或者热到会自己重启。
- 物理损伤:电池鼓包、充电口接触不良、屏幕或边框变形。
为什么要先分类? 因为这三类的处置逻辑完全不一样。连不上大多数是软件或接触问题,成本低;异常发热要区分是负载带来的热,还是硬件老化带来的热;物理损伤里有一条(鼓包)是安全问题,优先级最高。
混在一起处理,最常见的后果是:为了修一台连不上的设备,把整个分组拆开重新配对;或者发现一台烫得离谱的机器,先怀疑脚本有问题,查了两天最后发现是电池老化。
设备状态集中在一个界面上,是判断「单台故障还是成片故障」最快的方式。
连不上:先排除软的,再怀疑硬的
这三类里,「连不上」是最好解决的,前提是顺序别反。
推荐顺序,成本从低到高:
- 换一根确认好用的线。 这一步最省事,也最容易被跳过——大家的心理是「线是刚买的,不会有问题」。但线材是整条链路里最脆弱的环节,尤其是长期固定不动的线,内部断股是常见的。
- 换一个确认好用的接口(电脑本口或集线器上的另一个口)。这一步能区分「设备问题」和「这个口的问题」。
- 换到另一台电脑上试。 如果换电脑就好了,问题在原来那台机器上——驱动、供电、或者 USB 控制器。
- 检查授权和环境是否正常。 授权过期、开发者模式没开、自动化环境没启动,都会表现为「连不上」。这类问题在设备侧怎么试都没用。
- 最后才怀疑设备本身。 前面四步都排除之后,才轮到怀疑这台机器。
把顺序反过来会怎样?你会花半天时间拆设备架、重做配对,最后发现是线的问题。成本最高的排查放在最后,这是这条顺序的全部意义。
有一个细节值得记住:如果故障是「时好时坏」,几乎可以确定是接触类问题(线材、接口、弹片),而不是软件。软件问题通常是一致性的——能用就一直能用,不能用就一直不能用。
异常发热:先找对照,再判断
发热这件事最容易误判,因为单看一台设备,你没法知道这个温度算不算高。
判断方法是找对照:同一批机器、跑同样的任务,如果只有某几台明显更烫,那几台就是有问题的;如果整批都一样烫,那问题在负载本身,不在设备。
找到个别异常的设备之后,再往下分:
- 摸外壳烫、但机器运行正常。多半是散热路径被堵了——设备平铺太密、底部通风孔被支架挡住、或者机器内部积灰。这类处理起来最简单:挪开、留出空隙、清一次灰。
- 烫且伴随自动重启、掉帧、切应用卡顿。这类要往前一步想,可能是电池老化导致的内阻升高——电池状态差的时候,放电发热会明显加剧。查一下电池健康度,掉到很低的水平就该考虑换了。
- 只有某几台烫,而且这几台是同一批买的。这是最需要警惕的一种,说明可能是批次性问题。同一批次的电芯或主板散热用料如果有一致性缺陷,会以同样的方式表现出来。
至于「正常负载下的热」,那属于预防范畴——安排空闲时段、改善物理散热,这些在那篇里讲过了,这里不重复。
鼓包:这条没有商量的余地
前面几类都可以权衡,这一类不行。
发现电池鼓包的设备,立刻断电、立刻停用。
原因不是「可能影响性能」,是安全。鼓包意味着电池内部已经发生了不可逆的化学变化,继续充电有起火风险。而群控设备恰恰是 7×24 小时插着电的,这个风险会被成倍放大——白天没人在机房的时候尤其危险。
处置上有三个动作:
- 断电,不是待机。 拔掉充电线,能关机就关机。
- 单独隔离。 不要让它继续和别的设备挤在同一个架子上。鼓包会把外壳和屏幕顶起来,继续受力可能造成更严重的形变。
- 尽快处理,不要拖。 不要因为「还能开机」就先放着继续跑任务。这是唯一一类我建议「先停下业务再处理」的故障。
怎么提前发现?其实很直观——设备平放在桌面上会晃。每隔一段时间把设备拿起来看一眼背面有没有隆起,尤其是跑了一年以上的机器。这个动作十秒钟,但能避免很麻烦的事。
充电口和屏幕:最常见,也最容易拖
这两类不会立刻让设备停机,所以最容易被一拖再拖。
充电口接触不良,处理顺序是:先自己清理,再考虑送修。相当比例的「充不上电」其实只是接口里积了灰、棉絮或者氧化层,用压缩空气吹一下、用牙签之类的非金属东西轻轻挑一下就能恢复。清理之后仍然不行的,才是触点氧化或者弹片变形,这种要送修。
需要提醒的是:群控设备因为长期插线不拔,充电口的磨损速度比日常使用快得多。所以看到某台设备「充电时好时坏」,别当成偶发——它就是正在坏的前兆,早处理成本低。
屏幕和边框的问题主要是两种:被夹持式支架压出痕迹、屏幕边缘受力变形。这类问题不影响脚本运行(脚本一般不依赖物理屏幕),但会影响设备残值。如果发现某台已经明显变形,建议不要再压着用,换个支架方式。
修还是换:三条判断线
到了这一步,需要的是决策而不是技术。三条线,任何一条成立就换:
- 维修成本超过同型号二手设备的价格。 这是最直接的一条。主板级维修经常比换一台二手机还贵。
- 这台设备有难以迁移的数据或配置依赖。 比如它绑定了特定的账号、或者它的参数是单独调过的。这种情况下维修的性价比反而更高。
- 故障会影响整批调度。 如果它所在的设备分组里,任务是需要整组同步执行的,那么这台不稳定的设备会拖累整组。这种情况优先换掉,不要等修好。
反过来,什么情况值得修?故障明确、单点、且不影响整组。 比如一台设备屏幕出了点问题但功能正常,或者只是充电口需要清理。这类修一修很划算。
什么时候该整批换,而不是一台台修
这是最容易被忽略的判断,因为它触发得很慢。
三个信号出现任意一个,就该考虑整批替换:
- 同一批设备里故障开始成串出现。比如一个月内坏了五台以上。
- 机型已经太旧、系统版本跟不上脚本要求。这类问题不是修能解决的,是整体过时。
- 故障集中在同一个批次号或同一种使用年限上。这说明是批次性衰减,接下来会一台接一台。
一台台修的成本不只是维修费,还有你处理故障的时间。iPhone 批量运维最怕的就是故障成串出现:到这一步,话题已经从设备维修变成持续消耗——你永远在处理下一个硬件问题,而不是在推进业务。
换设备的时候注意两点:
一是尽量同型号替换。 不同机型分辨率不同,脚本里的坐标需要重新适配。整批同型号,维护成本低一个量级。
二是按分组换,不要一台台换。 同一组设备承担同样的任务,整组替换可以避免新旧混跑导致任务分配不均,也方便一次性验证脚本在新设备上跑得对不对。
整组替换之后,设备别名也能批量重设一遍,不用一台台改。
最后
回到那四台机器。换掉电池之后它们又跑了半年才退役——因为发现得不算太晚,而且发现之后没有再瞎折腾。
设备故障这件事,处置的核心不是技术难度,是顺序和边界:先排除成本最低的可能,再动设备;先判断是单点还是批次,再决定修还是换;遇到鼓包就立刻停,不权衡。
除了这些,剩下的大部分设备损耗其实都可以靠预防避免——亮度、散热、轮换、线材,那篇里讲得比我这里细:长期运行苹果群控系统,对被控手机有哪些影响。
设备数量上去之后的做法,可以顺带看看苹果群控带机量实测。
关于 EasyClick:手机自动化 AI 智能体平台,覆盖安卓免 root、iOS 免越狱、鸿蒙 Next 三大生态,提供脚本开发、苹果群控、本地中控投屏与云控系统。→ 了解全部产品
想要真实跑起来?
本文介绍的方案均可在 EasyClick 手机自动化平台落地。官网提供完整文档、开发工具与群控云控产品,免费体验。