工作总结
发表时间:2026-04-29[高质量]2026年客服工作总结。
三季度247张工单,189个远程摁掉了,58个必须得跑一趟。说“必须”是因为远程实在够不着——要么是现场设备压根没联网,要么是症状太飘忽,日志里看不出名堂。这58趟里,有12趟其实可以省掉。为什么没省掉?因为客服那边第一次接触时漏问了几个关键信息。打个比方,八月初有个超市报“打印机不出票”,远程折腾了半小时,最后我到现场一看,纸卷装反了。来回油费加一小时工时,够买五卷热敏纸。这件事之后我给客服团队做了一页纸的“报修前必问五条”,贴在每个人工位隔板上。九月份再统计,不必要的出勤降到了4趟。
再说解决时长。247个工单从接报到恢复,平均用时47分钟。最短的一个3分钟——重启收银软件就好的那种。最长的一个花了9小时,就是下面要说的那个收银机卡死。
八月十七号,周六下午两点,某连锁便利店老板打来电话,语气已经不太对了:“你们这系统第三个礼拜出毛病了,高峰期一卡就是半分钟,顾客直接摔东西走人。”我先远程过去,CPU、内存、磁盘IO看着都正常。让店长把收银机旁边的冰柜拔掉,他说试过了,没用。我又让他换插座、换排插,还是不行。这时候我判断大概率和电没关系,可能主板有问题。带了一块备用主板和电源,开车四十公里过去。
到现场拆开机器,先测电源输出。12V的线实际只有10.8V,而且随着冰柜压缩机启停,电压能掉到9V以下。这不是换插座能解决的,是这路供电线路老化,压降太大。换上新电源适配器,症状改善了一点,但还是会闪。我接上示波器看波形,纹波峰峰值超过200mV。这时候才明白,不光是电压不足,整个供电环境噪声太大。最后方案:加一台在线式UPS,既稳压又滤波。前后折腾了四个小时,机器终于跑稳了。当晚我守在店里看到晚高峰结束,没有再卡过一次。
走之前跟店长交代了两件事:第一,这台收银机和冰柜不要插在同一路空气开关下,明天我让电工来改线路;第二,以后再有新设备进场,先拿万用表测插座电压,低于210V别开机,直接给我打电话。店长递了瓶水,说了句“辛苦了”。我没接水,但心里舒服了点。
这趟回来后,我把巡检脚本改了一版。原来每周一早上跑的自动检查只有温度、风扇和硬盘,现在加上了电压监测——用lm-sensors读主板的电压传感器,低于标准值5%就报警。具体命令是sensors -u,然后grep出in0_input到in4_input。阈值按每块主板的出厂规格设定,华硕的板子和技嘉的不一样,我做了个配置文件表。目前75台在线终端,跑了两周,标黄了三台。其中两台更换电源后正常,另一台是电源插排接触不良,换插排解决。
日常的设备清理也没闲着。那批五年的自助查询机,夏天过完终于没再死机。我拿高压气枪清灰,压力调到0.6MPa,喷嘴离主板至少15公分,怕把电容吹飞。每台拆开、清完、重新涂硅脂,再改BIOS风扇策略。具体路径:Advanced > Hardware Monitor > CPU Fan Profile,从Silent改成Performance。改完噪音大了,但温度从75度降到52度。顺手写了个cron脚本,每30秒记录一次温度,超过75度发邮件到alerts@邮箱。两个星期跑了43200条记录,最高温59度,安全。
说到验收,三季度四个新点位。我带着工艺对照表去查:接地电阻小于4欧,机柜内扎带间距不超过30公分,标签机用Brother PT-E550W打的三联标签,写明设备名称、IP、上架日期。有一家施工队把六类网线和220V电源线绑在一起走了两米。我让他们返工,项目经理还嘴硬说“以前都这么干,没出过问题”。我说你看误码率——拿FLUKE测,相邻绑扎那段误码率1.2e-6,分开后降到1.7e-10。数据甩过去,不说话了。返工花了三小时,人工成本他们自己扛。
也有彻底翻车的事。九月十四号,一台核心交换机丢包,丢得不多,5%左右,但足以让办公系统卡成狗。查了两天。第一天换模块、换端口、重启、升级固件,都没用。第二天抓包分析,发现丢包集中在几个特定MAC地址上,以为是ARP攻击,查了一圈又排除。最后是机房隔壁装修的工头跑来跟我说:“昨天我们砸墙的时候,你们机柜好像晃了一下。”我跑过去看,机柜位移了将近三厘米,光纤跳线被机柜门夹住,折了个死角。用OTDR打了一下,那个折弯处衰减高达12dB。重新理线、固定机柜,问题解决。
这件事让我彻底改了一个习惯。现在任何故障排查,第一句不是问“报什么错”,而是问“最近有没有人动过物理环境”。装修、搬运、保洁拖地撞到机柜——这些才是真正的隐形杀手。
跟客服团队的配合,之前一直有点隔阂。他们觉得我要求填的信息太多,我觉得他们传上来的信息总是缺胳膊少腿。八月底我花了三个小时,把他们常用的话术重新捋了一遍。比如“设备异常”,改成“指示灯什么颜色?闪烁频率是快还是慢?”“无法开机”改成“按电源键后风扇转不转?屏幕有没有背光?”整理成一张A4纸,起名叫“报修信息采集表”,贴在每台电话旁边。九月份试运行下来,远程解决率从76%提到了82%。客服那边反馈说,照着问完,有一半的报修自己能直接指导用户搞定了。
被骂是常事。九月下旬有个客户投诉我“服务态度差”,理由是电话里我让他“先把电源拔了等三十秒再插上”,他觉得我在敷衍。后来我让客服回放录音,确实语气太硬,没有解释为什么要等三十秒。这件事之后我给自己立了个规矩:每次给指导操作前,先一句话说明原理。“电容放电需要时间,三十秒最保险。”就这一句,用户的配合度明显高了。
说点实在的。三季度247张工单,我统计了一下分类:供电问题占18%,硬件故障占35%,配置错误占22%,物理环境占12%,其他13%。硬件故障里硬盘坏道最多,一共换了11块硬盘。用的都是西数紫盘,换之前用dd做全盘镜像,保留七天。配置错误里,有9次是因为IP地址冲突,后来启用了DHCP保留和ARP静态绑定,再没出现过。
工具清单现在就是我的命根子。万用表是Fluke 17B+,示波器是普源DS1054Z,网线测试用能手NS-468,光功率计用信维的。脚本全用bash写,放在GitLab上,版本号从v2.3升到了v2.7。每次修改必须写commit message,哪怕是“把温度阈值从80调到75”也得写清楚原因。
下一阶段不做大规划,就盯三件事。一,把UPS覆盖率从现在的30%提到60%,优先覆盖餐饮和便利店这类高峰期伤不起的业态。二,给客服团队做一次模拟故障演练,我扮演用户乱报信息,看他们能不能把必问的五条挖出来。三,把我踩过的坑整理成一份《常见故障处置顺序表》,不是教人修机器,是教人判断“该不该报修、报修时该说什么”。
干这行,说白了就是跟不确定性死磕。你以为查了三天是软件bug,结果是隔壁砸墙;你觉得客户瞎报故障,结果他是真不懂。报表上的数字是死的,但每天早晨醒来你不知道今天会被什么问题摁在地上摩擦。这就够了,总比昨天强一点。
- 推荐阅读: 〔高质量〕2026年质量检验员工作总结 [高质量]2026年七年级班务工作总结 〔高质量〕财务成本试用期工作总结 〔高质量〕医学学术编辑工作总结 (高质量)七年级美术工作总结 (高质量)教师职称专业技术工作总结
- 更多精彩工作总结内容,请访问我们为您准备的专题:工作总结