停在模块名称不一定是死锁,数据补丁可能更新大表,也可能被线上连接阻塞。不要直接终止后反复运行,不可重入补丁可能重复写数据。

先固定复现条件

记录开始时间、模块名和最后一行输出,同时观察 PHP 进程 CPU、MySQL 当前语句及日志是否继续变化。

ps -eo pid,etime,%cpu,%mem,cmd | grep '[s]etup:upgrade'
tail -n 100 var/log/system.log var/log/exception.log
mysql -e 'SHOW FULL PROCESSLIST'
mysql -e "SELECT patch_name FROM patch_list ORDER BY patch_id DESC LIMIT 30"

根据结果定位根因

SQL 正在扫描且行数增长,可评估维护窗口后等待;Waiting for metadata lock 则定位占锁连接。日志中准备执行但 patch_list 未记录的补丁,是首要检查对象。

修复时保留回滚路径

先确认旧进程退出并备份相关表,在生产数据副本复现。补丁应分批处理、以唯一条件保证幂等,不能把整表装入 PHP 内存。修复后以 -vvv 重跑,不要手工把未完成补丁写进 patch_list。

上线后的验收

检查模块状态、schema、数据行数与索引;第二次运行 setup:upgrade 应快速完成且不重复插入。随后退出维护模式并观察 Cron 与前台。

生产环境操作前的检查

针对“Magento 2 setup:upgrade 卡在 Module data setup”进行处理时,先记录 Magento 版本、部署模式、问题 Store View、复现时间和最近一次发布。所有 SQL 默认先执行 SELECT;需要 UPDATE、DELETE、补偿命令或目录删除时,必须先确认命中范围并保留可恢复备份。多 Web 节点环境还要比较代码版本、app/etc/env.php 摘要和当前流量节点,避免只修复其中一台。

php bin/magento --version
php bin/magento deploy:mode:show
php bin/magento maintenance:status
php bin/magento indexer:status
php bin/magento cache:status

命令应由 Magento 文件所有者在项目根目录执行。生产站不要同时运行多个全量索引或静态部署任务;若涉及数据库结构、库存、支付或订单,先在脱敏的生产数据副本验证,再安排维护窗口。

建立可比较的排查记录

每次实验只改变一个变量,并保存“操作前值、执行命令、开始时间、结束时间、结果、回滚方式”。至少准备一个正常对象和一个异常对象作对照,例如两个 SKU、两张订单或访客与登录客户。若修复后仅当前对象恢复,而新建对象仍会复现,说明根因尚未消除。

检查点需要记录通过标准
数据层 主键、Store/Website、更新时间、关联行数 关系完整且无孤儿记录
应用层 异常堆栈、模块、Cron/消费者状态 无新异常并可重复执行
缓存与索引 索引模式、版本、源站和公网响应 按预期周期自动更新
业务回归 正常路径、失败路径、重复请求 结果一致且没有重复副作用

修复后的观察窗口

上线后不要只刷新一次页面就结束。至少观察一轮 Cron、队列消费和索引周期,并在两台节点、无痕浏览器及目标 Store View 重复验证。对日志、数据库行数、错误率和响应时间设置临时观察项;确认它们稳定后再移除调试日志。调试日志可能包含客户、订单或令牌信息,采集时要脱敏,问题结束后及时关闭。