laravel队列任务卡住或静默失败的根本原因是缺乏失败记录与可观测性:需创建failed_jobs表并配置database失败驱动;启用horizon实现可视化监控;高优任务须结合$tries、retryuntil()、addmilliseconds()及--sleep=0实现毫秒级重试。

线上Laravel应用的队列任务突然卡住、静默消失或反复失败,导致订单未发货、邮件未发送、数据未同步,业务链路中断却无告警——这不是偶发故障,而是队列系统缺乏重试策略与可观测性配置的必然结果。
确认失败任务是否被持久化记录
第一步不是重试,是确认系统是否具备记录能力。若failed_jobs表不存在,所有失败任务将直接丢弃,连排查依据都没有。
运行php artisan queue:failed-table生成迁移文件。
执行php artisan migrate创建failed_jobs表。该表必须存在,否则queue:failed命令始终返回空列表,【你看到的“没失败”很可能只是没记录】。
检查config/queue.php中'failed'配置项:驱动必须设为database-uuids或database,且database指向已配置的数据库连接名。
启用Horizon实现可视化监控
Horizon是Laravel官方提供的Redis队列监控方案,能实时显示队列吞吐、延迟、失败率和单个任务堆栈,比日志grep高效百倍。
方法一:安装并初始化
执行composer require laravel/horizon。
运行php artisan horizon:install生成配置与资源。
执行php artisan vendor:publish --provider="Laravel\Horizon\HorizonServiceProvider"发布配置文件。
方法二:关键配置校验
确保.env中QUEUE_CONNECTION=redis且REDIS_QUEUE值与Horizon配置中prefix一致。
在config/horizon.php中启用'waits' => true,否则长耗时任务超时不会触发告警。
启动服务:php artisan horizon,访问/horizon查看仪表盘。
配置高优任务毫秒级重试
支付回调、库存扣减等高优先级任务失败后,不能等默认5秒退避,必须100毫秒内重试——这需要组合三处配置。
第一步:在任务类中声明重试次数与退避逻辑
使用$tries = 3限制最大尝试数,避免无限循环;
覆盖retryUntil()方法返回未来时间点,例如now()->addSeconds(1),强制短周期重试。
第二步:在failed()方法中注入毫秒级延迟
调用$this->addMilliseconds(100),该调用会修改下次重试时间戳,跳过默认秒级退避;
注意:此方法仅在database驱动下生效,Redis驱动需配合--sleep=0参数使用。
第三步:启动队列处理器时禁用休眠
运行php artisan queue:work --sleep=0,让worker在无任务时立即轮询而非等待;
【不加--sleep=0,即使代码里写了addMilliseconds(100),实际仍会卡在默认1秒休眠上】。











