大量消息在mq里积压了几个小时了还没解决 架构
几千万条数据在MQ里积压了七八个小时,最简单的方法可让他恢复消费速度,而后等待几个小时消费完毕。 spa
一个消费者一秒是1000条,一秒3个消费者是3000条,一分钟是18万条,1000多万条 ,因此若是你积压了几百万到上千万的数据,即便消费者恢复了,也须要大概1小时的时间才能恢复过来 blog
通常这个时候,只能操做临时紧急扩容了,具体操做步骤和思路以下: rabbitmq
先修复consumer的问题,确保其恢复消费速度,而后将现有cnosumer都停掉 资源
新建一个topic,partition是原来的10倍,临时创建好原先10倍或者20倍的queue数量 部署
而后写一个临时的分发数据的consumer程序,这个程序部署上去消费积压的数据,消费以后不作耗时的处理,直接均匀轮询写入临时创建好的10倍数量的queue it
接着临时征用10倍的机器来部署consumer,每一批consumer消费一个临时queue的数据 io
这种作法至关因而临时将queue资源和consumer资源扩大10倍,以正常的10倍速度来消费数据 程序
等快速消费完积压数据以后,得恢复原先部署架构,从新用原先的consumer机器来消费消息queue
RabbitMQ中因为消息积压致使过时被清理了怎么办
假设你用的是rabbitmq,rabbitmq是能够设置过时时间的,就是TTL,若是消息在queue中积压超过必定的时间就会被rabbitmq给清理掉,这个数据就没了。
这就不是说数据会大量积压在mq里,而是大量的数据会直接搞丢。
这个状况下,就不是说要增长consumer消费积压的消息,由于实际上没啥积压,而是丢了大量的消息。
咱们能够采起一个方案,就是批量重导。就是大量积压的时候,咱们当时就直接丢弃数据了,而后等过了高峰期之后,这个时候咱们就开始写程序,将丢失的那批数据,写个临时程序,一点一点的查出来,而后从新灌入mq里面去,把白天丢的数据给他补回来。
假设1万个订单积压在mq里面,没有处理,其中1000个订单都丢了,你只能手动写程序把那1000个订单给查出来,手动发到mq里去再补一次