当前位置: 首页 > news >正文

头疼的 Kafka 消息重复问题,从根上解决!

一、前言

数据重复这个问题其实也是挺正常,全链路都有可能会导致数据重复。

通常,消息消费时候都会设置一定重试次数来避免网络波动造成的影响,同时带来副作用是可能出现消息重复。

整理下消息重复的几个场景:
  1. 生产端:遇到异常,基本解决措施都是重试

    • 场景一:leader分区不可用了,抛LeaderNotAvailableException异常,等待选出新leader分区。

    • 场景二:Controller所在Broker挂了,抛NotControllerException异常,等待Controller重新选举。

    • 场景三:网络异常、断网、网络分区、丢包等,抛NetworkException异常,等待网络恢复。

  2. 消费端:poll一批数据,处理完毕还没提交offset,机子宕机重启了,又会poll上批数据,再度消费就造成了消息重复。

怎么解决?

先来了解下消息的三种投递语义:

  • 最多一次(at most once):消息只发一次,消息可能会丢失,但绝不会被重复发送。例如:mqttQoS = 0

  • 至少一次(at least once):消息至少发一次,消息不会丢失,但有可能被重复发送。例如:mqttQoS = 1

  • 精确一次(exactly once):消息精确发一次,消息不会丢失,也不会被重复发送。例如:mqttQoS = 2

了解了这三种语义,再来看如何解决消息重复,即如何实现精准一次,可分为三种方法:
  1. Kafka幂等性Producer保证生产端发送消息幂等。局限性,是只能保证单分区且单会话(重启后就算新会话)

  2. Kafka事务:保证生产端发送消息幂等。解决幂等Producer的局限性。

  3. 消费端幂等: 保证消费端接收消息幂等。蔸底方案。

1)Kafka幂等性Producer

幂等性指:无论执行多少次同样的运算,结果都是相同的。即一条命令,任意多次执行所产生的影响均与一次执行的影响相同。

幂等性使用示例:在生产端添加对应配置即可

Properties props = new Properties(); props.put("enable.idempotence", ture); // 1. 设置幂等 props.put("acks", "all"); // 2. 当 enable.idempotence 为 true,这里默认为 all props.put("max.in.flight.requests.per.connection", 5); // 3. 注意
  1. 设置幂等,启动幂等。

  2. 配置acks,注意:一定要设置acks=all,否则会抛异常。

  3. 配置max.in.flight.requests.per.connection需要<= 5,否则会抛异常OutOfOrderSequenceException

    • 0.11 >= Kafka < 1.1,max.in.flight.request.per.connection = 1

    • Kafka >= 1.1,max.in.flight.request.per.connection <= 5

为了更好理解,需要了解下Kafka 幂等机制:

  1. Producer每次启动后,会向Broker申请一个全局唯一的pid。(重启后pid会变化,这也是弊端之一)

  2. Sequence Numbe:针对每个<Topic, Partition>都对应一个从0开始单调递增的Sequence,同时Broker端会缓存这个seq num

  3. 判断是否重复:<pid, seq num>Broker里对应的队列ProducerStateEntry.Queue(默认队列长度为 5)查询是否存在

    • 如果nextSeq == lastSeq + 1,即服务端seq + 1 == 生产传入seq,则接收。

    • 如果nextSeq == 0 && lastSeq == Int.MaxValue,即刚初始化,也接收。

    • 反之,要么重复,要么丢消息,均拒绝。

这种设计针对解决了两个问题:
  1. 消息重复:场景Broker保存消息后还没发送ack就宕机了,这时候Producer就会重试,这就造成消息重复。

  2. 消息乱序:避免场景,前一条消息发送失败而其后一条发送成功,前一条消息重试后成功,造成的消息乱序。

那什么时候该使用幂等:
  1. 如果已经使用acks=all,使用幂等也可以。

  2. 如果已经使用acks=0或者acks=1,说明你的系统追求高性能,对数据一致性要求不高。不要使用幂等。

2)Kafka事务

使用Kafka事务解决幂等的弊端:单会话且单分区幂等。

Tips这块篇幅较长,这先稍微提及下使用,之后另起一篇。

事务使用示例:分为生产端 和 消费端

Properties props = new Properties(); props.put("enable.idempotence", ture); // 1. 设置幂等 props.put("acks", "all"); // 2. 当 enable.idempotence 为 true,这里默认为 all props.put("max.in.flight.requests.per.connection", 5); // 3. 最大等待数 props.put("transactional.id", "my-transactional-id"); // 4. 设定事务 id Producer<String, String> producer = new KafkaProducer<String, String>(props); // 初始化事务 producer.initTransactions(); try{ // 开始事务 producer.beginTransaction(); // 发送数据 producer.send(new ProducerRecord<String, String>("Topic", "Key", "Value")); // 数据发送及 Offset 发送均成功的情况下,提交事务 producer.commitTransaction(); } catch (ProducerFencedException | OutOfOrderSequenceException | AuthorizationException e) { // 数据发送或者 Offset 发送出现异常时,终止事务 producer.abortTransaction(); } finally { // 关闭 Producer 和 Consumer producer.close(); consumer.close(); }

这里消费端Consumer需要设置下配置:isolation.level参数

  • read_uncommitted这是默认值,表明Consumer能够读取到Kafka写入的任何消息,不论事务型Producer提交事务还是终止事务,其写入的消息都可以读取。如果你用了事务型Producer,那么对应的Consumer就不要使用这个值。

  • read_committed表明Consumer只会读取事务型Producer成功提交事务写入的消息。当然了,它也能看到非事务型Producer写入的所有消息。

3)消费端幂等

“如何解决消息重复?” 这个问题,其实换一种说法:就是如何解决消费端幂等性问题。

只要消费端具备了幂等性,那么重复消费消息的问题也就解决了。

典型的方案是使用:消息表,来去重:

  • 上述栗子中,消费端拉取到一条消息后,开启事务,将消息Id新增到本地消息表中,同时更新订单信息。

  • 如果消息重复,则新增操作insert会异常,同时触发事务回滚。

二、案例:Kafka 幂等性 Producer 使用

环境搭建可参考:https://developer.confluent.io/tutorials/message-ordering/kafka.html#view-all-records-in-the-topic

准备工作如下:

1、Zookeeper:本地使用Docker启动

$ docker run -d --name zookeeper -p 2181:2181 zookeeper a86dff3689b68f6af7eb3da5a21c2dba06e9623f3c961154a8bbbe3e9991dea4

2、Kafka:版本2.7.1,源码编译启动(看上文源码搭建启动)

3、启动生产者:Kafka源码中exmaple

4、启动消息者:可以用Kafka提供的脚本

# 举个栗子:topic 需要自己去修改 $ cd ./kafka-2.7.1-src/bin $ ./kafka-console-producer.sh --broker-list localhost:9092 --topic test_topic

创建topic1副本,2 分区

$ ./kafka-topics.sh --bootstrap-server localhost:9092 --topic myTopic --create --replication-factor 1 --partitions 2 # 查看 $ ./kafka-topics.sh --bootstrap-server broker:9092 --topic myTopic --describe

生产者代码:

public class KafkaProducerApplication { private final Producer<String, String> producer; final String outTopic; public KafkaProducerApplication(final Producer<String, String> producer, final String topic) { this.producer = producer; outTopic = topic; } public void produce(final String message) { final String[] parts = message.split("-"); final String key, value; if (parts.length > 1) { key = parts[0]; value = parts[1]; } else { key = null; value = parts[0]; } final ProducerRecord<String, String> producerRecord = new ProducerRecord<>(outTopic, key, value); producer.send(producerRecord, (recordMetadata, e) -> { if(e != null) { e.printStackTrace(); } else { System.out.println("key/value " + key + "/" + value + "\twritten to topic[partition] " + recordMetadata.topic() + "[" + recordMetadata.partition() + "] at offset " + recordMetadata.offset()); } } ); } public void shutdown() { producer.close(); } public static void main(String[] args) { final Properties props = new Properties(); props.put(ProducerConfig.ENABLE_IDEMPOTENCE_CONFIG, "true"); props.put(ProducerConfig.ACKS_CONFIG, "all"); props.put(ProducerConfig.CLIENT_ID_CONFIG, "myApp"); props.put(ProducerConfig.KEY_SERIALIZER_CLASS_CONFIG, StringSerializer.class); props.put(ProducerConfig.VALUE_SERIALIZER_CLASS_CONFIG, StringSerializer.class); final String topic = "myTopic"; final Producer<String, String> producer = new KafkaProducer<>(props); final KafkaProducerApplication producerApp = new KafkaProducerApplication(producer, topic); String filePath = "/home/donald/Documents/Code/Source/kafka-2.7.1-src/examples/src/main/java/kafka/examples/input.txt"; try { List<String> linesToProduce = Files.readAllLines(Paths.get(filePath)); linesToProduce.stream().filter(l -> !l.trim().isEmpty()) .forEach(producerApp::produce); System.out.println("Offsets and timestamps committed in batch from " + filePath); } catch (IOException e) { System.err.printf("Error reading file %s due to %s %n", filePath, e); } finally { producerApp.shutdown(); } } }

启动生产者后,控制台输出如下:

启动消费者:

$ ./kafka-console-consumer.sh --bootstrap-server localhost:9092 --topic myTopic

修改配置 acks

启用幂等的情况下,调整acks配置,生产者启动后结果是怎样的:

  • 修改配置acks = 1

  • 修改配置acks = 0

会直接报错:

Exception in thread "main" org.apache.kafka.common.config.ConfigException: Must set acks to all in order to use the idempotent producer. Otherwise we cannot guarantee idempotence.

修改配置 max.in.flight.requests.per.connection

启用幂等的情况下,调整此配置,结果是怎样的:

max.in.flight.requests.per.connection > 5会怎样?

当然会报错:

Caused by: org.apache.kafka.common.config.ConfigException: Must set max.in.flight.requests.per.connection to at most 5 to use the idempotent producer.

http://www.cnnetsun.cn/news/3998060.html

相关文章:

  • 深度解析报纸门户网站建设方案:从传统媒体转型到数字化生存的实战指南,助力媒体融合新跨越
  • 4.1.2三目运算符
  • 网站建设合同编号全攻略:如何通过正规流程规避建站陷阱并保障企业权益
  • machine 框格标注的特殊规定(形位公差)
  • 红外多类别无人机 YOLOv11 检测 基于 YOLOv11n 的红外多类型无人机目标检测系统 智慧红外飞行检测 - 红外多类别无人机航拍数据集
  • 揭秘杭州91网站建设背后的真实故事:如何打造一台真正懂生意的营销利器
  • Linux服务器Samba部署实战:跨平台文件共享配置与权限管理
  • 3步轻松解锁华为Bootloader:PotatoNV实用指南全面解析
  • 数学建模竞赛A题实战:从高质量思路到获奖论文的完整指南
  • Apache Doris 4.0.4:HSAP架构与向量检索如何赋能AI数据应用
  • Windows Defender完全移除终极指南:三步轻松优化系统性能
  • 数学建模国赛高效备赛:从信息甄别到论文精修的全流程实战指南
  • 商城网站建设分为几块及后续运营维护深度解析指南
  • SlopCodeBench:渐进披露场景下的代码重构能力基准测试详解
  • 电商多平台数据接口对接技术解析与选型指南
  • 西安营销型网站建设动力无限,助力企业数字化转型的新引擎与未来趋势深度解析
  • 单片机AT指令响应接收:从轮询到DMA的四种高效方法解析
  • 华为OD机试新系统真题 【末世分配资源包】
  • 网站建设实用教程新手必读:从0到1打造高转化官网的避坑指南与落地策略
  • 如何在VSCode中实现秘密阅读?程序员必备的摸鱼插件完整指南
  • 从零基础到独立建站完整揭秘:一份关于网页制作与网站建设项目教程的深度指南
  • 逻辑分析仪与示波器核心差异解析:从原理到实战的数字系统调试指南
  • 从模糊需求到清晰实现:领域驱动设计与Spring Boot实践
  • AMD Ryzen硬件级调试技术深度解析:SMUDebugTool架构设计与实践应用
  • 为什么三极管,一上PCB板电路就炸?一文带你彻底吃透三极管!
  • CentOS 7系统下MySQL 8.0完整安装与安全配置指南
  • 知识问答大模型(维修)技术方案-文档融合与重排
  • MOOTDX架构设计与性能优化深度解析:构建高性能量化数据接口
  • 告别网盘限速!LinkSwift:九大网盘直链解析的终极解决方案
  • 深度解析北京鑫旺路桥建设有限公司网站:如何成为您靠谱的道路桥梁建设合作伙伴