【Kafka】2.深入理解Kafka事件流平台及其核心概念

news2025/1/11 2:53:12

1.事件流(Event streaming)

事件流是人体中枢神经系统的数字化的等价物。它是构建“始终在线”世界的技术基础,在这个世界中,企业越来越多地被定义为软件化和自动化,而软件的用户本身也是软件。

从技术上讲,事件流是从数据库、传感器、移动设备、云服务和软件应用程序等事件源实时捕获数据的做法,以事件流的形式;将这些事件流持久化存储以供以后检索;实时以及回顾性地操作、处理和响应事件流;并根据需要将事件流路由到不同的目标技术。因此,事件流确保了数据的持续流动和解释,以便正确的信息在正确的地点,正确的时间可用。

2.事件流作用

事件流适用于各种用例,跨越众多行业和组织。它的许多例子包括:

  • 实时处理支付和金融交易,例如在证券交易所、银行和保险公司。
  • 实时跟踪和监控汽车、卡车、车队和货物,例如在物流和汽车行业。
  • 持续捕获和分析来自IoT设备或其他设备的传感器数据,例如在工厂和风力公园。
  • 收集并立即响应客户互动和订单,例如在零售、酒店和旅游行业以及移动应用程序中。
  • 在医院护理中监测患者并预测病情变化,以确保在紧急情况下及时治疗。
  • 连接、存储并使公司不同部门产生的数据可用。
  • 作为数据平台、事件驱动架构和微服务的基础。

3.Kafka是一个事件流平台意味着什么?

Kafka结合了三个关键能力,因此您可以使用一个经过实战考验的解决方案端到端实现您的事件流用例:

  • 发布(写入)和订阅(读取)事件流,包括从其他系统中持续导入/导出您的数据。
  • 持久可靠地存储事件流,只要您需要。
  • 实时或回顾性地处理事件流。

所有这些功能都以分布式、高度可扩展、弹性、容错和安全的方式提供。Kafka可以在裸机硬件、虚拟机上部署,也可以在容器中部署,在本地以及云中。您可以选择自行管理Kafka环境或使用各种供应商提供的全托管服务。

4.Kafka如何运作?

Kafka是一个由服务器和客户端组成的分布式系统,通过高性能的TCP网络协议进行通信。它可以在本地硬件、虚拟机和容器上部署,在本地以及云环境中。

服务器: Kafka作为一台或多台服务器的集群运行,可以跨越多个数据中心或云区域。其中一些服务器形成存储层,称为代理。其他服务器运行Kafka Connect,以持续地将数据作为事件流导入和导出,将Kafka与您现有的系统集成,例如关系数据库以及其他Kafka集群。为了让您实现关键任务用例,Kafka集群具有高度的可扩展性和容错性:如果任何服务器失败,其他服务器将接管它们的工作,以确保不间断的操作,而不会丢失任何数据。

客户端: 它们允许您编写分布式应用程序和微服务,以并行、大规模和容错的方式读取、写入和处理事件流,即使在网络问题或机器故障的情况下也是如此。Kafka随附了一些这样的客户端,这些客户端由Kafka社区提供的数十个客户端增强:客户端可用于Java和Scala,包括更高级别的Kafka Streams库,适用于Go、Python、C/C++等许多其他编程语言,以及REST API。

5.主要概念和术语

事件记录了“某事发生”的事实,无论是在世界还是您的业务中。它也称为记录或消息(Message)。当您读取或写入Kafka中的数据时,您是通过事件的形式进行的。概念上,一个事件有一个键、值、时间戳和可选的元数据头。这里是一个示例事件:

  • 事件键:“Alice”
  • 事件值:“向Bob支付了200美元”
  • 事件时间戳:“2020年6月25日下午2:06”
    生产者(Producer)是发布(写入)事件到Kafka的客户端应用程序,消费者(Consumer)是订阅(读取和处理)这些事件的应用程序。在Kafka中,生产者和消费者是完全解耦的,并且彼此不知情,这是实现Kafka众所周知的高可扩展性的关键设计元素。例如,生产者永远不需要等待消费者。Kafka提供了各种保证,例如能够精确处理事件的能力。

事件被组织并持久地存储在主题(Topic)中。非常简化地说,主题类似于文件系统中的文件夹,事件是该文件夹中的文件。一个示例主题名称可能是“payments”。Kafka中的主题始终是多生产者和多订阅者:一个主题可以有零、一个或多个生产者将事件写入其中,以及零、一个或多个消费者订阅这些事件。主题中的事件可以根据需要读取尽可能多次 - 与传统的消息系统不同,事件在消费后不会被删除。相反,您通过每个主题的配置设置定义Kafka应该保留您的事件多长时间,之后旧的事件将被丢弃。Kafka的性能对于数据大小实际上是恒定的,因此长时间存储数据完全没有问题。

主题是分区(Partition)的,这意味着主题分布在位于不同Kafka代理上的“桶”上。您的数据的分布式放置对于可扩展性非常重要,因为它允许客户端应用程序同时从/向许多代理读取和写入数据。当发布到主题的新事件时,它实际上被追加到主题的某个分区中。具有相同事件键(例如,客户或车辆ID)的事件被写入到同一个分区中,并且Kafka保证任何给定主题-分区的消费者总是能够按照它们被写入的完全相同的顺序读取那些分区中的事件。
 图示:这个示例主题有四个分区P1-P4。两个不同的生产者客户端正独立于彼此地向主题发布新事件,通过在网络中向主题的分区写入事件。具有相同键(在图中用颜色表示)的事件被写入同一个分区。请注意,如果适当,两个生产者都可以向同一个分区写入。
为了使您的数据具有容错性和高可用性,每个主题都可以复制,甚至可以跨地理区域或数据中心复制,以便在出现问题、您想要对代理进行维护等情况下,始终有多个代理拥有数据的副本。一个常见的生产设置是3的复制因子,即,您的数据将始终有三份副本。这种复制是在主题-分区级别上执行的。

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.coloradmin.cn/o/1678645.html

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈,一经查实,立即删除!

相关文章

数据结构(十五)----排序算法(2)

目录 一.选择排序 1.简单选择排序 2.堆排序 •建立大根堆 •基于大根堆进行排序 堆排序算法效率: 堆排序算法稳定性: 3.堆的插入和删除 •在堆中插入新元素 •在堆中删除元素 二.归并排序 归并排序算法效率: 归并排序算法的稳定…

基于卷积神经网络的一维信号降噪(简单版,MATLAB)

简单演示一下基于卷积神经网络的一维信号降噪,有个大致印象即可。 %% Plot the previous training CNN. set_plot_defaults(on) load(denoiser_sparse.mat); h1{1} double(conv1); h1{2} double(conv2); h1{3} reshape(double(conv3),[8,1,17]); figure(1) [r,c…

又一款爆火AI游戏诞生!《换你来当爹》做对了什么?| ShowMeAI体验报告

社区里几百人玩一款AI游戏的场面,值得记录一下! 大模型游戏化极度看重〖有趣〗程度。 可有趣的灵魂那么难得,以至于只要一眼,我们就在产品的海洋里发现了 ta 。 1. 有趣的灵魂在发疯疯疯 《换你来当爹》是一款全员发疯的AI游戏&am…

分页查询PageHelper插件分页条件查询(xml映射文件,动态SQL)

黑马程序员JavaWeb开发教程 文章目录 一、分页查询-分析二、分页查询-实现1. 实现思路1.1 controller1.2 service1.3 mapper 1.4 postman测试接口 三、分页查询-PageHelper插件1. 引入pageHelper插件的依赖2. 修改原来的代码2.1 mapper2.2 serviceimpl2.3 postman测试接口 四、…

第83天: 代码审计-PHP 项目RCE 安全调试追踪代码执行命令执行

案例一:CNVD拿1day-RCE命令执行-百家CMS 这里用代码审计系统搜索system,可以利用的是第一种 打开看细节 查找函数引用 查找$_file第一次出现的地方 这个时候就明白了,必须上传文件,然后利用文件名,去执行system命令 …

基于YOLOv5的道路裂缝检测,加入一种基于内容引导注意力(CGA)的混合融合提升2个多点

💡💡💡本文主要内容:详细介绍道路裂缝检测整个过程,从数据集到训练模型到结果可视化分析。 💡💡💡通过加入一种基于内容引导注意力(CGA)的混合融合提升检测性能, 特征融合创新 | 一…

硬盘坏道如何检测和修复?

硬盘是我们储存数据的重要设备,然而在使用过程中,我们可能会遇到一些困扰,比如硬盘出现坏道的问题。那么,什么是坏道呢?硬盘出现坏道会对我们的性能和数据安全产生影响吗?如何去检测和修复这些坏道呢&#…

js积累一(ipv4正则校验+弹窗方式)

1. ipv4地址,点分十进制的校验 var regexIP /^((25[0-5]|2[0-4]\d|((1\d{2})|([1-9]?\d)))\.){3}(25[0-5]|2[0-4]\d|((1\d{2})|([1-9]?\d)))$/; if(strRegex.test(ip)) //true: 通过 2. 三种弹窗方式: alert();confirm(); prompt() 1&a…

微分阻尼作用的理解

先说阻尼的作用,阻尼能够缩短系统整定时间,减小系统响应的振动幅度。 1、CODESYS位置式PID(完整ST源代码) CODESYS位置式PID(完整ST源代码)_codesys pid功能块-CSDN博客文章浏览阅读1.2k次,点赞2次,收藏2次。CODESYS增量式PID完整源代码请参看下面文章链接:CODESYS增量式…

echarts的柱状图使用

1. 柱状图&#xff08;柱体顶部使用外部图片 相关代码 <template><div class"out-bg"><div class"container" ref"warnChartRef"></div></div> </template><script> import * as echarts from echar…

【Linux系统编程】基本指令(二)

目录 1、mv指令 2、cat指令 输出重定向 ​编辑 追加重定向 输入重定向 3、more指令 4、less指令 5、head指令 6、tail指令 与时间相关的指令 7、date指令 8、cal指令 9、find指令 10、grep指令 11、zip/unzip指令 1、mv指令 mv文件是用来对文件或目录进行重命名…

网络爬虫安全:90后小伙,用软件非法搬运他人原创视频被判刑

目录 违法视频搬运软件是网络爬虫 如何发现偷盗视频的爬虫&#xff1f; 拦截违法网络爬虫 央视《今日说法》栏目近日报道了一名程序员开发非法视频搬运软件获利超700多万&#xff0c;最终获刑的案例。 国内某知名短视频平台报警称&#xff0c;有人在网络上售卖一款视频搬运…

玩转Matlab-Simscape(初级)- 07 - 基于Solidworks、Matlab Simulink、COMSOL的协同仿真(理论部分3)

** 玩转Matlab-Simscape&#xff08;初级&#xff09;- 07 - 基于Solidworks、Matlab Simulink、COMSOL的协同仿真&#xff08;理论部分3&#xff09; ** 目录 玩转Matlab-Simscape&#xff08;初级&#xff09;- 07 - 基于Solidworks、Matlab Simulink、COMSOL的协同仿真&am…

探索Dapper与EF Core等ORM框架的神器

Dapper的好处&#xff1a; 轻量级&#xff1a;Dapper是一个非常轻量级的库&#xff0c;对性能的影响非常小。它主要关注于执行SQL查询和映射查询结果到对象&#xff0c;因此它的设计和实现都非常简洁。直接SQL&#xff1a;Dapper鼓励直接写SQL&#xff0c;而不是使用抽象查询语…

从独立开发者到成为SeaTunnel社区的贡献者,我做对了哪些事儿?

个人介绍 大家好&#xff0c;我是闫成雨&#xff0c;目前是一名独立开发者。专注于数据开发、机器学习、资源调度算法和分布式系统。 GitHub ID: CheneyYin 个人主页&#xff1a;https://cheneyyin.github.io/ 为社区做了哪些贡献 加强了Spark引擎和Flink引擎对SeaTunnel数据…

photoshop(PS)有什么快速提升工作效率的功能?或者实用功能?这里告诉你7条!

1:文件太多&#xff0c;不方便马上找到需要插入元素&#xff08;元素放入PS会发现&#xff0c;位置不知道在哪里&#xff09;&#xff0c;点击需要选中或者搭配的元素&#xff0c;ctrlV就可以快速插入目标/图层元素的位置了&#xff01; 点击当前元素&#xff0c;选中&#xf…

MT3035 逆波兰式

思路&#xff1a; 两个栈str1和sr2&#xff0c;分别存放运算符和结果。 如果是数字&#xff0c;直接放入str2中。 如果是运算符&#xff1a; 1. ( &#xff1a;直接放入 str1 2. /-/*// 看栈顶元素&#xff0c;若当前字符优先级比栈顶大&#xff0c;则压到str1中&#x…

【STL】string

本节博客主要是介绍了一下CPP标准库中的string这一容器的相关用法和常用接口&#xff0c;有需要借鉴即可。 目录 1.string介绍1.1CPP标准库与STL关系1.2string历史问题与介绍 2.string概要3.Member functions3.1constructor3.2operator 4.访问4.1[]访问4.2迭代器访问4.3范围for…

软件测试的一些概念

一.基本概念 1.什么事需求 1&#xff09;需求的定义 用户需求&#xff1a;可以简单理解为甲方提出的需求&#xff0c;如果没有甲方&#xff0c;那么就是终端用户使用产品时&#xff0c;必须完成的任务&#xff0c;该需求一般比较简略 软件需求&#xff1a;或则叫功能需求&a…

【Amplify_自己写的shadr遇到没有阴影的解决方案】

Amplify 自己写的shadr遇到没有阴影的解决方案 2020-01-21 16:04 本来我有个百试很灵的投射阴影脚本。 这次不灵光了&#xff01;地形内建材质&#xff0c;这个不支持投射的阴影~~奇了怪了。 可以采用引用的方式UsePass加入阴影部分代码&#xff0c;具体操作如下&#xff1…