ApacheBeam从Kafka进行流式处理,在固定时间窗口内将数据写入文件时不起作用。
创始人
2024-09-05 11:01:00
0

使用以下 Beam 代码来从 Kafka 读取数据并将其写入到文件中,每 10 秒钟创建一个新文件:

import apache_beam as beam
from apache_beam import window
from apache_beam.transforms.trigger import AfterProcessingTime

# Kafka configuration
KAFKA_BOOTSTRAP_SERVERS = ''
KAFKA_TOPIC = ''

# Beam pipeline configuration
OUTPUT_DIR = ''

# Pipeline
def run():
    with beam.Pipeline() as p:
        records = (
            p
            | 'ReadFromKafka' >> beam.io.ReadFromKafka(
                consumer_config={'bootstrap.servers': KAFKA_BOOTSTRAP_SERVERS},
                topics=[KAFKA_TOPIC],
            )
            | 'Format' >> beam.Map(lambda r: str(r.value, 'utf-8'))
            | 'Window' >> beam.WindowInto(window.FixedWindows(10))
            | 'WriteToFiles' >> beam.io.WriteToText(
                OUTPUT_DIR,
                file_name_suffix='.txt'
            )
        )

if __name__ == '__main__':
    run()

这段代码定义了一个 Beam 管道,它包含从 Kafka 读取记录、转换记录、应用固定窗口和将数据写入文本文件的步骤。这里的窗口大小为10秒钟,并且每10秒钟都会创建一个新文件。

相关内容

热门资讯

一次性透视!aapoker破解... 一次性透视!aapoker破解侠是真的“推荐开挂辅助器”1、aapoker破解侠是真的系统规律教程、...
第一次性发现!指尖四川辅助脚本... 第一次性发现!指尖四川辅助脚本“解谜开挂辅助插件”亲,关键说明,指尖四川辅助脚本赛季回归,指尖四川辅...
六次性领会!指尖四川辅助脚本视... 六次性领会!指尖四川辅助脚本视频“揭幕开挂辅助教程”1、上手简单,内置详细流程视频教学,新手小白可以...
9次性普及!掌电竞技辅助器“解... 9次性普及!掌电竞技辅助器“解密开挂辅助插件”一、掌电竞技辅助器AI软件牌型概率发牌机制”必胜“技巧...
第8次性掌握!赣牌圈修改器“推... 第8次性掌握!赣牌圈修改器“推荐开挂辅助app”1、上手简单,内置详细流程视频教学,新手小白可以快速...
三次性了解!大菠萝789辅助“... 三次性了解!大菠萝789辅助“解迷开挂辅助神器”1、首先打开大菠萝789辅助最新版本,在大菠萝789...
第二次性私人局!欢聚水鱼神器“... 第二次性私人局!欢聚水鱼神器“曝光开挂辅助器”1、超多福利:超高返利,海量正版游戏,欢聚水鱼神器系统...
3次性理解!闲逸辅助软件“专业... 3次性理解!闲逸辅助软件“专业开挂辅助插件”闲逸辅助软件辅助器中分为三种模型:闲逸辅助软件软件透明挂...
第五次性掌握!皮皮游戏辅助工具... 第五次性掌握!皮皮游戏辅助工具“揭露开挂辅助教程”在进入皮皮游戏辅助工具辅助挂后,参与本局比赛的八名...
1次性晓得!沧海十三水私人局辅... 1次性晓得!沧海十三水私人局辅助器“分享开挂辅助器”沧海十三水私人局辅助器是一种具有地方特色的麻将游...