实时计算Flink版:如何配置Task快速重启
网站编辑2022-12-26 11:26:51791
通常,当Flink流作业中的某个Task发生异常时,为了保证数据一致性,同一个PipelineRegion的所有Task都会进行Failover。作业Failover后,Source节点需要从上一个Checkpoint位点开始消费数据。然而,在一些作业中, Task Failover后还需要下载大资源文件或者State数据。如果作业并发很高,所有Task进行一轮Failover的调度时间可能也会比较长。这些都会导致作业出现延迟或阻塞,一段时间内无法正常消费数据等问题,恢复正常运行所需的时间会更长。
1、进入Task快速重启配置入口。
(1)登录实时计算管理控制台。
(2)在Flink全托管页签,单击目标工作空间操作列下的控制台。
(3)在左侧导航栏上,选择应用 > 作业运维。
(4)单击目标作业名称。
(5)在页面右上角,单击返回开发。
(6)单击右侧的高级配置。
2、在Flink配置中,增加如下代码信息。
individual-task-failover.enabled: enabled_approximate
shuffle-service-factory.class: org.apache.flink.runtime.io.network.IndividualRecoverableNettyShuffleServiceFactory
说明 如果您的作业使用的是Session模式的集群,则也需要在Session集群的配置中增加上述代码。session集群配置详情请参见配置开发测试环境(Session集群)。
3、单击保存。
4、单击上线。
5、在作业运维页面,单击启动。
如果您对阿里云的产品感兴趣,可以咨询我们的在线客服,我们7*24小时客服在线,技术专家一对一提供服务,随时随地为您答疑解惑,能为客户带来最优的服务体验!期待与您的合作!







