Spring Batch 中只有 1 个块大小是不是很糟糕？

jiji 发表于 Dev

Jiji

我必须处理一个文件，该文件具有相同 ID 和不同日期的记录。如果特定 ID 有多个日期不同的记录，则必须将所有记录相加。目前，我的解决方案是按一个块编写并让 SQL 查询来做求和部分，因为我无法知道相同 ID 的多个条目是否在同一个块中。这样做是否会产生巨大的性能影响，尤其是我正在处理价值 10 万的数据？

马哈茂德·本·哈辛

这样做是否会产生巨大的性能影响，尤其是我正在处理价值 10 万的数据？

是的，这可能会影响您的步骤的性能，因为每个项目都将在其自己的事务中进行处理。使用 100k，您将有 100k 个事务，而如果 chunk-size=1000，例如，您将只有 100 个事务。

面向块的处理模型并不真正适合您要执行的操作，因为具有相同 ID 的项目可能跨越不同的块。这种需求的一种常用技术是将数据加载到临时表中（例如，如果针对 sqlite 完成，这可能是一个非常快的步骤），然后针对该表运行聚合 SQL 查询。

本文收集自互联网，转载请注明来源。

如有侵权，请联系 [email protected] 删除。

编辑于 2021-09-8

我来说两句

0 条评论

登录后参与评论

上一篇：android studio v3.4 拒绝访问

TOP 榜单

文章

Spring Batch 中只有 1 个块大小是不是很糟糕？

Spring Batch 中只有 1 个块大小是不是很糟糕？

Linux的官方Adobe Flash存储库是否已过时？

如何使用HttpClient的在使用SSL证书，无论多么“糟糕”是

错误：“ javac”未被识别为内部或外部命令，

在 Python 2.7 中。如何从文件中读取特定文本并分配给变量

Modbus Python施耐德PM5300

为什么Object.hashCode（）不遵循Java代码约定

如何检查字符串输入的格式

检查嵌套列表中的长度是否相同

错误TS2365：运算符'！=='无法应用于类型'“（”'和'“）”'

如何自动选择正确的键盘布局？-仅具有一个键盘布局

如何正确比较 scala.xml 节点？

在令牌内联程序集错误之前预期为 ')'

如何在JavaScript中获取数组的第n个元素？

如何将sklearn.naive_bayes与（多个）分类功能一起使用？

ValueError：尝试同时迭代两个列表时，解包的值太多（预期为 2）

如何监视应用程序而不是单个进程的CPU使用率？

解决类Koin的实例时出错

ES5的代理替代

有什么解决方案可以将android设备用作Cast Receiver？

VBA 自动化错误：-2147221080 (800401a8)

套接字无法检测到断开连接