spring data jpa开启批量插入、批量更新的问题解析

来自：网络

时间：2021-08-09

阅读：

最近准备上spring全家桶写一下个人项目，该学的都学学，其中ORM框架，最早我用的是jdbcTemplate，后来用了Mybatis，唯独没有用过JPA（Hibernate）系的，过去觉得Hibernate太重量级了，后来随着springboot和spring data jpa出来之后，让我觉得好像还不错，再加上谷歌趋势。。。

只有中日韩在大规模用Mybatis（我严重怀疑是中国的外包），所以就很奇怪，虽然说中国的IT技术在慢慢抬头了，但是这社会IT发展的主导目前看来还是美国、欧洲，这里JPA、Hibernate是绝对的主流，那么我觉得学习并以JPA为主开发是我接下来个人项目的选择。

那么经过几天简单的摸索，发现JPA可以说是非常的好用，尤其DDD设计思想简直完美符合现在springboot、微服务的设计理念（仅代表个人看法）。

不过呢，在使用过程中就会遇到一个问题，我之前写的爬虫插入效率非常低，一方面是因为我服务器上Mysql表现的极差，详情请看：

[评测]低配环境下，PostgresQL和Mysql读写性能简单对比（欢迎大家提出Mysql优化意见）

另外一方面，JPA的批量插入源码：

这saveAll明明就是循环调用save方法了啊，我们写个简单的测试插入数据方法试一下：

我们打开了Hibernate显示sql日志，看一下输出结果：

看日志，JPA是先把所有的数据全查出来了，如果数据库有就更新，没有就新增。我们再看一下阿里的监控，如果没有配可以按照这个文章里面的方法配

springboot2.0配置连接池（hikari、druid）

我插了5条数据，结果执行了10次sql，这特么。。。我不太能理解，可能是我太菜了？我跑脚本至少了成千上万条数据往库里插，这种写法得给我辣鸡数据库写死。

并且这样效率也太低了吧，查询不会用in？insert不会拼sql？并且很多场景我自己能控制是插入还是新增,我根本不需要你给我校验一次，我只想安安静静的插数据，那么有没有办法呢？有的。

在配置文件里加入：

spring.jpa.properties.hibernate.jdbc.batch_size=500
spring.jpa.properties.hibernate.jdbc.batch_versioned_data=true
spring.jpa.properties.hibernate.order_inserts=true
spring.jpa.properties.hibernate.order_updates =true

这个batch size建议设置成你数据库每秒最大写入数/2 ，没有理由只是我自己感觉这样好一点。。。

自己在repository里面定义两个接口 batchSave，batchUpdate并实现：

@Override
    @Transactional
    public <S extends T> Iterable<S> batchSave(Iterable<S> var1) {
        Iterator<S> iterator = var1.iterator();
        int index = 0;
        while (iterator.hasNext()){
            em.persist(iterator.next());
            index++;
            if (index % BATCH_SIZE == 0){
                em.flush();
                em.clear();
            }
        }
        if (index % BATCH_SIZE != 0){
            em.flush();
            em.clear();
        }
        return var1;
    }

@Override
    public <S extends T> Iterable<S> batchUpdate(Iterable<S> var1) {
        Iterator<S> iterator = var1.iterator();
        int index = 0;
        while (iterator.hasNext()){
            em.merge(iterator.next());
            index++;
            if (index % BATCH_SIZE == 0){
                em.flush();
                em.clear();
            }
        }
        if (index % BATCH_SIZE != 0){
            em.flush();
            em.clear();
        }
        return var1;
    }

然后对批量插入的入口稍作改动，改成刚刚自己实现的调用batchSave的方法

我们运行一下看看结果：

这次500条用了778毫秒，跟之前5条712相差不多，但是我们大家看到了，控制台打印了500条插入语句。。。这个导致我一度以为批量插入失败了，按理说看时间是成功了呀，所以后来配置了阿里的监控一看：

放心了，是Hibernate自己日志打印有问题，所以后来我给Hibernate日志打印关掉了，专心用阿里的druid

目录 mybatis resultType自带数据类型别名定义了一些常见类的别名整理成表格总结 mybatis resultType自带数据类型别名为了简化开发，mybatis 默认在 org.apache.ibat

2024-10-20 21:52:35

目录 1. 引言 2. 核心代码解析 2.1 POM依赖 2.2 SpringBoot启动类注解 2.3 核心代码总结 3. Spring 注解说明 3.1 @Retryable注解 3.2 @Backoff注解 4. 如何使用

2024-10-20 21:52:26

目录 Spring Boot API 中的速率限制步骤 1 - 定义速率限制配置步骤 2 - 创建速率限制方面步骤 3 — 定义 RateLimited 注释步骤 4 - 实施速率限制器步骤 5

2024-10-20 21:52:18

目录引言 1. 使用 Spring Boot 默认的 Logback 日志框架步骤： 2. 使用 Log4j2 日志框架步骤： 3. 在代码中使用日志 4.使用lombok.extern.slf4j.Slf4j 1.基本使用

2024-10-20 21:52:11

目录前言 1.方法一：反射获取线程池中的线程列表 2.方法二：使用Thread.getAllStackTraces() 3.方法三：使用ThreadPoolExecutor的getCompletedTaskCount()和getActiveCount()等

2024-10-20 21:52:03

目录一、使用 @Scheduled 注解二、使用 SchedulingConfigurer 接口三、使用 TaskScheduler 四、使用 Quartz 实现定时任务一、使用 @Scheduled 注解@Scheduled 是 Spring

2024-10-20 21:51:49

目录引言一、问题描述： 1.1 报错示例： 1.2 报错分析： 1.3 解决思路：二、解决方法： 2.1 方法一： 2.2 方法二： 2.3 方法三： 2.4 方法四：三、其他解决方法：四、总结：

2024-10-20 21:51:41

目录 SpringBoot项目启动报错：命令行太长解决 1. 第一种方法 1. 第二种方法 1-1 旧版本Idea 1-2 新版本Idea SpringBoot项目启动报错：命令行太长解决报错信息：1. 第

2024-10-20 21:51:32

目录前言一、Spring Boot 日志框架概述 1.1 Spring Boot 支持的日志框架 1.2 Spring Boot 默认日志配置二、日志框架冲突问题 2.1 问题描述 2.2 解决方案 2.3 检

2024-10-20 21:51:18

目录前言一、Maven 简介二、为什么需要手动添加 JAR 文件？三、Maven 本地仓库位置如何确认本地仓库位置？四、创建必要的目录结构创建目录结构的步骤：五、创建 PO

2024-10-20 21:51:10

目录什么是职责链模式？职责链模式在电商订单流程中的应用 POM 文件配置具体处理器实现控制器接口优化前端界面及 jQuery 调用 JSON 接口总结在电商系统中，订单的处理流

2024-10-18 23:26:01

目录 1.生成war包 1.1 更改pom包 1.2 编写类 1.3 将war包使用 tomcat 解压为文件夹 1.生成war包1.1 更改pom包打开一个springboot 项目，右击项目名从项目管理器打开在po

2024-10-18 23:25:45

数据库表中的字段创建时间 (createTime) 更新时间 (updateTime)每次增删改查的时候，需要通过对Entity的字段（createTime，updateTime）进行set设置，但是，每次增删改都要set设置比

2024-10-18 23:25:25

目录主键策略 1、AUTO(自动增长策略) 2、INPUT(插入前自行设置主键值) 3、ASSING_ID(雪花算法) 4、ASSING_UUID(不含中划线的UUID) 5、NONE(无状态) 雪花算法算

2024-10-18 23:25:12

目录第一个Hystrix程序步骤1：创建父工程hystrix-1 步骤2：改造服务提供者步骤3：改造服务消费者为Hystrix客户端（1）添加Hystrix依赖（2）添加@EnableHystrix注解（3）创

2024-10-18 23:24:58

目录 Config与Bus整合自动刷新步骤1：安装RabbitMQ并启动 RabbitMQ的安装步骤2：创建项目创建Eureka Server 创建config-server 步骤3：添加依赖修改配置文件步骤4：Co

2024-10-18 23:24:27

目录 1. 前言 2. 注册 2.1. 手机验证码注册流程 2.2. 代码实现（仅核心） 3. 登录 3.1. 手机验证码登录流程 3.2. 涉及到的Spring Security组件 3.3. 代码实现（仅核心）

2024-10-18 23:23:50

目录 Java中重写和重载的区别方法重载的规则方法重写的规则总结 Java中重写和重载的区别其实java中的重写和重载没有任何关系，只是因为都有个重字，有些小白就会对这两

2024-10-18 23:23:37

目录 1. 什么是 Spring Web MVC 1.1 MVC 定义 1.2 什么是 Spring MVC 2. 学习 Spring MVC 2.1 项目准备 2.2 建立连接 1. 什么是 Spring Web MVCSpring Web MVC 是基

2024-10-18 23:23:29

目录 springBoot跨域注解@CrossOrigin用法在controller控制类上方加注解 spring注解@CrossOrigin不起作用的原因总结 springBoot跨域注解@CrossOrigin用法Spring Fra

2024-10-18 23:23:14

目录 1. 找到自动生成的pom.xml文件 2.添加servlet依赖 3.别眨眼，你已经搞定了！ 4.就可以右键新建Servlet 总结 IDEA版本2021右键新建没有servlet?在pom.xml文件中需要导入ser

2024-10-14 19:56:52

目录问题解决步骤：找到File->Project Structure... 设置SDK 设置SDKs 问题刚刚在使用IDEA专业版创建好SpringBoot项目后，发现上方导航栏的运行按钮是灰色的，而且左侧导

2024-10-14 19:56:37

实现flex的分页查询需要去维护一个对应的获取数据库总数的方法，下面会对有无该方法进行一个比较实现文件主要以下几个类，注意UserMapper.xml的位置，默认是扫描resources下的map

2024-10-14 19:56:23

目录在编译项目的时候出现报错：解决办法： 1、无效的源发行版 2、IDEA 报错，java无效的目标发行版：22 无效的目标发行版总结在编译项目的时候出现报错：解决办法：1、无效

2024-10-14 19:56:09

目录 1、目的 2、实现 2-1、导入MyBatis-Flex和ShardingSphere-JDBC的相关依赖 2-2、配置初始化的数据库连接用来加载配置，当然用配置中心来保存初始化数据的配置 2-3、

2024-10-14 19:55:50

前端发送请求后，会请求DeptController的方法list()。package com.intelligent_learning_aid_system.controller;import com.intelligent_learning_aid_system.pojo.Dept;impo

2024-10-14 19:55:31

Java 函数式编程中 try-catch 块的替代方案在 Java 函数式编程中，传统意义上的 try-catch 块并不是必不可少的。函数式编程强调代码的不可变性和纯净性，这意味着我们不希望函

2024-09-17 21:25:34

Java 函数参数可以定义多个类型吗？在 Java 中，函数的参数可以定义多个类型，这称为方法重载。通过方法重载，可以创建具有相同名称但接受不同参数类型的多个函数版本。语法<return

2024-09-17 21:23:26

如何在 Java 中使用 lambda 表达式实现接口方法Java 8 引入了 lambda 表达式，它提供了简洁且方便的方法来实现接口方法。lambda 表达式是一种匿名函数，它可以用来替换实现接口

2024-09-17 21:22:43

在 java 中，函数的返回值类型指定函数返回的值的类型，位于函数签名中函数名之前。例如，getgreeting 函数返回一个字符串 string getgreeting() { return "hello!"; }。返回值类

2024-09-10 22:37:27

2021-02-06

2020-09-18

2020-12-12

2020-05-05

2020-11-20

2021-01-09

2020-09-25

2021-02-06

2021-03-07

2020-09-27

spring data jpa开启批量插入、批量更新的问题解析

mybatis resultType自带数据类型别名解读

Java使用@Retryable注解实现HTTP请求重试

SpringBoot中基于AOP和Semaphore实现API限流

SpringBoot中集成日志的四种方式

Java线程池获取池中所有线程列表的方法总结

SpringBoot创建动态定时任务的几种方式小结

Java报错Java.net.SocketTimeoutException的几种解决方法

SpringBoot项目启动报错：命令行太长解决的两种解决方法

SpringBoot项目中日志管理与调优指南

将本地JAR文件手动添加到Maven本地仓库的实现过程

Spring Boot 3.3 实现职责链模式轻松应对电商订单流程分析

使用SpringBoot生成war包的流程步骤

mybatisplus实现自动填充时间的项目实践

MybatisPlus 主键策略的几种实现方法

Spring Cloud Hystrix实现服务容错的方法

Spring Cloud Config与Bus整合实现微服务配置自动刷新功能

使用Spring Security集成手机验证码登录功能实现

Java中重写和重载的区别及说明

Spring MVC的项目准备和连接建立方法

springBoot跨域注解@CrossOrigin用法

IDEA的Web项目右键无法创建Servlet问题解决办法

创建好SpringBoot项目后但是找不到Maven的解决方法

MyBatis-Flex实现分页查询的示例代码

解决IDEA报错java无效的目标发行版:22

MyBatis-Flex+ShardingSphere-JDBC多数据源分库分表实现

springboot查询全部部门流程分析

Java函数式编程中是否有try-catch块的替代方案？

Java函数的参数是否可以定义多个类型？

如何在Java中使用lambda表达式实现接口方法？

Java函数的返回值类型如何定义？

热点内容

免费资源网

在线工具

扫一扫随时看

本站下载频道