ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

5个坑让你少熬3夜:druid连接池实战避坑指南

5个坑让你少熬3夜:druid连接池实战避坑指南 5个坑让你少熬3夜:druid连接池实战避坑指南 刚接手新项目,Spring Boot 配置里加个数据库连接,结果一跑起来就报错。改了半天 application.yml,重启了十几次,日志里全是 CommunicationsException 和 GetConnectionTimeoutException。这种配置环境就卡半天的经历,每个后端开发都逃不掉。 别慌,今天这篇不是那种复制粘贴就能跑的“伪教程”。我们要从底层原理聊起,把 Druid 连接池这个 Java 生态里最复杂的组件之一,彻底扒开看。这是一份针对初学者和中级开发的 druid连接池 实战避坑指南,读完你会发现,以前那些玄学的报错,其实都有迹可循。 项目目标:不只是跑通代码 很多博客教你配置 Druid,只给你一个 YAML 配置就完事了。但这远远不够。在真实的企业级项目中,我们引入 Druid 的核心目的不仅仅是“连上数据库”,而是为了监控和故障自愈。 本次实战项目的具体目标如下:彻底搞懂参数:不再盲目抄网上的配置,理解 initialSize、minIdle、maxActive 之间的数学关系。 集成监控页面:部署 Druid 自带的 Web 监控界面,能实时看到 SQL 执行效率。 实现 SQL 防火墙:配置 wallFilter,防止恶意的 SQL 注入攻击。 解决连接泄漏:通过代码层面的日志追踪,定位那些“借了不还”的连接。如果你只想要一个能用的配置,可以跳过原理部分直接看代码,但强烈建议先花两分钟看懂参数含义,否则遇到生产事故时,你连改哪个参数都不知道。 目录结构:工程化思维落地 为了避免“大泥球”式的代码堆砌,我们采用标准的 Maven 工程结构。这里不展示所有文件,只列出与数据库连接相关的核心结构。这种结构有助于后续扩展,比如增加 Redis 连接池或 MQ 客户端时,模块职责清晰。 druid-demo/ ├── pom.xml ├── src/ │ ├── main/ │ │ ├── java/com/example/druid/ │ │ │ ├── DruidConfig.java // 核心:连接池 Bean 定义 │ │ │ ├── WebStatFilterConfig.java // 核心:监控过滤器注册 │ │ │ ├── controller/ │ │ │ │ └── TestController.java // 业务测试接口 │ │ │ └── DruidApplication.java │ │ └── resources/ │ │ ├── application.yml // 基础配置 │ │ └── logback-spring.xml // 日志配置 │ └── test/ └── README.md注意看 DruidConfig.java 和 WebStatFilterConfig.java 是分开的。这是为了避免将业务逻辑与基础设施配置耦合。很多新手喜欢把所有配置都写在 application.yml 里,导致配置项爆炸,且无法通过 Java 代码进行动态调整或校验。 核心代码实现:逐行拆解避坑 这部分是重点。我们不在 YAML 里写死所有参数,而是通过 Java Config 的方式注入。为什么?因为 Druid 的某些参数(如监控 Filter)需要以 Bean 的形式注册才能生效,YAML 配置往往不够灵活。 1. 定义 DataSource Bean 这是最核心的类。我们将 Druid 的官方文档中的推荐参数作为基准,但针对本地开发环境做了调整。 @Configuration public class DruidConfig {@Bean@ConfigurationProperties(spring.datasource.druid)public DataSource dataSource() {// 1. 实例化 DruidDataSourceDruidDataSource datasource = new DruidDataSource();// 2. 关键参数设置(若未在 yml 中指定,此处为默认值)// 初始连接数,启动时建立的空闲连接datasource.setInitialSize(5);// 最小空闲连接数,当连接数小于 minIdle 时,后台线程会尝试创建新连接datasource.setMinIdle(10);// 最大连接数,连接池的最大容量,超过此数请求会阻塞datasource.setMaxActive(20);// 获取连接的超时时间,单位毫秒,防止线程死锁datasource.setMaxWait(60000);// 配置检测连接是否有效的 SQL// MySQL 推荐 SELECT 1,PostgreSQL 推荐 SELECT 1datasource.setValidationQuery(SELECT 1);// 是否开启测试连接有效性的功能,建议开启datasource.setTestWhileIdle(true);// 空闲连接回收检测间隔时间,单位毫秒datasource.setTimeBetweenEvictionRunsMillis(60000);// 连接在池中最小生存时间,单位毫秒datasource.setMinEvictableIdleTimeMillis(300000);// 连接在池中最大生存时间,单位毫秒datasource.setMaxEvictableIdleTimeMillis(900000);// 开启监控统计功能datasource.setFilters(stat,wall);return datasource;} }避坑点解析:testWhileIdle 必须为 true:这是防止“假死”连接的关键。如果数据库重启或网络抖动,池子里的旧连接可能已经断开,但客户端不知道。开启此配置后,Druid 会在每次取连接前或空闲时执行 validationQuery,确保拿到的连接是活的。 maxWait 不要设太短:很多教程设成 5 秒,这在低并发下没问题,但在高并发峰值时,容易导致业务线程快速失败。建议设为 60 秒,给数据库喘口气的时间。 filters 配置:这里我们启用了 stat(统计)和 wall(防火墙)。wall 是 Druid 的特色,能拦截恶意 SQL,如 drop table 或 union select。2. 注册监控过滤器 Druid 的 Web 监控界面依赖 WebStatFilter 和 StatViewServlet。如果不注册这两个 Bean,你配置了监控页面也打不开,或者进去一片空白。 @Configuration public class WebStatFilterConfig {/*** 注册 Web 监控过滤器,用于记录请求和 SQL 执行时间*/@Beanpublic FilterRegistrationBeanWebStatFilter statFilter() {FilterRegistrationBeanWebStatFilter bean = new FilterRegistrationBean();WebStatFilter filter = new WebStatFilter();// 排除不需要监控的静态资源filter.setExclusions(*.js,*.css,*.png,*.jpg,*.ico,/druid/*);bean.setFilter(filter);bean.addUrlPatterns(/*);return bean;}/*** 注册 Druid 监控页面 Servlet*/@Beanpublic ServletRegistrationBeanStatViewServlet statViewServlet() {ServletRegistrationBeanStatViewServlet bean = new ServletRegistrationBean(new StatViewServlet(), /druid/*);// 设置白名单,生产环境建议配置 IP 白名单或密码MapString, String initParams = new HashMap();initParams.put(loginUsername, admin);initParams.put(loginPassword, 123456);initParams.put(resetEnable, false); // 生产环境禁用重置bean.setInitParams(initParams);return bean;} }避坑点解析:安全警告:loginUsername 和 loginPassword 绝对不能使用默认值。Druid 的 GitHub 开源仓库 issues 区里,关于 Druid 监控页面被爆破的讨论非常多。务必修改密码,并建议在生产环境中通过 Spring Security 或网关层做二次鉴权。 Exclusions 配置:不要监控静态资源,否则监控页面会非常卡顿,且日志量巨大。运行与测试:验证配置有效性 代码写完,如何验证?别只看控制台没报错就完事。我们需要主动制造“异常”来测试连接池的健壮性。 1. 启动应用 运行 DruidApplication,观察控制台日志。如果配置正确,你会看到类似以下的日志: {dataSource-1} inited如果看到 GetConnectionTimeoutException,说明 maxWait 设置过短,或者数据库连接数已满。 2. 访问监控页面 启动后,访问 http://localhost:8080/druid/,输入账号密码。数据源页:查看当前连接数。ActiveCount 应该接近 0,PoolingCount 应该等于 initialSize。 SQL 监控页:调用一次 TestController 中的接口,然后刷新 SQL 监控页。你应该能看到刚才执行的 SQL 语句,以及执行耗时。3. 模拟连接泄漏测试 这是最容易被忽略的测试。如果代码中有 Connection conn = dataSource.getConnection(); 但没有 conn.close();,连接池会被耗尽。 我们可以写一个简单的测试接口,故意不关闭连接: @GetMapping(/leak-test) public String leakTest() {// 故意获取连接但不关闭try (Connection conn = dataSource.getConnection()) {// 模拟业务处理Thread.sleep(1000);// 注意:这里没有 close,虽然 try-with-resources 会自动关闭,// 但为了测试,我们可以手动 new 一个 DruidPooledConnection 并不调用 close// 或者在真实业务中遗漏 close} catch (Exception e) {return Error;}return Leaked; }注:上述代码中 try-with-resources 会自动关闭,所以无法模拟泄漏。在实际测试中,请移除 try 块,直接获取连接并 sleep,然后不关闭。观察 Druid 监控页面的 ActiveCount 是否会持续增长且不回落。 如果 ActiveCount 持续增长,说明存在泄漏。Druid 提供了 removeAbandoned 配置,可以强制回收长时间未使用的连接,但这只是治标不治本,必须修复代码。 优化扩展:生产级实战技巧 本地跑通了,上生产环境前,还有几个关键点需要优化。 1. 日志级别调整 Druid 默认会打印大量的 SQL 日志。在生产环境中,建议将 Druid 的日志级别调整为 WARN 或 ERROR,避免日志磁盘被打满。在 logback-spring.xml 中配置: logger name=com.alibaba.druid level=WARN /2. 异步关闭 应用停机时,Druid 连接池的关闭可能耗时较长,导致 Spring 容器停机超时。可以配置 asyncClose: datasource.setAsyncClose(true);这会让连接池在后台线程中关闭,不阻塞主线程。 3. 动态配置 对于大型微服务,数据库配置可能需要在运行时动态变更(如切换主从库)。Druid 支持通过 MBean 动态修改配置,但更推荐结合 Nacos 或 Apollo 配置中心,监听配置变更事件,动态刷新 DataSource Bean。 小结:从工具到思维 druid连接池 不仅仅是一个配置项,它是 Java 应用与数据库之间的桥梁。理解它的参数,就是理解高并发下的资源调度逻辑。 我们回顾一下今天的核心内容:参数不是死的:minIdle、maxActive 需要根据业务 QPS 和数据库性能调整,不要盲目照抄。 监控是刚需:没有监控的数据库连接池是“黑盒”,出了问题是运气好才能查到。 安全是底线:Druid 监控页面必须加权限控制,否则就是给黑客开门。技术选型没有银弹,Druid 虽然强大,但也复杂。对于简单项目,HikariCP 可能更轻量;但对于需要深度监控和 SQL 拦截的企业级项目,Druid 依然是首选。 你公司项目里是怎么处理数据库连接池的?是用 Druid、HikariCP 还是其他?在监控和安全配置上有什么特别的技巧?欢迎在评论区分享你的实战经验,我们一起避坑。
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进