百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术资源 > 正文

想要提升SQL查询性能?这6个SQL陷阱一定要避开!

moboyou 2025-04-15 13:09 13 浏览

SQL是一种便捷的数据管理和查询方式,数据库开发者们无论使用SQL Server、Oracle、MySQL、PostgreSQL还是SQLite,都经常会面临相似的问题:在处理大量数据、查询复杂逻辑等业务场景时,编写性能不佳、浪费系统资源的查询语句,导致数据库运行缓慢。

下面介绍6个常见的SQL陷阱,看看你中招了吗?

  • 盲目复用查询;
  • 嵌套视图;
  • 在单个事务中运行大型多表操作;
  • 在GUID或其他“不稳定”列上进行聚类;
  • 使用触发器;
  • 使用否定搜索


1,盲目复用查询

通常我们会为特定的检索任务创建SQL查询语句,以获取所需的数据。

然而,盲目复用查询可能导致获取不必要的大量数据,对性能和资源造成负担。

在复用查询语句之前,请确保它恰当并修改以适应新的场景。

情景:

假设我们有一个查询,用于检索公司名为“maicong”的用户全部信息:

SELECT * FROM users WHERE company = 'maicong';

现在,我们在另一个场景下想获取公司名为“maicong”的用户id、姓名和邮件,而不是用户的全部信息。

反面情景:

直接复用上述查询,这样我们实际会获取比需要更多的数据,这会导致:

性能问题: 获取了不必要的数据可能会导致查询变慢,尤其是当用户表很大时。

资源浪费: 返回的数据中包含了很多不需要的字段,浪费了网络带宽和数据库系统资源。

正面情景:

应该仔细审查要复用的查询,只选择新场景下所需的字段:

SELECT user_id, user_name, email FROM users WHERE company = 'maicong';


2,嵌套视图

虽然视图为查看数据提供了标准方式,但在查询中使用其他试图可能导致查询不必要的数据,并难以优化生成的查询。避免嵌套视图,直接从需要的视图中选择列,以提高查询性能。

情景:

假设有两个视图:employee_info 和 department_info,需要查询员工信息:

正面情景(不使用嵌套视图)

SELECT employee_id, firstname, lastname, departmentname
FROM employee_info
JOIN department_info ON employee_info.department_id = department_info.department_id;

这个查询直接从基础视图中选择所需的列,而不使用嵌套视图。

反面情景(使用嵌套视图)

SELECT employee_id, firstname, lastname, departmentname
FROM (SELECT * FROM employee_info) AS e
JOIN (SELECT * FROM department_info) AS d ON e.department_id = d.department_id;

这个查询中嵌套了两个视图,尽管它看起来完成了相同的任务,但可能会导致检索大量不必要的数据,增加系统负担,也不利于优化




3,在单个事务中运行大型多表操作

当需要在某次查询中,从多个表中删除数据时,避免在单个事务中直接删除所有表上的目标数据。最好分别处理每个表的操作。

如果是跨表查询时要求原子性操作,可以将其拆分成许多较小的事务。

例如,如果有10,000行需要在20个表中删除,可以在一个事务中删除前20个表中的第一千行,然后在另一个事务中删除下一个一千行,依此类推。

正面情景

分别处理每个表的删除操作,例如,假设有表 Table1, Table2, ..., Table10

-- Transaction 1
BEGIN TRANSACTION;
DELETE FROM Table1 WHERE company = 'maicong';
-- ...
COMMIT;

-- Transaction 2
BEGIN TRANSACTION;
DELETE FROM Table2 WHERE company = 'maicong';
-- ...
COMMIT;

-- ...

-- Transaction 10
BEGIN TRANSACTION;
DELETE FROM Table10 WHERE company = 'maicong';
-- ...
COMMIT;

反面情景

不推荐的做法:将所有表的删除操作放在一个事务中——这可能导致性能问题和资源争夺。

BEGIN TRANSACTION;
DELETE FROM Table1 WHERE company = 'maicong';
-- ...
DELETE FROM Table2 WHERE company = 'maicong';
-- ...
-- ...
DELETE FROM Table10 WHERE company = 'maicong';
-- ...
COMMIT;




4,在GUID或其他“不稳定”列上进行聚类

GUID(全局唯一标识符)是用于给对象赋予一些独特标识符的16字节随机数。由于GUID的随机性,这会导致表的物理排列变得高度碎片化,使得表操作变得非常慢。所以,要避免在具有大量随机性的列上聚类,最好使用日期或ID列。

情景

假设有一个数据库表 users,其中有一个列是user_id,它是GUID类型,用于唯一标识每个用户。

不稳定列上的错误聚类

-- 错误示例:按照user_id(GUID)列进行聚类

CREATE CLUSTERED INDEX IX_user_id ON users(user_id);

理想的聚类列

-- 正确示例:按照稳定的日期列进行聚类

CREATE CLUSTERED INDEX IX_created_date ON users(created_date);




5,使用触发器

当我们使用触发器(triggers)时,它们会在某个数据库表上发生特定的事件时自动执行,例如插入、更新或删除记录。虽然触发器在某些情况下很方便,但必须在与触发它们的原始数据库操作相同的事务中发生。这意味着如果你在修改一个表的同时,触发器需要对另一个表进行修改,那么这两个表将被锁定,直到触发器完成执行。特别是在处理大量数据时,这将会导致性能问题。

示例:

使用触发器的情况

假设有两个表,orders 表和 order_history 表。每当在 orders 表中插入一条新记录时,我们希望触发器将相应的信息插入 order_history 表中。

-- 创建一个在插入 orders 表时触发的触发器
CREATE TRIGGER tr_orderInserted
ON orders
AFTER INSERT
AS
BEGIN
		-- 在 order_history 表中插入相应的信息
		INSERT INTO order_history (order_id, order_date, customer_id)
		SELECT order_id, order_date, customer_id
		FROM inserted;
END;

上述触发器会在 orders 表中插入新记录后,将相应的信息插入 order_history 表中。但请注意,这个操作会在同一个事务中执行,因此在触发器完成之前,orders 表和 order_history 表都会被锁定。

更好的解决方案

如果触发器可能会导致锁定超过可容忍的资源,而且你可以在多个事务中执行触发器的操作,那么存储过程可能是更好的选择。存储过程允许你在多个事务中执行类似触发器的操作,而不会导致两个表在同一个事务中被锁定。

-- 创建一个存储过程,在其中执行与触发器相似的操作
CREATE PROCEDURE pr_orderInserted
    @order_id INT,
    @order_date DATE,
    @customer_id INT
AS
BEGIN
    -- 在 order_history 表中插入相应的信息
		INSERT INTO order_history (order_id, order_date, customer_id)
		VALUES (@order_id, @order_date, @customer_id);
END;

这样的存储过程可以在需要的时候被调用,而不会像触发器那样自动在同一个事务中执行。




6,进行否定搜索

避免使用否定搜索,例如SELECT * FROM users WHERE users_status <> 2 这样的查询时,这个查询会返回所有 users 表中状态不等于2的用户,尽管 users_status 上可能有索引,但由于查询条件是不等于,数据库可能会选择执行表扫描,而不是有效使用索引,特别是当表中有大量数据时。

更好的解决方案

更好的解决方案是编写查询,使其能够有效地使用覆盖索引。例如,可以使用 IN 子查询来实现,如下所示:

-- 使用覆盖索引的查询,排除状态为2的用户
SELECT * FROM users 
WHERE user_id NOT IN (SELECT users_id FROM users WHERE users_status = 2);

这个查询有效地使用了 users_id和 users_status 列上的索引,而不需要执行整个表的扫描。通过使用 NOT IN 子查询,我们可以从索引中剔除我们不想要的内容,提高查询效率。这对于大型数据集尤其重要。

相关推荐

声学EI要完稿?十步速写法

【推荐会议】国际声学与振动会议(ICAV)会议号:CFP23112A截稿时间:2025年4月20日召开时间/地点:2025年8月15-17日·新加坡论文集上线:会后3个月提交EiComp...

结构力学!EI会议图表规范秘籍

推荐会议:国际结构与材料工程进展大会(ISME2026)会议编号:EI#73521截稿时间:2026年3月10日召开时间/地点:2026年8月15-17日·德国柏林论文集上线:会后4...

傅里叶级数物理意义的直观理解:利用傅里叶级数逼近方波信号

上篇文章将向大家介绍频谱的概念,对傅里叶级数、傅里叶积分、傅里叶变换进行了数学的推导,并解释了它们各自的物理意义。推导过程见我的上一篇文章:频谱分析——频谱概念(傅里叶变换、级数、积分及物理意义)如下...

通过对航空发动机整机振动进行分析,有何控制方法?

前言针对航空发动机整机振动问题的复杂性和多样性,以整机振动的振源分析为出发点,总结国内外关于转子系统故障、气流激振、轴承故障、齿轮故障和结构局部共振等引起的整机振动的研究情况。结合航空发动机整机结构动...

MATLIB中使用PCA

主成分分析PCA(PrincipalComponentsAnalysis),奇异值分解SVD(Singularvaluedecomposition)是两种常用的降维方法降维致力于解决三类问题:降维...

数据处理|软件:让科研更简单2

书接上回,继续介绍免费的数据处理软件。eGPS一款热图绘制专用软件,热图就是用颜色代表数字,让数据呈现更直观,对比更明显。优点:小巧方便,基本功能齐全,包括数据转换、聚类分析、颜色调整等等缺点:常见的...

电力系统常用的通讯协议及其在Speedgoat系统中的实现

在电力系统中,IEC61850协议、DNP3协议、ModbusTCP广泛应用于远程终端设备(RTU)、智能电子设备(IED)交互以及监控和数据采集(SCADA)系统。一、IEC61850协议IE...

电子工程师的常用仿真软件

不知道从事电子行业的工程师,有没有使用模拟仿真工具,仿真软件网上又有很多,初学者,可能只知道Multisim和Proteus。一般Multisim适合在学习模拟电路和电路分析原理课程时使用,便于理解电...

技术论文|异结构混沌系统的组合同步控制及电路实现

欢迎引用[1]李贤丽,马赛,樊争先,王壮,马文峥,于婷婷.异结构混沌系统的组合同步控制及电路实现[J].自动化与仪器仪表,2022,No.276(10):80-84.DOI:10.14016/j.cn...

现场︱某110KV主变事故过程仿真分析

三峡电力职业学院、河南省电力公司洛阳供电公司的研究人员李莉、任幼逢、徐金雄、王磊,在2016年第6期《电气技术》杂志上撰文,针对某110KV变电站主变差动保护跳闸事故,结合事故相关检测数据,通过MAT...

光伏发电系统篇:单级式并网系统实时仿真

在全球积极推动清洁能源转型的大背景下,光伏发电作为重要的可再生能源利用方式,得到了广泛关注和迅猛发展。目前常用的光伏并网及光伏电站主要拓扑结构有单级式和双级式。相较于传统的多级式系统,单级式光伏发电并...

光伏发电系统篇:三电平并网逆变器实时仿真

一、三电平并网逆变器在能源转型加速的当下,分布式能源接入电网需求大增。三电平并网逆变器凭借低谐波、高功率密度等优势,有效提升电能转换效率,于新能源并网发电中担当关键角色。常见的三电平电路拓扑结构包括二...

自制3.5KW大功率逆变器,很简单,看过这个电路原理就懂了

前言拿下8000元奖金的项目,是什么水平?本项目经过联合湖南科技大学光伏逆变以及电力电子研究生团队共同探讨方案。项目成本:1200元,获得奖金:8000元!参加赛事:立创开源硬件平台_星火计划·外包赛...

圈内分享:电容式加速度计接口电路非线性建模与仿真设计

摘要:非线性是Sigma-Delta(ΣΔ)加速度计系统的关键指标之一。基于一个五阶ΣΔ加速度计结构,分析了其主要的非线性模块,在MATLAB中建立了整体结构的行为级模型,并利用根轨迹法进行了稳...

基于Matlab/Simulink建立一种Thevenin/RC电池模块仿真模型

本文以锂电池数学模型为基础,在Matlab/Simulink的仿真系统中,建立了一种Thevenin/RC电池模块仿真模型,通过实际工况试验,测试精度在允许误差范围内,为电池SOC/SOH研究提供了极...