五种提高SQL性能的方法有时,为了让应用程序运行得更快,所做的全部工作就是在这里或那里做一些很小调整。啊,但关键在于确定如何进行调整!迟早您会遇到这种情况:应用程序中的SQL查询不能按照您想要的方式进行响应。它要么不返回数据,要么耗费的时间长得出奇。如果它降低了报告或您的企业应用程序的速度,用户必须等待的时间过长,他们就会很不满意。就像您的父母不想听您解释为什么在深更半夜才回来一样,用户也不会听你解释为什么查询耗费这么长时间。(“对不起,妈妈,我使用了太多的LEFTJOIN。”)用户希望应用程序响应迅速,他们的报告能够在瞬间之内返回分析数据。就我自己而言,如果在Web上冲浪时某个页面要耗费十多秒才能加载(好吧,五秒更实际一些),我也会很不耐烦。为了解决这些问题,重要的是找到问题的根源。那么,从哪里开始呢?根本原因通常在于数据库设计和访问它的查询。在本月的专栏中,我将讲述四项技术,这些技术可用于提高基于SQLServer?的应用程序的性能或改善其可伸缩性。我将仔细说明LEFTJOIN、CROSSJOIN的使用以及IDENTITY值的检索。请记住,根本没有神奇的解决方案。调整您的数据库及其查询需要占用时间、进行分析,还需要大量的测试。这些技术都已被证明行之有效,但对您的应用程序而言,可能其中一些技术比另一些技术更适用。从INSERT返回IDENTITY我决定从遇到许多问题的内容入手:如何在执行SQLINSERT后检索IDENTITY值。通常,问题不在于如何编写检索值的查询,而在于在哪里以及何时进行检索。在SQLServer中,下面的语句可用于检索由最新在活动数据库连接上运行的SQL语句所创建的IDENTITY值:SELECT@@IDENTITY这个SQL语句并不复杂,但需要记住的一点是:如果这个最新的SQL语句不是INSERT,或者您针对非INSERTSQL的其他连接运行了此SQL,则不会获得期望的值。您必须运行下列代码才能检索紧跟在INSERTSQL之后且位于同一连接上的IDENTITY,如下所示:INSERTINTOProducts(ProductName)VALUES('Chalk')SELECT@@IDENTITY在一个连接上针对Northwind数据库运行这些查询将返回一个名称为Chalk的新产品的IDENTITY值。所以,在使用ADO的VisualBasic?应用程序中,可以运行以下语句:SetoRs=oCn.Execute(SETNOCOUNTON;INSERTINTOProducts_(ProductName)VALUES('Chalk');SELECT@@IDENTITY)lProductID=oRs(0)此代码告诉SQLServer不要返回查询的行计数,然后执行INSERT语句,并返回刚刚为这个新行创建的IDENTITY值。SETNOCOUNTON语句表示返回的记录集有一行和一列,其中包含了这个新的IDENTITY值。如果没有此语句,则会首先返回一个空的记录集(因为INSERT语句不返回任何数据),然后会返回第二个记录集,第二个记录集中包含IDENTITY值。这可能有些令人困惑,尤其是因为您从来就没有希望过INSERT会返回记录集。之所以会发生此情况,是因为SQLServer看到了这个行计数(即一行受到影响)并将其解释为表示一个记录集。因此,真正的数据被推回到了第二个记录集。当然您可以使用ADO中的NextRecordset方法获取此第二个记录集,但如果总能够首先返回该记录集且只返回该记录集,则会更方便,也更有效率。此方法虽然有效,但需要在SQL语句中额外添加一些代码。获得相同结果的另一方法是在INSERT之前使用SETNOCOUNTON语句,并将SELECT@@IDENTITY语句放在表中的FORINSERT触发器中,如下面的代码片段所示。这样,任何进入该表的INSERT语句都将自动返回IDENTITY值。CREATETRIGGERtrProducts_InsertONProductsFORINSERTASSELECT@@IDENTITYGO触发器只在Products表上发生INSERT时启动,所以它总是会在成功INSERT之后返回一个IDENTITY。使用此技术,您可以始终以相同的方式在应用程序中检索IDENTITY值。内嵌视图与临时表某些时候,查询需要将数据与其他一些可能只能通过执行GROUPBY然后执行标准查询才能收集的数据进行联接。例如,如果要查询最新五个定单的有关信息,您首先需要知道是哪些定单。这可以使用返回定单ID的SQL查询来检索。此数据就会存储在临时表(这是一个常用技术)中,然后与Products表进行联接,以返回这些定单售出的产品数量:CREATETABLE#Temp1(OrderIDINTNOTNULL,_OrderDateDATETIMENOTNULL)INSERTINTO#Temp1(OrderID,OrderDate)SELECTTOP5o.OrderID,o.OrderDateFROMOrdersoORDERBYo.OrderDateDESCSELECTp.ProductName,SUM(od.Quantity)ASProductQuantityFROM#Temp1tINNERJOIN[OrderDetails]odONt.OrderID=od.OrderIDINNERJOINProductspONod.ProductID=p.ProductIDGROUPBYp.ProductNameORDERBYp.ProductNameDROPTABLE#Temp1这些SQL语句会创建一个临时表,将数据插入该表中,将其他数据与该表进行联接,然后除去该临时表。这会导致此查询进行大量I/O操作,因此,可以重新编写查询,使用内嵌视图取代临时表。内嵌视图只是一个可以联接到FROM子句中的查询。所以,您不用在tempdb中的临时表上耗费大量I/O和磁盘访问,而可以使用内嵌视图得到同样的结果:SELECTp.ProductName,SUM(od.Quantity)ASProductQuantityFROM(SELECTTOP5o.OrderID,o.OrderDateFROMOrdersoORDERBYo.OrderDateDESC)tINNERJOIN[OrderDetails]odONt.OrderID=od.OrderIDINNERJOINProductspONod.ProductID=p.ProductIDGROUPBYp.ProductNameORDERBYp.ProductName此查询不仅比前面的查询效率更高,而且长度更短。临时表会消耗大量资源。如果只需要将数据联接到其他查询,则可以试试使用内嵌视图,以节省资源。避免LEFTJOIN和NULL当然,有很多时候您需要执行LEFTJOIN和使用NULL值。但是,它们并不适用于所有情况。改变SQL查询的构建方式可能会产生将一个花几分钟运行的报告缩短到只花几秒钟这样的天壤之别的效果。有时,必须在查询中调整数据的形态,使之适应应用程序所要求的显示方式。虽然TABLE数据类型会减少大量占用资源的情况,但在查询中还有许多区域可以进行优化。SQL的一个有价值的常用功能是LEFTJOIN。它可以用于检索第一个表中的所有行、第二个表中所有匹配的行、以及第二个表中与第一个表不匹配的所有行。例如,如果希望返回每个客户及其定单,使用LEFTJOIN则可以显示有定单和没有定单的客户。此工具可能会被过度使用。LEFTJOIN消耗的资源非常之多,因为它们包含与NULL(不存在)数据匹配的数据。在某些情况下,这是不可避免的,但是代价可能非常高。LEFTJOIN比INNERJOIN消耗资源更多,所以如果您可以重新编写查询以使得该查询不使用任何LEFTJOIN,则会得到非常可观的回报(请参阅图1中的图)。图1查询加快使用LEFTJOIN的查询速度的一项技术涉及创建一个TABLE数据类型,插入第一个表(LEFTJOIN左侧的表)中的所有行,然后使用第二个表中的值更新TABLE数据类型。此技术是一个两步的过程,但与标准的LEFTJOIN相比,可以节省大量时间。一个很好的规则是尝试各种不同的技术并记录每种技术所需的时间,直到获得用于您的应用程序的执行性能最佳的查询。测试查询的速度时,有必要多次运行此查询,然后取一个平均值。因为查询(或存储过程)可能会存储在SQLServer内存中的过程缓存中,因此第一次尝试耗费的时间好像稍长一些,而所有后续尝试耗费的时间都较短。另外,运行您的查询时,可能正在针对相同的表运行其他查询。当其他查询锁定和解锁这些表时,可能会导致您的查询要排队等待。例如,如果您进行查询时某人正在更新此表中的数据,则在更新提交时您的查询可能需要耗费更长时间来执行。避免使用LEFTJOIN时速度降低的最简单方法是尽可能多地围绕它们设计数据库。例如,假设某一产品可能具有类别也可能没有类别。如果Products表存储了其类别的ID,而没有用于某个特定产品的类别,则您可以在字段中存储NULL值。然后您必须执行LEFTJOIN来获取所有产品及其类别。您可以创建一个值为“NoCategory”的类别,从而指定外键关系不允许NULL值。通过执行上述操作,现在您就可以使用INNERJOIN检索所有产品及其类别了。虽然这看起来好像是一个带有多余数据的变通方法,但可能是一个很有价值的技术,因为它可以消除SQL批处理语句中消耗资源较多的LEFTJOIN。在数据库中全部使用此概念可以为您节省大量的处理时间。请记住,对于您的用户而言,即使几秒钟的时间也非常重要,因为当您有许多用户正在访问同一个联机数据库应用程序时,这几秒钟实际上的意义会非常重大。灵活使用笛卡尔乘积对于此技巧,我将进行非常详细的介绍,并提倡在某些情况下使用笛卡尔乘积。出于某些原因,笛卡尔乘积(CROSSJOIN)遭到了很多谴责,开发人员通常会被警告根本就不要使用它们。在许多情况下,它们消耗的资源太多,从而无法高效使用。但是像SQL中的任何工具一样,如果正确使用,它们也会很有价值。例如,如果您想运行一个返回每月数据(即使某一特定月份客户没有定单也要返回)的查询,您就可以很方便地使用笛卡尔乘积。图2中的SQL就执行了上述操作。Figure2ReturningAllCustomersandTheirSalessetnocountonDECLARE@dtStartDateDATETIME,@dtEndDateDATETIME,@dtDateDATETIMESET@dtEndDate='5/5/1997'SET@dtEndDate=DATEADD(DD,-1,CAST(CAST((MONTH(@dtEndDate)+1)ASVARCHAR(2))+'/01/'+CAST(YEAR(@dtEndDate)ASVARCHAR(4))+'23:59:59'ASDATETIME))SET@dtStartDate=DATEADD(MM,-1*12,@dtEndDate)SELECTCAST(YEAR(o.OrderDate)ASVARCHAR(4))+'-'+CASEWHENMONTH(o.OrderDate)10THEN'0'+CAST(MONTH(o.OrderDate)ASVARCHAR(2))ELSECAST(MONTH(o.OrderDate)ASVARCHAR(2))ENDASsMonth,c.CustomerID,c.CompanyName,c.ContactName,SUM(od.Quantity*od.UnitPrice)ASmSalesFROMCustomerscINNERJOINOrdersoONc.CustomerID=o.CustomerIDINNERJOIN[OrderDetails]odONo.OrderID=od.OrderIDWHEREo.OrderDateBETWEEN@dtStartDateAND