MySQL一个错误查询有关问题追查-MySQL 튜토리얼-php.cn

집

데이터 베이스

MySQL 튜토리얼

MySQL一个错误查询有关问题追查

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jun 07, 2016 pm 04:25 PM

mysql 하나 질문 실수

MySQL一个异常查询问题追查问题线上碰到的问题：相同的语句，只是最后的limit行数不同。奇怪的是，limit 10 的性能比limit 100的语句还慢约10倍。隐藏用户表信息，语句及结果如下SELECT f1 , SUM(`f2`) `CNT` FROM T WHERE f1 IS NOT NULL AND f3 = '2014-0

MySQL一个异常查询问题追查

问题

<code>线上碰到的问题：相同的语句，只是最后的limit行数不同。奇怪的是，limit 10 的性能比limit 100的语句还慢约10倍。

隐藏用户表信息，语句及结果如下
SELECT  f1 , SUM(`f2`) `CNT` FROM T  WHERE f1 IS NOT NULL AND f3 = '2014-05-12'     GROUP BY f1 ORDER BY `CNT` DESC LIMIT 10;
执行时间3 min 3.65 sec

SELECT  f1 , SUM(`f2`) `CNT` FROM T  WHERE f1 IS NOT NULL AND f3 = '2014-05-12'     GROUP BY f1 ORDER BY `CNT` DESC LIMIT 100;
执行时间1.24Sec.

性能差距非常大！
</code>

로그인 후 복사

分析

<code>MySQL Tips：<span>追查语句执行时最常用的方法，是通过explain来看语句的执行计划。 </span></code><span>?</span>

로그인 후 복사

<code>更有冲击性的效果是通过缩小范围后，在这个数据下，limit 67和limit 68的执行计划相差很大。

两个执行计划:
LIMIT 67     

id: 1
select_type: SIMPLE
table: a
type: range
possible_keys: A,B,C
<span>key: B</span>
key_len: 387
ref: NULL
<span>rows: 2555192</span>
Extra: Using where; Using temporary; Using filesort
1 row in set (0.00 sec) 

LIMIT 68
id: 1
select_type: SIMPLE
table: a
type: ref
possible_keys: A,B,C
<span>key: A</span>
key_len: 3
ref: const
<span>rows: 67586</span>
Extra: Using where; Using temporary; Using filesort
1 row in set (0.00 sec)

可以看到，两个语句的执行计划不同：使用的索引不同。
</code>

로그인 후 복사

<code>
MySQL Tips：<span>explain的结果中，key表示最终使用的索引，rows表示使用这个索引需要扫描的行数，这是个估计值。</span>

表中 索引A定义为 (f3, f4, f1, f2, f5); 索引B定义为(f1, f2, f3);
</code>

로그인 후 복사

一个确认

<code>虽然rows是估计值，但是指导索引使用的依据。既然limit 68能达到rows 67586,         说明在第一个语句优化器可选结果中，也应该有此值，为什么不会选择索引A？
先确认一下我们上面的这个结论。</code>

로그인 후 복사

<code>MySQL Tips：<span>MySQL语法中能够用force index 来强行要求优化器使用某一个索引。</span>
</code>

로그인 후 복사

Explain SELECT f1 , SUM(f2)?CNT?FROM t force index(A) WHERE f1 IS NOT NULL AND f3 = ‘2014-05-12’ GROUP BY P ORDER BY?CNT?DESC LIMIT 67\G

id: 1?
select_type: SIMPLE?
table: a?
type: ref?
possible_keys:A?
key: A?
key_len: 3?
ref: const?
rows: 67586?
Extra: Using where; Using temporary; Using filesort?
1 row in set (0.00 sec)

<code>顺便说明，由于我们指定了force index，因此优化器不会考虑其他索引，possible_keys里只会显示A。
我们关注的是rows:67586。这说明在limit 67语句里，使用索引A也能够减少行扫描。</code>

로그인 후 복사

<code>MySQL Tips：<span>MySQL优化器会对possiable_key中的每个可能索引都计算查询代价，选择最小代价的查询计划。</span></code>

로그인 후 복사

<code><span>?</span>至此我们大概可以猜测，这个应该是MySQL实现上的bug：没有选择合适的索引，导致使用了明显错误的执行计划。</code>

로그인 후 복사

<code>MySQL Tips：<span>MySQL的优化器执行期间需要依赖于表的统计信息，而统计信息是估算值，因此有可能导致得到的执行计划非最优。</span></code>

로그인 후 복사

<code>但要说明的是，上述Tip是客观情况造成（可接受），但本例却是例外，因此优化器实际上可以拿到能够作出选择正确结果的数据(rows值)，但是最终选择错误。
</code>

로그인 후 복사

原因分析

<code>MySQL优化器是按照查询代价的估算值，来确定要使用的索引。计算这个估算值的过程，基本是按照“估计需要扫描的行数”来确定的。
</code>

로그인 후 복사

<code>MySQL Tips：<span>MySQL在目前集团主流使用的5.1和5.5版本中只能使用前缀索引。</span>
</code>

로그인 후 복사

因此，使用索引A只能用上字段f3，使用索引B只能用上字段f1。Rows即为使用了索引查到上下界，之后需要扫描的数据行数（估算值）。

<code>上述的语句需要用到group和order by，因此执行计划中都有Using temporary; Using filesort。
流程上按顺序先计算使用索引A的查询代价。

之后依次计算其他possitabe_key的查询代价。由于过程中需要排序，在得到一个暂定结果后，需要判断是否有代价更低的排序方式(test_if_cheaper_ordering)。
与之前的大同小异，也是依靠估计扫描行数来计算代价。

在这个逻辑的实现过程中，存在一个bug：在估计当前索引的区分度的时候，没有考虑到前缀索引。

即：假设表中有50w行数据，索引B(f1,f2,f3)，则计算索引区分度时，需要根据能够用上的前缀部分来确定。比如f1有1000个不同的值，则平均每个key值上的记录数为500.如(f1,f2)有10000个同的值，则平均每个组合key上的记录数为50，若(f1,f2,f3)有50w个不同的值，则平均每个组合key上的记录数为1。</code>

로그인 후 복사

<code>MySQL Tips：<span>每个key上的记录数越少，说明使用该索引查询时效率最高。对应于show index from tbl 输出结果中的Cardinality值越大。</span></code>

로그인 후 복사

在这个case下，索引A只能使用f1做前缀索引，但是在计算单key上的行平均值时用的是(f1,f2,f3)，这就导致估算用索引B估算的时候，得到的代价偏小。导致误选。

回到问题本身

<code>1、  为什么limit值大的时候反而选对了呢？
</code><span>这是因为在计算B的查询代价时，查询需要返回的行数limit_rows也参与乘积，若limit值较大，则计算出来的B的代价就会更大，反而会由于代价。值超过A，而导致优化器最终选择A。</span>

로그인 후 복사

<code>2、  这个表有50w行数就，为什么limit相差1为就差别这么大？
这与语句本身有关。这个语句中有group by，这就意味着每多limit一个值，实际上需要扫描更多的行N。 这里N为“表的总行数”/“表中不同的f2值”。
也就是说这个语句使得这个bug有放大作用。
</code>

로그인 후 복사

解决方法

<code>分析清楚后解决方法就比较简单了，修改代码逻辑，在执行test_if_cheaper_ordering过程中，改用字段f1的区分度来计算即可。</code>

로그인 후 복사

본 웹사이트의 성명

본 글의 내용은 네티즌들의 자발적인 기여로 작성되었으며, 저작권은 원저작자에게 있습니다. 본 사이트는 이에 상응하는 법적 책임을 지지 않습니다. 표절이나 침해가 의심되는 콘텐츠를 발견한 경우 admin@php.cn으로 문의하세요.

핫 AI 도구

뜨거운 도구

뜨거운 주제

Gmail 이메일의 로그인 입구는 어디에 있나요?

7322

자바 튜토리얼

1625

Cakephp 튜토리얼

1350

라라벨 튜토리얼

1262

PHP 튜토리얼

1209

Related knowledge

Windows 업데이트 프롬프트 오류 0x8024401c 오류에 대한 해결 방법 Jun 08, 2024 pm 12:18 PM

목차 해결 방법 1 해결 방법 21. Windows 업데이트의 임시 파일 삭제 2. 손상된 시스템 파일 복구 3. 레지스트리 항목 보기 및 수정 4. 네트워크 카드 IPv6 끄기 5. WindowsUpdateTroubleshooter 도구를 실행하여 복구 6. 방화벽 끄기 및 기타 관련 바이러스 백신 소프트웨어. 7. WidowsUpdate 서비스를 닫습니다. 해결 방법 3 해결 방법 4 Huawei 컴퓨터에서 Windows 업데이트 중 "0x8024401c" 오류가 발생함 증상 문제 원인 해결 방법 아직도 해결되지 않았습니까? 최근 시스템 취약점으로 인해 웹 서버를 업데이트해야 하는데, 서버에 로그인하면 업데이트 시 오류 코드 0x8024401c가 표시됩니다.

PHP의 빅데이터 구조 처리 능력 May 08, 2024 am 10:24 AM

빅 데이터 구조 처리 기술: 청킹(Chunking): 데이터 세트를 분할하고 청크로 처리하여 메모리 소비를 줄입니다. 생성기: 전체 데이터 세트를 로드하지 않고 데이터 항목을 하나씩 생성하므로 무제한 데이터 세트에 적합합니다. 스트리밍: 파일을 읽거나 결과를 한 줄씩 쿼리하므로 대용량 파일이나 원격 데이터에 적합합니다. 외부 저장소: 매우 큰 데이터 세트의 경우 데이터를 데이터베이스 또는 NoSQL에 저장합니다.

PHP에서 MySQL 쿼리 성능을 최적화하는 방법은 무엇입니까? Jun 03, 2024 pm 08:11 PM

선형 복잡성에서 로그 복잡성까지 조회 시간을 줄이는 인덱스를 구축하여 MySQL 쿼리 성능을 최적화할 수 있습니다. SQL 삽입을 방지하고 쿼리 성능을 향상하려면 PREPAREDStatements를 사용하세요. 쿼리 결과를 제한하고 서버에서 처리되는 데이터의 양을 줄입니다. 적절한 조인 유형 사용, 인덱스 생성, 하위 쿼리 사용 고려 등 조인 쿼리를 최적화합니다. 쿼리를 분석하여 병목 현상을 식별하고, 캐싱을 사용하여 데이터베이스 로드를 줄이고, 오버헤드를 최소화합니다.

PHP에서 MySQL 백업 및 복원을 사용하는 방법은 무엇입니까? Jun 03, 2024 pm 12:19 PM

PHP에서 MySQL 데이터베이스를 백업하고 복원하는 작업은 다음 단계에 따라 수행할 수 있습니다. 데이터베이스 백업: mysqldump 명령을 사용하여 데이터베이스를 SQL 파일로 덤프합니다. 데이터베이스 복원: mysql 명령을 사용하여 SQL 파일에서 데이터베이스를 복원합니다.

PHP를 사용하여 MySQL 테이블에 데이터를 삽입하는 방법은 무엇입니까? Jun 02, 2024 pm 02:26 PM

MySQL 테이블에 데이터를 삽입하는 방법은 무엇입니까? 데이터베이스에 연결: mysqli를 사용하여 데이터베이스에 대한 연결을 설정합니다. SQL 쿼리 준비: 삽입할 열과 값을 지정하는 INSERT 문을 작성합니다. 쿼리 실행: query() 메서드를 사용하여 삽입 쿼리를 실행하면 확인 메시지가 출력됩니다.

MySQL 8.4에서 mysql_native_password가 로드되지 않음 오류를 수정하는 방법 Dec 09, 2024 am 11:42 AM

MySQL 8.4(2024년 최신 LTS 릴리스)에 도입된 주요 변경 사항 중 하나는 "MySQL 기본 비밀번호" 플러그인이 더 이상 기본적으로 활성화되지 않는다는 것입니다. 또한 MySQL 9.0에서는 이 플러그인을 완전히 제거합니다. 이 변경 사항은 PHP 및 기타 앱에 영향을 미칩니다.

PHP에서 MySQL 저장 프로시저를 사용하는 방법은 무엇입니까? Jun 02, 2024 pm 02:13 PM

PHP에서 MySQL 저장 프로시저를 사용하려면: PDO 또는 MySQLi 확장을 사용하여 MySQL 데이터베이스에 연결합니다. 저장 프로시저를 호출하는 문을 준비합니다. 저장 프로시저를 실행합니다. 결과 집합을 처리합니다(저장 프로시저가 결과를 반환하는 경우). 데이터베이스 연결을 닫습니다.