MySQL为什么需要一个主键

主键

表中每一行都应该有可以唯一标识自己的一列

主键,其能够唯一区分表中的每个行

虽然并不总是需要主键,但大多数情况下都应保证每个表都有一个主键,便于以后数据的操作和管理

表中的任何列都可以作为主键,主要它满足以下条件:

1
2
任何两行都不能有相同的主键值
每个行都必须具有一个主键值(主键列不允许NULL值)

主键值的规范

1
2
3
不能更新主键列的值
不重用主键列的值
不在主键列中使用可能会更改的值(例如使用一个名字来作为主键标识某个供应商,供应商如果名字被修改,则必须更改这个主键)

无特殊需求下Innodb建议使用与业务无关的自增ID作为主键

InnoDB引擎使用聚集索引,数据记录本身被存于主索引(一颗 B+Tree)的叶子节点上,这就要求同一个叶子节点内(大小为一个内存页或磁盘页)的各条数据记录按主键顺序存放,因此每当有一条新的记录插入时,MySQL会根据其主键将其插入适当的节点和位置,如果页面达到装载因子(InnoDB默认为15/16),则开辟一个新的页(节点)

如果表使用自增主键,那么每次插入新的记录,记录就会顺序添加到当前索引节点的后续位置,当一页写满,就会自动开辟一个新的页

这样就会形成一个紧凑的索引结构,近似顺序填满,由于每次插入时也不需要移动已有的数据,因此效率很高,也不会增加很多开销在维护索引上。

如果使用非自增主键(如果身份证号或学号等),由于每次插入主键的值近似于随机,因此每次新记录都要被插到现有索引页的中间某个位置,此时MySQL不得不为了将新记录插到合适位置而移动数据,甚至目标页面可能已经被回写到磁盘上而从缓存中清掉,此时又要从磁盘上读回来,这增加了很多开销,同时频繁的移动,分页操作造成了大量的碎片,得到了不够紧凑的索引结构,后续不得不通过optimize table来重建表并优化填充页面。

在使用InnoDB存储引擎时,如果没有特别的需要,请永远使用一个与业务无关的自增字段作为主键

MySQL 在频繁的更新、删除操作,会产生碎片。而含碎片比较大的表,查询效率会降低。此时需对表进行优化,这样才会使查询变得更有效率。

InnDB与MyISAM区别?索引结构如何实现的

InnDB 是采用B+树来组织的数据,叶子节点DATA包含了索引和数据,索引和Data在磁盘上都是存放在同一个文件中

MyISAM也是采用B+树来组织数据,但是叶子节点只存储了地址,Data数据存放在单独文件中

SQL查询流程

首先判断where条件查询的字段是否为主键,如果是主键,先判断要查询的id在根叔节点那个位置,然后在找到对应的叶子节点,如果是表InnDB类型,那么直接当前Data节点找到数据返回,否则MyISAM类型的话,会先找到叶子节点中存放的地址,然后通过地址在Data文件中找到对应的数据

InnDB的主键索引 为聚集索引,因为索引和Data都是存放在一起的,所以称为聚集索引

MyISAM的主键索引为非聚集索引,是因为索引和data是分别单独存储的

坚持原创技术分享,您的支持将鼓励我继续创作!