文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

数据库,主键为何不宜太长长长长长长长长?

2024-04-02 19:55

关注

回答星球水友提问:

沈老师,我听网上说,MySQL数据表,在数据量比较大的情况下,主键不宜过长,是不是这样呢?这又是为什么呢?
 
这个问题嘛,不能一概而论:
(1)如果是InnoDB存储引擎,主键不宜过长;
(2)如果是MyISAM存储引擎,影响不大;
 
先举个简单的栗子说明一下前序知识。
 
假设有数据表:

t(id PK, name KEY, sex, flag);

 
其中:
(1)id是主键;
(2)name建了普通索引;
 
假设表中有四条记录:

1, shenjian, m, A

3, zhangsan, m, A

5, lisi, m, A

9, wangwu, f, B

 
如果存储引擎是MyISAM,其索引与记录的结构是这样的:

数据库,主键为何不宜太长长长长长长长长?

(1)有单独的区域存储记录(record);
(2)主键索引与普通索引结构相同,都存储记录的指针(暂且理解为指针);
画外音:
(1)主键索引与记录不存储在一起,因此它是非聚集索引(Unclustered Index);
(2)MyISAM可以没有PK;
 
MyISAM使用索引进行检索时,会先从索引树定位到记录指针,再通过记录指针定位到具体的记录。
画外音:不管主键索引,还普通索引,过程相同。
 
InnoDB则不同,其索引与记录的结构是这样的:

数据库,主键为何不宜太长长长长长长长长?

(1)主键索引与记录存储在一起;
(2)普通索引存储主键(这下不是指针了);
画外音:
(1)主键索引与记录存储在一起,所以才叫聚集索引(Clustered Index);
(2)InnoDB一定会有聚集索引;
 
InnoDB通过主键索引查询时,能够直接定位到行记录。
 

数据库,主键为何不宜太长长长长长长长长?

但如果通过普通索引查询时,会先查询出主键,再从主键索引上二次遍历索引树。
 
回归正题,为什么InnoDB的主键不宜过长呢?
 
假设有一个用户中心场景,包含身份证号,身份证MD5,姓名,出生年月等业务属性,这些属性上均有查询需求。

最容易想到的设计方式是:

user(id_code PK,
id_md5(index),
name(index),
birthday(index));

 

数据库,主键为何不宜太长长长长长长长长?

此时的索引树与行记录结构如上:
 
身份证号id_code是一个比较长的字符串,每个索引都存储这个值,在数据量大,内存珍贵的情况下,MySQL有限的缓冲区,存储的索引与数据会减少,磁盘IO的概率会增加。
画外音:同时,索引占用的磁盘空间也会增加。
 
此时,应该新增一个无业务含义的id自增列:

user(id PK auto inc,
id_code(index),
id_md5(index),
name(index),
birthday(index));

 

数据库,主键为何不宜太长长长长长长长长?

如此一来,有限的缓冲区,能够缓冲更多的索引与行数据,磁盘IO的频率会降低,整体性能会增加。
 
总结
(1)MyISAM的索引与数据分开存储,索引叶子存储指针,主键索引与普通索引无太大区别;
(2)InnoDB的聚集索引和数据行统一存储,聚集索引存储数据行本身,普通索引存储主键;
(3)InnoDB不建议使用太长字段作为PK(此时可以加入一个自增键PK),MyISAM则无所谓;

希望解答了这位水友的疑问。
阅读原文内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-数据库
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯