编程技术是改变世界的力量。
本站
当前位置:网站首页 > 后端语言 > 正文

InnoDB行格式(2)存储行格式COMPACT结构分析

gowuye 2024-04-04 11:57 9 浏览 0 评论

InnoDB 存储引擎行格式 COMPACT

前言

InnoDB 存储引擎包含 4 种行格式,分别为 Compact、Redundant、Dynamic、Compressed,其中 Compact、Dynamic、Compressed 行格式基本相同,在 Mysql5.7 版本中默认的行格式就是 Dynamic,那么这三种行格式到底如何存储呢?这就需要用到之前搭建环境的知识,具体信息可以参考InnoDB行格式环境搭建

简单概括就是新建了一个 test 数据库,同时新建了一个表 record_format_demo,建表语句如下

### 执行建表语句 创建测试表record_format_demo
mysql> CREATE TABLE record_format_demo (
    ->     c1 VARCHAR(10),
    ->     c2 VARCHAR(10) NOT NULL,
    ->     c3 CHAR(10),
    ->     c4 VARCHAR(10)
    -> )CHARSET=ascii ROW_FORMAT=COMPACT;

创建表后往数据库中插入两行数据,如下所示

+------+-----+------+------+
| c1   | c2  | c3   | c4   |
+------+-----+------+------+
| aaaa | bbb | cc   | d    |
| eeee | fff | NULL | NULL |
+------+-----+------+------+

分析测试表 record_format_demo 的 ibd 文件可以摘取部分内容得到如下 16 进制数据

0000c070  73 75 70 72 65 6d 75 6d  01 03 04 00 00 00 10 00  |supremum........|
0000c080  2d 00 00 00 00 02 02 00  00 00 00 8f 1f b7 00 00  |-...............|
0000c090  01 2b 01 10 61 61 61 61  62 62 62 63 63 20 20 20  |.+..aaaabbbcc   |
0000c0a0  20 20 20 20 20 64 03 04  06 00 00 18 ff c2 00 00  |     d..........|
0000c0b0  00 00 02 03 00 00 00 00  8f 1f b7 00 00 01 2b 01  |..............+.|
0000c0c0  1e 65 65 65 65 66 66 66  00 00 00 00 00 00 00 00  |.eeeefff........|

分析 COMPACT 行结构

COMPACT 行结构简单概括如下所示

上图表明 COMPACT 行格式代表了一条记录将被分为两部分记录的额外信息和记录的真实信息,其中额外信息又被分为三大块分别为:变长字段长度列表、NULL 值列表和记录头信息,这些都是什么东西呢?具体分析如下

记录的额外信息

变长字段长度列表

分析这部分结构首先要知道什么是变长字段,简单定义就是存储字段的长度并不固定,我们用的最多的代表就是 VARCHAR 类型,其次还有 TEXT、BLOB、VARBINARY 等,如果表数据中不包含变长字段那么这部分不需要有。

对于上面的测试表 record_format_demo 表第一列值而言那就是 c1、c2、c4,也就是说变长字段长度列表中存放的就是这三个列的实际长度,因为这个测试表采用的是 ascii 编码,也就是说一个字节编码一个字符,所以这三列占用空间分别为



所以变长列表显示如下

04 03 01

但真实结果真是这样吗,显然在上面的 16 进制中没有找到类似排序,因为这些变长列表长度需要按照列的逆序排列如下所示

01 04 03

这就对应 ibd 文件中截取部分

需要注意的是,变长字段长度列表统计的是非 NULL 的列值长度,也就是测试表的第二列变长字段长度列表只有两个 c1 和 c2,也就是 0x04 和 0x03,展示结果如下

03 04

对应 ibd 文件截取部分

NULL 值列表

在一个表中一般会设置一个列是否为 NULL,因为如果将 NULL 值直接存储到真实数据区将十分消耗内存,所以需要将这些为 NULL 的列统一管理。

首先我们需要知道,这个 NULL 值列表的统计范围,这个其实很好理解只要有可能为 NULL 的列才可能被统计到所以主键列和设置了 NOT NULL 的列将不会被统计,测试表 record_format_demo 就只有 c1、c3、c4 才能被统计。

那么我们将如何统计呢?就是将允许为 NULL 的列对应一个二进制位

  • 当该列值为 NULL,那么二进制位为 1。
  • 当该列值不为 NULL,那么二进制位为 0。

需要注意的是二进制位的排放顺序是列的逆序排列。

综上第一列值的 NULL 值列表如下

第二列值的 NULL 值列表如下

这两个值对应的 ibd 文件位置如下

记录头信息

这部分由固定的 5 个字节组成,包含一些是否删除的标识、记录堆的位置信息、下一条记录的相对位置等等。

记录头信息在 ibd 文件位置如下所示

记录的真实数据

这一部分并不全是记录的真实数据,还有一些隐藏列如下



注意:DB_ROW_ID 之所以不是必须是因为如果用户自己定义主键,那么优先使用用户定义的主键 id,如果用户没有定义主键会选取 Unique 列为主键,如果没有定义 Unique 列,这才会使用 DB_ROW_ID 作为行 ID,标识唯一记录。

测试表的第一行测试数据,隐藏列 ibd 文件展示如下

对于后面非隐藏列展示对照如下

aaaa ------> 61 61 61 61

bbb ----- > 62 62 62

cc --------> 63 63 20 20 20 20 20 20 20 20(定长字段需要填充 0x20)

d ---------> 64

相关推荐

嵌入式C语言中常量的应用实例(嵌入式c语言中常量的应用实例是什么)

常量,我们都知道,就是数值保持不变的量。在C语言中,常量一旦初始化了,它的值将在整个程序运行周期内,不允许发生任何变化。常量与变量是相对的,我们实际项目中经常会用到它。定义常量的两种方式C语言中主要有...

C语言编程基础知识汇总学习,适合初学者!更新常量知识

(二)整型常量整型常量有3种形式:十进制整型常量、八进制整型常量和十六进制整型常量。(注意:c语言中没有直接表示二进制的整型常量,在c语言源程序中不会出现二进制。)书写方式如下:十进制整型常量:123...

【C语言】第二章第六节:字符串常量

第二章第六节:字符串常量。下表C语言中的常用转义字符。·字符形式功能:ASCIl码(十进制形式)。→\t水平制表(横向跳格:跳到下一个tab位置)。→\b退格8。→\r回车(不换行,光标移到本行行首)...

「GCTT 出品」Go 系列教程——5. 常量

这是我们Golang系列教程的第五篇。定义在Go语言中,术语”常量”用于表示固定的值。比如5、-89、IloveGo、67.89等等。看看下面的代码:varaint=50v...

每日C语言-常量指针、指针常量、指向常量的指针常量

一、常量指针1)什么是常量指针?通过该指针不可以修改其所指向存储单元中的值指针本身即地址可以被修改2)定义:类型说明符const*指针变量;类型说明符表示指针所指向存储单元中的值得数据类型指针...

C语言-符号常量、常变量、变量之我见

更新内容:新增音频。音频和文章一起更配oHello,大家好,又和大家见面了~~相信很多朋友们听了C语言的“符号常量”、“常变量”、“变量”后还是对这三者一脸懵逼吧。不管老师怎么歇斯底里地讲解,同学们迷...

零基础带你学习C语言:四:探索常量与变量

前言常量与变量学习;一:分析:short、float、long类型#include<stdio.h>intmain(){shortage=18;floatweight=12...

C语言中是如何定义常量的?那定义字符串呢?

常量有整型常量、浮点型常量、字符型常量及字符串常量。‘常量定义是指定义符号常量,用一个标识符来代表一个常量,通过宏定义预处理指令来实现。常量的定义:#definecount60这就定义了一个常量...

C语言符号常量的优点,会是那几点?

符号常量是一个常量,是不变量,所以,在编译的时候,就把符号常量出现的地方,替换为符号常量对应的常量。符号常量一般用户定义一个全局使用的数据,而且要改变该数据的时候,只需要改变符号常量的值,代码中引用符...

嵌入式开发- C语言数据类型-常量(c语言嵌入式是干嘛的)

基本数据类型的常量-掌握**整型常量:**常量是指在程序运行期间其数值不发生变化的数据。整型常量通常简称为整数整数可以是十进制数、八进制数、十六进制数八进制06334十六进制0xd1...

c语言解剖课:只读变量、常量、字面量傻傻分不清?

写在前面本篇主题的缘起,是因为一个计算机专业的大学生在和我讨论c语言问题时,说const常量如何如何,我说变量被const修饰了,还是变量,不是“常量”。他给了我一个截图:他说大模型都是这样回答的,变...

C/C++编程笔记:C数组、字符串常量和指针!三分钟弄懂它

想弄懂C语言中数组和指针的关系吗?这篇文章就占据你三分钟时间,看完你肯定会有收获!数组数组声明为数据类型名称[constant-size],并将一个数据类型的一个或多个实例分组到一个可寻址的位...

C语言入门到精通【第008讲】——C语言常量

C语言常量常量是固定值,在程序执行期间不会改变。这些固定的值,又叫做字面量。常量可以是任何的基本数据类型,比如整数常量、浮点常量、字符常量,或字符串字面值,也有枚举常量。常量就像是常规的变量,只不过常...

这是C语言无法修改得东西,C语言基础教程之常量解析

常量是指程序在执行期间不会改变的固定值。这些固定值也称为文字。常量可以是任何基本数据类型,如整数常量,浮点常量,字符常量或字符串文字,还有枚举常量。常量被视为常规变量,除了它们的值在定义后无法修改。整...

C语言中的单精度、双精度、常量等都有什么意思?

刚接触C语言时,对于常量,变量,浮点,单精度,双精度等问题的理解,大都很模糊不清,其实在程序运行过程中,其值不能改变的量称为常量。如12、0、-3为整型常量,4.6、-1.23为实型常量,'a'、'...

取消回复欢迎 发表评论: