深刻理解计算机系统（2.6）------整数的运算

时间 2019-11-18

标签深刻理解计算机系统 2.6 整数运算繁體版

原文原文链接

　　前面两篇博客咱们详细讲解了计算机中整数的表示，包括有符号和无符号（补码编码）的详细介绍。那么这篇博客咱们将对它们的运算有个详细的了解。java

　　在讲解以前首先看下面的一个程序，看看输出结果是啥？优化

#include <stdio.h>

int main()
{
	int i = 2147483647;
    printf("%d\n",i+1);
    printf("%d\n",i+i);
	return 0;
}

　　结果是：编码

　　咱们预期的:spa

　　i+1 = 2147483647 + 1 = 2147483648blog

　　i+i = 2147483647 + 2147483647 = 4 294 967 294图片

　　为何程序中的结果和咱们数学中的常识会有这么大的区别？两个正数相加获得负数。这就须要咱们理解计算机中整数的运算原理。编译器

一、计算机整数运算的局限

　　咱们知道计算机是用二进制序列来表示数的。而二进制序列的长度是和计算机自己的字长有关。不一样的数据类型定义的二进制序列长度不同，即不一样的数据类型表示数的大小范围是不同的。可是不论是什么数据类型，它定义的二进制序列长度是有限的，即它表示的数的大小范围是有限的。博客

　　因此两个数作运算，若是结果超出了定义数据类型所表示数的大小范围，那么结果将会出现失真。并且这个失真的结果也不是随机的，而是有迹可循的，那么究竟是怎么产生失真的，请接着往下面看。数学

　　PS：下面给出 64 位机器上C语言的整型数据类型的取值范围。本篇博客中程序运行环境都是在64位系统中进行。io

二、无符号数加法运算

　　前面咱们讲过，对于一个 w 位的无符号二进制整数[x_w-1 , x_w-2 , … , x₂ , x₁ , x₀]，其值大小知足 0 <= x <= 2^w-1.

　　若是两个无符号数相加，那么其结果应该是 0 <= x+y <=2^w+1-2。很显然表示这个范围的数必需要 w+1 位二进制。

　　当咱们对无符号数作加法运算的时候，若是结果超过了 2^w-1，那么这个结果就会失真。

#include <stdio.h>

int main()
{
	unsigned short int i = 65535;
	unsigned short int j = i+1;
    printf("%u\n",j);
	return 0;
}

　　结果为：

　　对于上面的程序，咱们是在64位系统中进行运算。由上面给出的图片咱们能够知道 unsigned short int 在计算机中占用 2 个字节。表示的数据范围是 0——2¹⁶-1，即0——65535

　　咱们在程序中定义 i = 65535,那么 i+1=65536,这个结果是超出了 unsigned short 表示的数据范围。因此结果失真了，可是结果为何是 0 呢？

　　上一篇博客咱们讲过C语言中二进制数的截断：

　　将一个 w 位的数 [x_w-1 , x_w-2 , … , x₂ , x₁ , x₀] 截断为一个 k 位数字时，咱们会丢弃高 w-k 位。获得 [x_k-1 , x_k-2 , … , x₂ , x₁ , x₀]

　　对于上面的 i = 65535,二进制表示为：[1111 1111 1111 1111]，加1 结果为 65536，用二进制表示为 [1 0000 0000 0000 0000],为了将结果保持在 4个字节，即32位二进制序列，咱们去掉最高位的 1，那么结果就变成了 [0000 0000 0000 0000]，也就是打印出来的结果 0.

　　通常而言，无符号加法等价于计算和模上2^w

　　好比上面的二者计算和为 65536,模上 2^w，即模上2¹⁶=65536，结果为0

　　ps：模表示二者相处取余

　　如今定义 0<= x,y <2^w,那么它们运算知足下面关系：

　　注意：当 2^w<= x+y < 2^w+1，对 x + y 进行2^w的取模运算，与 x + y - 2^w是等价的。

　　因此若是两个无符号整数做加法运算。当 x+y < 2^w 时，它们的结果不变；当 2^w<= x+y < 2^w+1，它们的结果为 x+y-2^w

三、补码加法运算　

　　对于补码加法运算，由于补码编码是表示有符号的整数。

　　对于一个 w 位的补码二进制整数[x_w-1 , x_w-2 , … , x₂ , x₁ , x₀]，其值大小知足 -2^w-1 <= x <= 2^w-1-1。那么 -2^w <= x+y <=2^w-1

　　想要表示上面的两个数相加和的范围，那么可能须要 w+1 来表示。这里咱们也须要截取。

　　与无符号加法运算不一样，补码加法会出现三种状况：正溢出、正常、负溢出。定义以下：

　　　　范围在 -2^w-1 <= x，y <= 2^w-1-1 作加法运算时，知足：

　　简单来讲：补码加法运算就是先按照无符号加法进行运算，然后在进行无符号和有符号的转换。

这里咱们看个例子：

#include <stdio.h>

int main()
{
	short int i = -32768;
 	short int j = i-1;
    printf("%d\n",j);
	return 0;
}

　　结果为：

　　为何 -32768-1 结果会是 32767？

　　根据上面的公式：

　　咱们须要先将 -32768 和 -1 分别转换成无符号数进行加法运算，而后对获得的结果转换成有符号数。

　　①、-32768 转换成无符号数也就是 -32768+2^16=32768 　

　　②、-1 转换成无符号数也就是-1+2^16=65535　

　　③、将上面两步的结果相加，而后转换成有符号数：

　　　　即（65535+32768）-2^16=65535+32768-65536=32767

　这个过程用到的公式分别有：

四、无符号数乘法运算

　　对于一个 w 位的无符号二进制整数[x_w-1 , x_w-2 , … , x₂ , x₁ , x₀]，其值大小知足 0 <= x <= 2^w-1.

　　若是两个无符号数相乘，那么其结果应该是 0 <= x*y <=（2^w-1）2=2^2w-2^w+1+1。很显然表示这个范围的数可能须要 2w 位来表示。也就是 2w 位的整数乘积的低 w 位表示的值。根据咱们前面讲的截断原理：能够看作是计算乘积模2^w,即：

#include <stdio.h>

int main()
{
	unsigned short int i = 2;
 	unsigned short int j = i*2;
    printf("%u\n",j);
	return 0;
}

　　好比上面的程序结果是：（2*2）mod 2¹⁶=4 mod 65536=4

五、补码乘法

　　对于一个 w 位的补码二进制整数[x_w-1 , x_w-2 , … , x₂ , x₁ , x₀]，其值大小知足 -2^w-1 <= x <= 2^w-1-1。

　　那么它们的乘积x*y的取值范围在 -2^w-1*（2^w-1-1）=2^2w-2+2^w-1到 -2^w-1*2^w-1=-2^{2w-2 之间。}

　　同理 2w 位的整数乘积的低 w 位表示的值。根据咱们前面讲的截断原理：补码乘法运算公式为

　　假设对于w位的两个补码数来讲，它们的乘积的低w位与无符号数乘积的低w位是同样的。这意味着计算机可使用一个指令执行无符号和补码的乘法运算。下面咱们来证实：

　　其中x’和y’分别表明x和y的补码编码。

　　那么：（应用有符号转为无符号公式可得）

　　即：　　　　　　　　　　（2^w mod 2^w = 0）

　　因为模运算符，全部带权重 2w 的项都丢弃了，所以咱们看到 x*y 和 x’*y’ 的低 w 位是相同的。

六、乘法优化

　　因为在大多数机器上，整数乘法指令至关慢，须要 10 个或多个时钟周期，而其余整数运算（好比加法、减法、位级运算和移位）只须要 1 个时钟周期。

　　所以编译器使用了一项重要的优化，使用移位和加法的组合来代替乘法。

　　结论：对于一个w位的二进制数来讲，它与2^k的乘积，等同于这个二进制数左移k位，在低位补k个0。

　　证实过程以下：

　　咱们前面说过，整数乘法代价要比移位和加法代价大得多。那么C编译器会以移位、加法、减法的组合来消除不少整数乘以常数的状况。

　　好比：

　　　　计算 x*14 的乘积。因为 14 = 2³+2²+2¹ ，那么编译器会将乘法重写为（x<<3）+（x<<2）+（x<<1）。这样就将乘法替换为三个移位和两个加法。不管 x 是无符号仍是补码，甚至当乘法会致使溢出时，两个计算都会获得同样的结果。

　　　　更好的编译器，可能会将 14 = 2⁴-2¹。那么就会变成（x<<4）-（x<<1），只须要两个移位和一个减法。

七、除法运算

　　实际上在大多数机器上，整数除法要比整数乘法更慢，须要 30 或更多个时钟周期。

　　结论：对于除以 2 的幂能够用移位来运算。无符号除法使用逻辑移位，补码除法使用算术移位。

　　①、逻辑右移在左端补k 个0。C语言中对于无符号数据必须逻辑右移。

　　对于位向量[x_w-1,x_w-2,...,x₀]逻辑右移 k 位会获得位向量：[0,...,0,x_w-1,x_w-2,...,x_k]。转换成除法即 x/2^k，从结果咱们能够看出逻辑移位出现小数，老是舍入到零，好比 7/2应该是 3，而不是4

　　②、算术右移是在左端补 k 个最高有效位的值。对于一个正整数，因为最高有效位是 0 ，因此效果和逻辑右移是同样的；对于非负数，算术右移 k 位与除以 2^k 是同样的。

　　　　对于结果不须要舍入的状况结果是正确的。可是对于结果须要舍入的时候，算术右移致使的结果是向下舍入，好比 -7/2应该是 -3，而不是 -4。这是错误的。

八、总结

　　那么本篇博客结束咱们对于整数的表示以及运算都已经了解了。注意整数的运算我没有将减法，其实减法也就是转换为补码相加。并且计算机中也只有加法器，是没有减法器的。咱们只须要将减法转换为加法运算便可。

　　整数的表示和运算结束了，下一篇博客咱们将会讲解浮点数，也就是有小数的数。