在C中,默
认
的基
础
数据类型均
为
signed,
现
在我
们
以char
为
例,
说
明(signed) char与unsigned char之
间
的区别
首先在内存中,
char
与
unsigned char
没有什么不同,都是一个字
节
,唯一的区别是,
char
的最高位
为
符号位,因此
char
能表示
-128~127, unsigned char
没有符号位,因此能表示
0~255
,
这个
好理解,
8
个
bit
,最多
256
种情况,因此无
论
如何都能表示
256
个数字。
在
实际使用过程种有什么区别呢?
主要是符号位,但是在普通的赋值,读写文件和网络字节流都没什么区别,反正就是一个字节,不管最高位是什么,最终的读取结果都一样,只是你怎么理解最高位而已,在屏幕上面的显示可能不一样。
但是我们却发现在表示byte时,都用unsigned char,这是为什么呢?
首先我们通常意义上理解,byte没有什么符号位之说,更重要的是如果将byte的值赋给int,long等数据类型时,系统会做一些额外的工作。
如果是char,那么系统认为最高位是符号位,而int可能是16或者32位,那么会对最高位进行扩展(
注意
,赋给unsigned int也会扩展)
而如果是unsigned char,那么不会扩展。
这就是二者的最大区别。
同理可以推导到其它的类型,比如short, unsigned short。等等
具体可以通过下面的小例子看看其区别
include <stdio.h>
void f(unsigned char v)
char c = v;
unsigned char uc = v;
unsigned int a = c, b = uc;
int i = c, j = uc;
printf("----------------\n");
printf("%%c: %c, %c\n", c, uc);
printf("%%X: %X, %X\n", c, uc);
printf("%%u: %u, %u\n", a, b);
printf("%%d: %d, %d\n", i, j);
int main(int argc, char *argv[])
f(0x80);
f(0x7F);
return 0;
输出结果
:
----------------
%c: ?, ?
%X: FFFFFF80, 80
%u: 4294967168, 128
%d: -128, 128
----------------
%c: ,
%X: 7F, 7F
%u: 127, 127
%d: 127, 127
由此可
见
,最高位若
为
0
时
,二者没有区别,若
为
0
时
,
则
有区别了。