专题三 编码和数据存取过程(讲义)-《计算机应用基础》高考备考讲练测(云南)
2025-06-03
|
6页
|
105人阅读
|
1人下载
精品
内容正文:
专题三 编码和数据存取过程
【考纲要求】
考试条目
(2)熟练掌握数据在计算机中的存取过程,了解计算机常用的编码。
【课时安排】
2课时
【知识梳理】
数据存取过程
数据或指令通过输入设备输入计算机,存储在存储器中。在计算机运行过程中,数据从存储器读入运算器进行运算,中间结果也要存入存储器中,最终将结果经输出设备输出程序。
常用的编码
ASCII 码(美国信息交换标准代码)
诞生背景:1963 年制定,用于解决早期计算机英文数据交互问题,是现代编码的基础。
技术细节:
位数:7 位二进制(可表示 128 个字符),扩展为 8 位(256 个字符,含特殊符号)。
编码范围:
字符类型
十进制范围
示例(十进制 / 二进制)
控制符
0-31
换行(10/
)、回车(13/\r)
数字 0-9
48-57
'5'=53→00110101
大写字母 A-Z
65-90
'A'=65→01000001
小写字母 a-z
97-122
'z'=122→01111010
可打印符号
32-126
空格(32)、感叹号(33)
特点:
数字 < 大写字母 < 小写字母(如 '9'=57<'A'=65<'a'=97)。
大小写字母编码差 32(如 'A'+32='a')。
示例:
下列字符中,ASCII 码值最大的是( )
A. '5' B. 'X' C. 'e' D. ' '
【答案】C
【解析】数字(48-57)< 大写字母(65-90)< 小写字母(97-122),空格(32)最小,故选 C。
考点 2:汉字编码(国标码→机内码的转换)
汉字编码:中文在计算机中的 “三重变身”,字需经过输入码→机内码→字形码三次转换,对应 “打字→存储→显示” 流程。
1. 输入码(外码):用户如何 “告诉” 计算机汉字
定义:通过键盘或手写等方式输入汉字的编码,需通过输入法软件转换为机内码。
输入法类型及特点表
类型
示例输入法
编码逻辑
特点
音码
拼音输入法
基于拼音(如 “中”→zhong)
易上手,重码率高
形码
五笔输入法
基于字形拆分(如 “中”→KHK)
重码率低,需记忆字根
音形码
搜狗输入法
拼音 + 笔画(如 “中”→zh+1)
兼顾效率与易记性
2. 机内码(内码):计算机如何 “存储” 汉字
定义:计算机内部存储和处理汉字的二进制编码,由国标码转换而来。
关键标准:GB2312-80(国标码)
收录 6763 个常用汉字:
一级字 3755 个(按拼音排序,如 “啊” 在首位)。
二级字 3008 个(按部首排序,如 “龘” 属二级)。
编码示例:“中” 的国标码为362DH(十六进制),对应二进制00110110 00101101(2 字节,最高位为 0)。
机内码转换公式:
机内码 = 国标码 + 8080H(十六进制)→ 确保每个字节最高位为 1,与 ASCII 码区分。
示例:
国标码362DH + 8080H = 机内码B6ADH→二进制10110110 10101101(最高位均为 1)。
3. 字形码(输出码):计算机如何 “显示” 汉字
定义:用点阵或矢量图形描述汉字形状,用于屏幕显示或打印。
点阵码计算:
公式:存储容量(字节)= 行数 × 列数 ÷ 8
示例:
16×16 点阵:16×16÷8 = 32 字节 / 字(用于简体中文 Windows 默认字体)。
24×24 点阵:24×24÷8 = 72 字节 / 字(用于高精度打印)。
矢量码:用数学公式(如贝塞尔曲线)描述字形(如 TrueType 字体),放大不失真,存储空间小。
例题:
已知 “学” 的国标码为 4953H,其机内码是( )
A. C9D3H B. 4953H C. 6173H D. 8080H
【答案】A
【解析】4953H + 8080H = C9D3H(十六进制加法:49+80=C9,53+80=D3)。
考点 3:Unicode 与 UTF-8
Unicode 与 UTF-8:统一全球语言的 “数字字典”
Unicode(统一码):
目标:解决 ASCII 无法表示非英文语言的问题,统一编码全球所有字符(包括中文、日语、阿拉伯文、 emoji 等)。
编码方式:
UCS-2:固定 16 位(2 字节),可表示 65536 个字符(覆盖常用汉字和符号)。
UCS-4:4 字节,支持百万级字符(包括生僻字、历史文字)。
示例:
' 中 ':U+4E2D(十六进制)→二进制 0100 1110 0010 1101(16 位)。
'😀':U+1F600(4 字节)→二进制 0001 1111 0110 0000 0000 0000(需 UTF-8 编码存储)。
UTF-8(Unicode 转换格式):
核心优势:可变长编码,节省存储空间,兼容 ASCII。
编码规则:
字符类型
字节数
二进制格式
英文字母 / 符号
1
0XXXXXXX
常用汉字
3
1110XXXX 10XXXXXX 10XXXXXX
生僻字 / emoji
4
11110XXX 10XXXXXX 10XXXXXX 10XXXXXX
应用场景:网页(HTML 默认编码)、数据库(MySQL 默认字符集 utf8mb4)、Python 编程语言。
案例:
下列关于 UTF-8 的说法,正确的是( )
A. 一个汉字固定占 2 字节 B. 英文与 ASCII 码完全兼容
C. 不能表示生僻汉字 D. 是 Unicode 的唯一编码方式
【答案】B
考点 4:编码应用场景
编码类型及其应用场景表
编码类型
典型应用场景
ASCII 码
英文系统、早期程序(如 DOS)
国标码 / 机内码
中文 Windows 系统、早期中文软件(如 WPS 2000)
UTF-8
网页(.html)、数据库(MySQL)、Python 默认编码
字形码
汉字显示(如 Word 字体)、打印
云南职教高考易错点与备考策略
易错点 1:ASCII 码大小比较
❌ 错误:认为 “数字> 字母”(如 '9'>'A')
✅ 正确:数字(48-57)< 大写字母(65-90)< 小写字母(97-122)
易错点 2:机内码计算
❌ 错误:忘记 “国标码转机内码需每个字节 + 128(十进制)”
✅ 正确:十六进制直接加 8080H,或十进制加 256(2 字节各加 128)
备考策略:
口诀记忆:
ASCII:“0 到 9,48 起;A 是 65,a 是 97,大小写差 32”
机内码:“国标码加 8080,最高位变 1 防冲突”
案例:
【单选题】
在云南省职教高考指定的 WPS Office 中,保存一个包含 10 个汉字的文档,使用 UTF-8 编码时,汉字部分至少占用( )
A. 10 字节 B. 20 字节 C. 30 字节 D. 40 字节
【答案】C
【判断题】
国标码中,一级汉字按部首排序,二级汉字按拼音排序。( )
【答案】×
【限时练习】
1. 已知 “学” 的机内码为 D1A7H,其国标码是( )
A. 5127H B. 3127H C. B187H D. 8080H
【答案】A
2. 在 UTF-8 编码中,“云南” 两个汉字占用的字节数是( )
A. 2 B. 4 C. 6 D. 8
【答案】C
3. 下列关于 GB2312 编码的描述,正确的是( )
A. 兼容 ASCII 码
B. 采用 4 字节编码
C. 收录所有汉字
D. 最高位为 0
【答案】A
4. ASCII 码中,小写字母 'k' 的编码值比大写字母 'K' 大( )
A. 28 B. 30 C. 32 D. 34
【答案】C
5. 在 24×24 点阵的字库中,存储 100 个汉字需要的存储空间是( )
A. 7200B B. 57600B C. 28800B D. 14400B
【答案】A
6. Unicode 编码的主要目的是( )
A. 提高存储效率
B. 统一全球字符编码
C. 兼容 ASCII 码
D. 简化汉字输入
【答案】B
7. 下列编码中,用于汉字输出显示的是( )
A. 输入码 B. 机内码 C. 字形码 D. 国标码
【答案】C
8. 机内码是汉字在计算机内部存储和处理的唯一编码。( )
【答案】√
9. ASCII 码的最高位固定为 1。( )
【答案】×
10. GBK 编码是 GB2312 的扩展,支持更多汉字。( )
【答案】√
【内容小结】
学科网(北京)股份有限公司
$$
由于学科网是一个信息分享及获取的平台,不确保部分用户上传资料的 来源及知识产权归属。如您发现相关资料侵犯您的合法权益,请联系学科网,我们核实后将及时进行处理。