内容正文:
3.3 数据与系统2024-2025学年高中信息技术教科版(2019)必修1
一、选择题
1.人们通过气象卫星获得大量的气象信息,这属于数据处理过程中的( )
A.数据采集 B.数据整理 C.数据分析 D.数据可视化
2.文本数据处理是从大量的文本中提取有用信息,在此过程中文本的状态变化是( )
A.从结构化到非结构化 B.从非结构化到结构化
C.从非结构化到半结构化 D.从半结构化到结构化
3.在数据库设计中,第一范式(1NF)要求( )
A.每个字段都是原子性的 B.每个表只能有一个主键
C.表中的数据不能重复 D.表中的数据必须进行排序
4.《数据与计算》中提到了数据处理的一般过程,包括数据采集、存储、加工、分析和表达。以下哪个选项不是数据处理的一般过程的一部分?( )
A.数据采集 B.数据存储 C.数据销毁 D.数据表达
5.数据处理的一般过程,顺序正确的是( )
①分析数据②定位数据需求③撰写分析报告④收集数据
A.②③④① B.②④①③ C.①④②③ D.③②④①
6.下列哪种存储介质具有较好的数据读写速度和耐用性?( )
A.硬盘 B.光盘 C.U盘 D.SD卡
7.SQL是用于数据库操作的一种语言,它代表( )
A.Simple Query Language B.Structured Query Language
C.Standard Query Language D.System Query Language
8.数据处理的一般过程包括以下哪几个步骤?( )
A.数据采集、存储、分析、表达 B.数据采集、加工、分析、可视化
C.数据收集、整理、计算、展示 D.数据获取、处理、分析、决策
9.阅读下列程序代码,下列选择中错误的是( )
def query():
c=open("旅行线路.txt",'r')
var=c.readlines()
c.close
text.delete('0.0','end')
for i in var:
text.insert(INSERT,i)
Button(root, text="查询线路", command =query,relief="solid",width=10).pack()
text=Text(root,width=82, height=8)
text.pack()
A.c=open("旅行线路.txt",'r')是以只读模式打开文件“旅行线路.txt”
B.c.readlines()读取当前行字符串
C.command =query是指按钮响应执行函数query()
D.text.insert(INSERT,i)INSERT表示输入光标所在的位置
10.下列关于数据筛选的说法不正确的是( )
A.数据筛选是将不符合条件的数据删除,只保留满足条件的数据
B.筛选可以累加,进行多列筛选时,后一次筛选是在前一次的基础上完成的
C.筛选可以针对所包含的字符或字符串实现模糊查找
D.日期/时间数据的筛选支持年、月、日分级选择
11.学习小组在调查同学的爱好情况,通过问卷收集了一些数据,小明负责去除数据中的重复部分,小明所做的工作是数据处理的哪一步( )
A.数据收集 B.数据整理 C.数据分析 D.数据呈现
12.数据结构也称逻辑结构,以下不是数据结构的是( )
A.集合结构 B.线性结构 C.网状结构 D.顺序结构
13.下列关于数据整理的说法,不正确的是( )
A.目的是检测和修正错误的数据、整合数据资源、规整数据格式、提高数据质量
B.对于重复数据,可以在进一步审核的基础上进行合并或删除等处理
C.不同来源的数据可能存在格式不一致的情况,这就需要进行数据转换
D.对于异常数据,通常指数据集中不符合一般规律的数据对象,可以直接删除
14.英语听力磁带属于( )
A.内部存储器 B.外部存储器 C.只读存储器 D.随机存储器
15.以下哪个不是数据库系统提供的用户操作接口( )
A.SQL B.ODBC C.JDBC D.HTML
16.以下哪个不是数据库设计阶段( )
A.需求分析 B.概念设计 C.逻辑设计 D.物理设计 E.用户培训
二、填空题
17.创建安全密码的一般技巧:第一,使用长度不少于 个字符的密码。密码越 越不容易被破解。第二,在可能的情况下,尽量使用 、 和 相结合的密码。
第三,不要使用 、 或 等信息作为密码。第四,不要使用整个用户ID或用户ID的 作为密码。第五,不要使用 中能找到的 作为密码,即使是字母次序 过来的常用词语也不可以。
18.队列在Python中,用( )实现队列的创建,队列的基本操作:( )( )( )( )线性数据结构又称线性表。
19.文件是指存储在 中的 。
20.在《数据与计算》中,数据处理的一般过程包括数据采集、数据存储、数据加工、数据分析和数据表达等步骤。其中,数据加工是对采集到的原始数据进行清洗、转换和重组的过程,以确保数据的 和 ,为数据分析阶段提供高质量的数据输入
21.在现代程序设计中,我们用 建立计算机世界的实体与客观世界的实体相一致的映射关系,问题的解决方案可以用一些彼此交互的对象来 表示。
22.树的递归定义如下:树是由n(n( ) )个节点组成的( )集合。若n( ),则称为( )。任何一个非空树均满足以下二个条件:(1)仅有一个( )。(2)当n>0时,其余节点可分为m(m>=0)个互不相交的有限集合,其中每个集合又是一棵树,并称为( )。
三、判断题
23.Access数据库表间查询简单的相等关系,可以使用SQL视图;复杂的关系,使用设计视图。 ( )
24.在数据库中,数据是以二维表的形式组织存储的,称为表。表中的一列称为一条记录,表中的一行称为一个字段。 ( )
25.数据处理的目的是为了将数据转换为信息,帮助人们更好地理解数据。( )
26.树结构是一种具有层次关系的线性结构。( )
27.数据库主要用于存储数据,需要足够大的内存储器和外存储器等硬件平台的支持。软件部分除需要操作系统和数据库管理系统外,还包括支持特定应用环境开发的软件工具。 ( )
四、操作题
28.某项运动计分规则如下:由7名评委给每个选手打分(最高分10分,最低分0分)。为客观公正,计分时,先去掉一个最高分和一个最低分,将剩余的5个评委的分数求和作为“有效分”,最后结合难度系数计算实际得分,实际得分=(有效分×难度系数)÷5×3。
(1)小美收集了该运动某次比赛的评委打分并进行数据整理。数据整理目的是 (多选,填字母:A.检测和修正错漏的数据/B.分析数据特征/C.整合数据资源/D.统计计算总分/E.规整数据格式提高数据质量)。
图1
图2
(2)小美使用Python结合pandas导入数据(如图1所示),计算实际得分并排序,选出前三名制作图表,如图2所示。
import pandas as pd
import matplotlib.pyplot as plt
df=pd.read_excel('ts.xlsx')
shiji=[] #shiji 存储每位选手实际得分
for line in df.values:
maxs,mins,s=-1,11,0
for i in range(1,len(line)-1):
if line[i]>maxs:
maxs=line[i]
if line[i]<mins:
mins=line[i]
①
s=s-maxs-mins
s=s*line[i+1]/5*3
shiji.append(s)
df['实际得分']=shiji
#新增“实际得分”列
df=df.② ('实际得分',ascending=False)
#按“实际得分”降序排列
x=df['选手'][0:3]
y=③
plt.title('本次比赛前三名')
plt.xlabel('前三名选手')
plt.ylabel('实际得分')
plt.rcParam['font.sans-serif']=['SimHei']
#显示中文
plt.bar(x,y)
plt.show()
请在画线处填入合适的代码。
试卷第1页,共3页
试卷第1页,共3页
学科网(北京)股份有限公司
参考答案:
1.A
【详解】本题考查数据处理。人们通过气象卫星获得大量的气象信息,这是获取原始数据的过程,属于数据处理中的数据采集。数据整理是对采集到的数据进行分类、排序等操作;数据分析是对整理后的数据进行分析以提取有价值的信息;数据可视化是将分析结果以直观的图形、图表等形式展示。故答案为:A。
2.B
【详解】本题考查数据处理。文本数据处理需要先将文本从非结构化的原始状态转化为结构化、便于计算机处理的数据。故答案为:B。
3.A
【详解】本题考查数据库设计。第一范式(1NF)要求数据库表中的每个字段都是原子性的,即每个字段只能包含一个值,不能再分解。选项B、C和D都不是第一范式的要求。故选A。
4.C
【详解】本题考查数据处理。选项C,数据销毁在数据处理的一般过程中并不常见。数据处理主要关注数据的采集、存储、加工、分析和表达,而数据销毁通常是在数据不再需要或达到存储期限后进行的安全操作,不属于数据处理的主要过程。其它选项均为数据处理过程,故正确答案为选项C。
5.B
【详解】本题考查数据处理的过程。数据处理的一般过程是:定位数据需求→收集数据→分析数据→撰写分析报告。故选B。
6.A
【详解】本题考查存储介质相关内容。硬盘作为计算机的主要存储介质,具有较大的容量、较快的数据读写速度和较好的耐用性。光盘的主要特性包括大存储容量、低价格、不怕电磁干扰、存取速度快,以及具有多次读出和写入的能力。U盘的主要特性包括容量小、体积小、速度快和方便。SD卡的最大特点是容量大、抗震防潮、性能稳定,能永久保存数据且无噪音和寻道错误。故本题答案是A选项
7.B
【详解】本题考查数据库的描述。SQL代表Structured Query Language,即结构化查询语言。它是一种用于管理和操作关系数据库的标准语言。故选B。
8.B
【详解】本题考查数据处理。数据处理的一般过程包括数据采集、加工、分析和可视化。故正确答案为:选项B。
9.B
【详解】本题考查程序分析。选项B,readlines()方法用于读取所有行,并不是当前行。故说法错误。其他选项说法正确。故正确答案为选项B。
10.A
【详解】本题考查数据筛选。数据筛选的目的是从数据集中提取符合条件的数据,而不是直接删除不符合条件的数据。原始数据集通常不改变,只是根据筛选条件生成一个新的数据视图或子集。故答案为:A。
11.B
【详解】本题考查数据处理相关内容。数据处理一般包括四个过程,收集数据、整理数据、描述数据、分析数据。去除数据中的重复部分属于数据整理。故本题答案是B选项。
12.D
【详解】本题考查数据结构相关知识。数据结构也称逻辑结构,数据结构是计算机存储、组织数据的方式。数据结构是指相互之间存在一种或多种特定关系的数据元素的集合。通常情况下,精心选择的数据结构可以带来更高的运行或者存储效率。数据结构往往同高效的检索算法和索引技术有关。集合结构,线性结构,网状结构都属于数据结构。选项D不属于数据结构,它是算法的结构。故本题选D。
13.D
【详解】本题考查数据处理。
对于异常数据,通常指数据集中不符合一般规律的数据对象,可以直接删除:异常数据(也称为离群点)确实是指那些不符合一般规律或预期模式的数据对象。然而,直接删除这些异常数据并不总是一个好的选择。异常数据可能是由于测量错误、数据录入错误或数据本身的特性(如极端值)造成的。在删除之前,应该仔细审核这些异常数据,以确定其是否真的是错误或无效数据。在某些情况下,异常数据可能包含有用的信息或揭示出数据集中的重要模式。因此,直接删除异常数据可能会丢失重要信息或导致错误的结论。此选项描述不正确。其它选项均正确,故正确答案为:选项D。
14.B
【详解】本题考查存储器相关内容。内部存储器(Internal Storage)是指设备或系统内部存储数据和程序的空间,不依赖外部介质(如硬盘或闪存盘)。外部存储器是一种独立于计算机的内存以及CPU的缓存之外的存储器。只读存储器(Read-Only Memory,ROM)是一种计算机存储器,用于存储计算机程序和数据,其主要特点是允许用户读取存储在其中的信息,但无法直接修改或写入新数据。随机存储器(Random Access Memory,缩写为RAM),也称为随机存取存储器,是一种内部存储器,与CPU直接交换数据。英语听力磁带可以读写,属于外部存储器。故本题答案是B选项。
15.D
【详解】本题考查数据库的描述。SQL(结构化查询语言)、ODBC(开放数据库连接)和JDBC(Java数据库连接)都是数据库系统提供的用户操作接口,用于与数据库进行交互。而HTML(超文本标记语言)是用于创建网页的标记语言,不是数据库系统提供的用户操作接口。故选D。
16.E
【详解】本题考查数据库设计。数据库设计阶段通常包括需求分析、概念设计、逻辑设计和物理设计。用户培训不属于数据库设计阶段,而是数据库实施和维护阶段的一部分。故选E。
17. 8 长 字母 数字 特殊符号 电话号码 身份证号 生日 一部分 字典 词语 颠倒
【详解】本题考查安全密码相关知识。创建安全密码的一般技巧:第一,使用长度不少于8个字符的密码。密码越长不容易被破解。第二,在可能的情况下,尽量使用字母,数字和特殊符号相结合的密码。第三,不要使用电话号码、身份证号或生日等信息作为密码。第四,不要使用整个用户ID或用户ID的一部分作为密码。第五,不要使用字典中能找到的词语作为密码,即使是字母次序颠倒过来的常用词语也不可以。
18. 列表 入队 出队 求队长 判队空
【详解】本题考查数据结构相关知识。在Python中,用列表实现队列的创建,队列的基本操作:入队,出队,求队长,判队空线性数据结构又称线性表。
19. 外存储设备 相关数据的集合
【详解】本题考查文件相关知识。文件是指存储在外存储设备中的相关数据的集合。
20. 正确性 一致性
【详解】本题考查数据处理。在《数据与计算》或数据科学领域,数据处理的一般过程确实包括数据采集、数据存储、数据加工、数据分析和数据表达等关键步骤。数据加工是这一流程中的核心环节,因为它直接决定了后续数据分析的质量和效果。数据加工的主要任务就是对采集到的原始数据进行清洗、转换和重组,以确保数据的正确性和一致性。故正确答案为:①正确性、②一致性。
21. 对象 形象化
【详解】本题考查程序设计相关知识。在现代程序设计中,我们用对象建立计算机世界的实体与客观世界的实体相一致的映射关系,问题的解决方案可以用一些彼此交互的对象来形象化表示。
22. >=0 有限 =0 空树 根节点 根的子树
【详解】本题考查数据结构相关知识。树的递归定义如下:树是由n树的递归定义如下:树是由n(n>=0 )个节点组成的有限集合。若n=0,则称为空树。任何一个非空树均满足以下二个条件:(1)仅有一个根节点。(2)当n>0时,其余节点可分为m(m>=0)个互不相交的有限集合,其中每个集合又是一棵树,并称为根的子树。
23.错
【详解】本题考查数据库相关知识。Access数据库表间查询简单的相等关系,使用设计视图,复杂的关系,可以使用SQL视图。题干说法错误。
24.错
【详解】本题考查的是数据库相关知识。数据库中,数据是以二维表的形式组织存储的,称为表。表中的一列称为一条字段,表中的一行称为一个记录。题干中的说法是错误的。
25.正确
【详解】本题考查数据处理。数据处理的目的是将原始数据转换为有用的信息,帮助人们理解和利用数据。故正确答案为:正确。
26.错
【详解】本题考查数据结构。树是一种重要的非线性数据结构,直观地看,它是数据元素(在树中称为结点)按分支关系组织起来的结构,很象自然界中的树那样。题干说法错误。
27.对
【详解】本题考查数据库相关知识。数据库是存放数据的仓库。它的存储空间很大,可以存放百万条、千万条、上亿条数据。但是数据库并不是随意地将数据进行存放,是有一定的规则的,否则查询的效率会很低。数据库是一个按数据结构来存储和管理数据的计算机软件系统。数据库的概念实际包括两层意思:(1)数据库是一个实体,它是能够合理保管数据的“仓库”,用户在该“仓库”中存放要管理的事务数据,“数据”和“库”两个概念结合成为数据库。(2)数据库是数据管理的新方法和技术,它能更合适的组织数据、更方便的维护数据、更严密的控制数据和更有效的利用数据。故题干说法正确。
28. ACE s=s+line[i](或s+=line[i]) sort_values df['实际得分'][0:3](或df['实际得分'].head(3))
【详解】本题考查Python以及数据处理。
(1)数据整理的目的通常包括检测和修正错漏的数据(A选项),以确保数据的准确性;整合数据资源(C选项),将相关数据集中以便处理和分析;规整数据格式提高数据质量(E选项),使数据更易于处理和分析。故答案为:ACE。
(2)在计算有效分时,需要将除最高分和最低分之外的分数累加。之前已经找到了最高分maxs和最低分mins,现在要将其他分数累加到s中,所以使用s=s+line[i](或s+=line[i])。故答案为:s=s+line[i](或s+=line[i])。sort_values是pandas中用于对数据进行排序的方法,通过指定列名和排序方式(ascending=False表示降序),可以实现按照“实际得分”列降序排列数据。故答案为:sort_values。要获取前三名的实际得分用于绘制图表,需要从df中提取“实际得分”列的前三个值,所以使用df['实际得分'][0:3]或df['实际得分'].head(3)。故答案为:df['实际得分'][0:3](或df['实际得分'].head(3))。
答案第1页,共2页
答案第1页,共2页
学科网(北京)股份有限公司
$$