
第一章测试
1、在一个循环体内又包含一个完整的循环结构,称为循环的嵌套。( )
A:对
B:错
喵查答案:对
2、continue语句:结束这一轮的循环,进入下一次循环。( )
A:对
B:错
喵查答案:对
3、浮点类型(float)是表示实数的数据类型。( )
A:对
B:错
喵查答案:对
4、字典中的每一对“键值对”被称为字典的条目。( )
A:对
B:错
喵查答案:对
5、字典是通过键值对方式存储数据与数据之间的对应关系的一种数据结构。( )
A:对
B:错
喵查答案:对
第二章测试
1、下列选项中用来表示数组维度的属性是( )。
A:dimension
B:shape
C:size
D:type
喵查答案:shape
2、已知a = np.arange(9).reshape(3,3),要访问数组a的数值5,正确的索引表达式为( )。
A:a[5]
B:a[2,2]
C:a[1,2]
D:a[1,3]
喵查答案:a[1,2]
3、导入Numpy模块的方式为( )。
A:from numpy
B:import numpy
C:import numpy as np
D:import np
喵查答案:import numpyimport numpy as np
4、创建数组,并且数组的5个元素均为1,实现该功能的命令为( )。
A:np. array([1]*5)
B:np. ones(5)
C:np. arange(5)
D:np. zeros(5)
喵查答案:np. array([1]*5)np. ones(5)
5、NumPy(Numerical Python) 是 Python 语言的一个扩展程序库,支持大量的维度数组与矩阵运算,此外也针对数组运算提供大量的数学函数库。( )
A:对
B:错
喵查答案:对
6、如果没有明确地指明数组中元素的类型,则默认为int64。( )
A:对
B:错
喵查答案:错
7、两个等长的数组才能相加。( )
A:对
B:错
喵查答案:对
8、表达式np.ones((2,6)).sum()的值为12。( )
A:对
B:错
喵查答案:对
9、使用np.zeros(5,6)生成的数组中元素个数为30。( )
A:对
B:错
喵查答案:对
10、使用np.arange(10)生成的数组中最后一个元素的值为9。( )
A:对
B:错
喵查答案:对
第三章测试
1、下列能创建序列类型对象的语句是( )。
A:s1=pd.Series([1,3,5,7,9])
B:s2=pd.Series((1,3,5,7,9))
C:s3=pd.Series(np.array([1,3,5,7,9]))
D:s4=pd.Series(dict())
喵查答案:s1=pd.Series([1,3,5,7,9])s2=pd.Series((1,3,5,7,9))s3=pd.Series(np.array([1,3,5,7,9]))s4=pd.Series(dict())
2、df是100行10列的数据框, “df.head(8)”语句的功能是( )。
A:查看df全部数据
B:查看df第8行数据
C:查看df前8行数据
D:查看df从第8开始到最后的所有数据
喵查答案:查看df前8行数据
3、df是100行10列的数据框,df.columns的功能是( )。
A:输出df全部列名称
B:输出df全部索引
C:输出df前5列的列名称
D:输出df前5行的索引
喵查答案:输出df全部列名称
4、df是一个10行3列的数据框,df.columns=[‘col1′,’col2′,’col3′]语句的功能是( )。
A:将df的部分列名修改为’col1′,’col2′,’col3′
B:将改df的全部列名修改为’col1′,’col2′,’col3′
C:将df的全部索引修改为’col1′,’col2′,’col3′
D:将df的部分索引修改为’col1′,’col2′,’col3’
喵查答案:将改df的全部列名修改为’col1′,’col2′,’col3′
5、df是一个的数据框变量,df.loc[‘f’, ‘age’] = 25语句的功能是( )。
A:将df的“f”行“age”列的值修改为25
B:将df的“age”行“f”列的值修改为25
C:将df的“age”行的值修改为25
D:将df 的“f”行的值修改为25
喵查答案:将df的“f”行“age”列的值修改为25
6、df是数据框对象,age是df的列名,df.loc[df[‘age’].isnull(),:]语句的功能是( )。
A:提取df中age列是空值的值
B:提取df中所有空值
C:提取df中所有空值的行
D:提取df中age列是空值的行
喵查答案:提取df中age列是空值的行
7、能将外部文件导入的语句是( )。
A:pd.read_excel(r“C:/Users /student.xlsx”)
B:pd.to_excel(r“C:/Users /student.xlsx”)
C:pd.read_table(r“C:/Users /student.txt”)
D:pd.read_csv (r“C:/Users /student.csv”)
喵查答案:pd.read_excel(r“C:/Users /student.xlsx”)pd.read_table(r“C:/Users /student.txt”)pd.read_csv (r“C:/Users /student.csv”)
8、下列语句的功能是( )。import pandas as pdimport numpy as npy = pd.Series(np.arange(0,19,2),index = [‘A’+str(i) for i in range(10)])
A:创建数据框类型数据对象赋值给变量y,
B:y的值是0,2,4,6,8,10,12,14,16,18
C:y的索引是“A0”,“A1”,“A2”,“A3”,“A4”“ A5”,“A6”,“A7”,“A8”,“A9”
D:创建序列类型数据对象赋值给变量y,
喵查答案:y的值是0,2,4,6,8,10,12,14,16,18y的索引是“A0”,“A1”,“A2”,“A3”,“A4”“ A5”,“A6”,“A7”,“A8”,“A9”创建序列类型数据对象赋值给变量y,
9、下列语句定义了df数据框对象,df[‘Age’].mean()语句的功能是( )。df=pd.DataFrame({‘ID’:[‘001′,’002′,’003′,’004′,’005′,’006′],’Name’:[‘su’,’gao’,’wang’,’li’,’zhang’,’song’],\’Age’:[33,31,35,36,37,38],’sex’:[‘m’,’f’,’m’,’m’,’f’,’m’]})
A:计算df的平均值”
B:计算age列的最大值”
C:计算age列的平均值
D:计算age列的和”
喵查答案:计算age列的平均值
10、下列语句的功能是( )。import pandas as pddata = pd.DataFrame()data[‘city’] = [‘Beijing’,’Shanghai’,’Shenzhen’]
A:在data数据框中新增一列,列名为“city”
B:在data数据框中新增一行 ,索引为“city”
C:在data序列中新增一列,列名为“city”
D:在data序列中新增一行,索引为“city”
喵查答案:在data数据框中新增一列,列名为“city”
pay point=”5″
第四章测试
1、下列函数中,可以绘制散点图的函数是( )。
A:hist
B:scatter
C:bar
D:pie
喵查答案:scatter
2、下列选项中,描述不正确的是( )。
A:箱形图可以提供有关数据分散情况的信息,可以很直观地查看数据的四分位分布
B:折线图是用直线段将数据连接起来而组成的图形,以折线的方式显式数据的变化
C:饼图显示一个数据序列中的各项的大小与各项总和的比例
D:条形图是由一系列高度不等的纵向条纹或线段表示数据分布情况
喵查答案:条形图是由一系列高度不等的纵向条纹或线段表示数据分布情况
3、下列图表中,可以清晰地反映出各数据系列的百分比情况的是( )。
A:直方图
B:折线图
C:饼图
D:散点图
喵查答案:饼图
4、在创建Figure对象时,可以指定哪个参数来调整画布大小?( )
A:num
B:dpi
C:figsize
D:facecolor
喵查答案:figsize
5、绘制图表时,可以使用subplot()函数创建多个子图。( )
A:对
B:错
喵查答案:对
6、Matplotlib默认支持中文显示。( )
A:对
B:错
喵查答案:错
7、Matplotlib生成的图表可以保存在本地。( )
A:对
B:错
喵查答案:对
8、散点图包含的数据点越少,比较的效果就会越好。( )
A:对
B:错
喵查答案:错
9、在使用Matplotlib绘制图表时,可以不需要导入pyplot模块。( )
A:对
B:错
喵查答案:错
10、在使用Matplotlib绘制条形图时可以使用pyplot模块中的bar函数。( )
A:对
B:错
喵查答案:对
第五章测试
1、线性回归方程中的截距a以及系数b与数学中的含义一致。( )
A:对
B:错
喵查答案:错
2、利用Excel实现一元线性回归中,三种方法得到的线性回归方程完全一致。( )
A:对
B:错
喵查答案:对
3、Python实现一元线性回归的解决方案,输出结果中R-squared值越小说明,模型对真实值的解释程度越高。( )
A:对
B:错
喵查答案:错
4、利用Excel实现一元线性回归中的三种方法都无法实现多元线性回归。( )
A:对
B:错
喵查答案:错
5、Python实现多元线性回归中如果不为X矩阵增加截距项,运行结果也能显示线性方程中的截距项。( )
A:对
B:错
喵查答案:错
6、多元线性回归过程中发现相关性不强或不显著的变量时,可以剔除后进行再次回归,以提高回归的R2。( )
A:对
B:错
喵查答案:对
7、回归是设法找出变量间在数量上的依存变化关系, 用函数表达式表达出来,这个表达式称之为回归方程。( )
A:对
B:错
喵查答案:对
8、残差分析:如果残差没有均匀分布在水平线两侧,而是呈现一定“规律性”,暗示存在某些“规律”没有被发现。( )
A:对
B:错
喵查答案:对
9、在回归分析中要求因变量Y是随机变量,服从正态分布,自变量X可以是随机变量也可以是给定的变量。( )
A:对
B:错
喵查答案:对
10、如果QQ图存在一定的弯曲,暗示残差可能不符合正态分布。( )
A:对
B:错
喵查答案:对
第六章测试
1、关于重采样的说法中,下列描述错误的是( )。
A:重采样是将时间序列从一个频率转到另一个频率
B:升采样的时间颗粒是变小的
C:时间序列数据在降采样时,总体的数据量是增加的
D:时间序列数据在降采样时,总体的数据量是减少的
喵查答案:时间序列数据在降采样时,总体的数据量是增加的
2、下列关于ARIMA(p,d,q)的说法中,描述正确的是( )。
A:ARIMA是一种用于时间序列预测的常见统计模型
B:参数p代表自回归项数
C:参数d代表差分阶数
D:参数q代表滑动平均项数
喵查答案:ARIMA是一种用于时间序列预测的常见统计模型参数p代表自回归项数参数d代表差分阶数参数q代表滑动平均项数
3、下列函数中,用于创建固定频率DatetimeIndex对象的是( )。
A:shift()
B:date_range()
C:period_range()
D:asfreq()
喵查答案:date_range()
4、下列选项中,用来表示Pandas中的时间戳的是( )。
A:Period
B:Timestamp
C:Interval
D:Series
喵查答案:Timestamp
5、关于时间序列的移动,下列说法错误的是( )。
A:移动是指沿着时间轴方向将数据进行前移或后移
B:时间序列移动后,索引也会发生变化
C:数据移动后会出现边界情况
D:无论时间序列的数据怎么移动,索引是不会发生任何变化的
喵查答案:时间序列移动后,索引也会发生变化
6、最基本的时间序列类型是以时间戳为索引的Series对象。( )
A:对
B:错
喵查答案:对
7、如果相同频率的两个Period对象进行数学运算,那么计算结果为它们的单位数量。( )
A:对
B:错
喵查答案:对
8、任何类型的Pandas对象都可以进行重采样。( )
A:对
B:错
喵查答案:错
9、DatetimeIndex是一种用来指代一系列时间戳的索引结构。( )
A:对
B:错
喵查答案:对
10、降采样时可能会导致一些时间戳索引没有对应的数据。( )
A:对
B:错
喵查答案:错
第七章测试
1、投资组合理论研究的是理性投资者的投资行为。( )
A:对
B:错
喵查答案:对
2、Excel实现投资组合理论的方法是借助“模拟分析”中的“模拟运算表”功能。( )
A:对
B:错
喵查答案:对
3、现代投资组合理论归结了理性投资者如何利用分散投资来优化他们的投资组合。( )
A:对
B:错
喵查答案:对
4、所谓均值,是指投资组合的期望收益率,它是单只证券的期望收益率的加权平均,权重为相应的投资比例。( )
A:对
B:错
喵查答案:对
5、所谓方差,是指投资组合的收益率的方差。我们把收益率的标准差称为波动率,刻画了投资组合的风险。( )
A:对
B:错
喵查答案:对
《金融数据分析》期末考试
1、已知a = np.arange(9).reshape(3,3),执行语句print(a[:1,1:]),输出结果为( )。
A:[[0 1]]
B:[[3 4]]
C:[[1 2]]
D:[[4 5]]
喵查答案:[[1 2]]
2、s1,s2为Series类型对象,执行语句s3=s1.append(s2),下列说法正确的是( )。
A:s3是DataFrame类型的对象
B:s1的数据发生变化
C:s2的数据发生变化
D:将 s2 拼接到 s1数据的后面,并将返回的序列赋值给s3
喵查答案:将 s2 拼接到 s1数据的后面,并将返回的序列赋值给s3
3、list(range(0, 10, 2)) 的输出结果是( )。
A:[0,2,4,6,8,10]
B:[0,2,4,6,8]
C:[2,4,6,8]
D:[2,4,6,8,10]
喵查答案:[0,2,4,6,8]
4、list(range(0, 15, 5))的输出结果是( )。
A:[0,1,2,3,4,5,6,7,8,9,10,11,12,13,14,15]
B:[0,1,2,3,4,5,6,7,8,9,10,11,12,13,14]
C:[0,5,10]
D:[0,5,10,15]
喵查答案:[0,5,10]
5、在创建Figure对象时,可以指定哪个参数来调整画布每英寸的像素个数?( )
A:num
B:dpi
C:figsize
D:facecolor
喵查答案:dpi
6、list(range(2, 8, -2)) 的输出结果是( )
A:报错
B:[2,4,6]
C:[2,4,6,8]
D:[ ]
喵查答案:[ ]
7、df1是DataFrame类型的对象,df1.index的功能是( )。
A:查看df1的索引
B:查看df1的数值
C:查看df1的列名
D:其它均错误
喵查答案:查看df1的索引
8、list(range(5, 1, -1)) 的输出结果是( )
A:[1,2,3,4,5]
B:[1,2,3,4]
C:[5, 4, 3, 2, 1]
D:[5, 4, 3, 2]
喵查答案:[5, 4, 3, 2]
9、下列函数中,用于创建固定频率PeriodIndex对象的是( )。
A:shift()
B:date_range()
C:period_range()
D:asfreq()
喵查答案:period_range()
10、下列函数中( )可以计算数组元素相乘。
A:add
B:divide
C:multiply
D:subtract
喵查答案:multiply
11、a=np.array([1,2,3,4,5])print((a*3).max())执行上述程序后的输出结果为( )
A:5
B:10
C:15
D:20
喵查答案:15
12、a1=np.array([1,2,3,4,5])a2=np.array(np.arange(5))print(np.add(a1,a2))执行上述程序后的输出结果为( )
A:[1, 3, 5, 7, 9]
B:[1,2,3,4,5]
C:[0,1,2,3,4]
D:空
喵查答案:[1, 3, 5, 7, 9]
13、下列函数中,用于移动数据的是( )。
A:shift()
B:date_range()
C:period_range()
D:asfreq()
喵查答案:shift()
14、已知a = np.array([4,16]),语句( )可以实现计算数组各元素的平方根。
A:print(np.abs(a))
B:print(np.sqrt(a))
C:print(np.square(a))
D:print(np.floor(a))
喵查答案:print(np.sqrt(a))
15、当使用resample()方法重新采样时,下列哪个参数可以确定采样的闭合区间?( )
A:label
B:fill_method
C:how
D:closed
喵查答案:closed
16、Pandas包中,统计数据框中重复数据的数目的方法是( )。
A:sum()
B:duplicated().sum()
C:count()
D:duplicated()
喵查答案:duplicated().sum()
17、以下函数可以在绘制图表时,设置x轴的名称的是( )。
A:xlim()
B:xlabel()
C:xticks()
D:ylabel()
喵查答案:ylabel()
18、下列语句能计算序列s1中位数的语句是( )。
A:s1.max()
B:s1.median()
C:s1.mode()
D:s1.mul()
喵查答案:s1.median()
19、Pandas将 CSV 文件写入的方法是( )。
A:read_table()
B:read_csv()
C:to_csv()
D:to_excel()
喵查答案:to_csv()
20、randrange([start],stop[,step]),其中的step省略时,默认值是多少( )
A:0
B:1
C:2
D:任意步长
喵查答案:1
21、设置标题函数title,如果想让标题出现右侧,应该将参数loc设置为( )。
A:left
B:center
C:right
D:upper
喵查答案:right
22、下列方法中,能够对常规时间序列数据重新采样的是( )。
A:shift()
B:rolling()
C:asfreq()
D:resample()
喵查答案:resample()
23、下列选项中,用来表示时间序列中的频率为每小时的是( )
A:S
B:B
C:D
D:H
喵查答案:H
24、a = np.mat(‘1,2;3,4;5,6’)e = np.matlib.eye(2)ae = np.bmat(‘a;e’)执行上述程序后,矩阵ae的形状为( )
A:(3, 2)
B:(3, 5)
C:(5, 2)
D:(5, 3)
喵查答案:(5, 2)
25、关于降采样的说法中,下列描述错误的是( )。
A:降采样是将高频率数据聚合到低频率数据
B:降采样的时间颗粒会变大
C:降采样的数据量是增加的
D:降采样就相当于另外一种形式的分组聚合操作
喵查答案:降采样的数据量是增加的
26、pandas读取外部文件的方法有( )
A:.read_table()
B:.to_csv()
C:read_excel()
D:.read_csv()
喵查答案:.read_table()read_excel().read_csv()
27、下列关于Series 运算说法正确的是( )。
A:Series的加法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。
B:Series的减法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。
C:Series的乘法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。
D:Series的除法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。
喵查答案:Series的加法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。Series的减法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。Series的乘法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。Series的除法运算是按照索引计算,如果索引不同则填充为 NaN(空值)。
28、下列关于DataFram描述正确的是( )。
A:DataFrame可以有多列数据
B:可以通过NumPy数组创建DataFrame
C:可以通过字典数组创建DataFrame
D:其它说法均错误
喵查答案:DataFrame可以有多列数据可以通过NumPy数组创建DataFrame可以通过字典数组创建DataFrame
29、df是数据框类型对象,删除数据框中重复数据的语句是( )。
A:df.drop_duplicates(inplace=True)
B:df.drop_duplicates(inplace=False)
C:df.drop_duplicates()
D:其它均正确
喵查答案:df.drop_duplicates(inplace=True) df.drop_duplicates(inplace=False)df.drop_duplicates()其它均正确
30、下面属于pandas包的数据类型是( )。
A:list([1,2,3,4])
B:np.array([1,2,3,4])
C:pd.Series([1,2,3,4])
D:pd.DataFrame([1,2,3,4])
喵查答案:pd.Series([1,2,3,4])pd.DataFrame([1,2,3,4])
31、若调用shift()方法时传入一个正数,则表明时间序列中的数据会沿着纵轴正方向移动一次。( )
A:对
B:错
喵查答案:对
32、现代投资组合理论研究的是理性投资者。( )
A:对
B:错
喵查答案:对
33、在OHLC采样时,时间序列的数据量是减少的。( )
A:对
B:错
喵查答案:对
34、位于左上角的子图编号为1。( )
A:对
B:错
喵查答案:错
35、Numpy模块中多维数组的切片是沿着行或者列的方向选取元素的。( )
A:对
B:错
喵查答案:对
36、使用pip命令在线安装numpy模块的命令是pip install numpy。( )
A:对
B:错
喵查答案:对
37、在给定收益下,追求更大风险的投资者,属于理性投资者。( )
A:对
B:错
喵查答案:错
38、numpy.random()模块中的choice函数既可以生成重复数据,又可以生成不重复数据。( )
A:对
B:错
喵查答案:对
39、在一次绘图中,不可以使用多个plot函数。( )
A:对
B:错
喵查答案:错
40、新版本的tushare工具包中的api接口函数可以任意使用。( )
A:对
B:错
喵查答案:错
41、Numpy模块中,可以使用dot( )函数计算两个数组的內积。( )
A:对
B:错
喵查答案:对
42、.isnull()方法是判断序列中是空值,如果有空值,返回True,否则返回False。( )
A:对
B:错
喵查答案:对
43、直方图可以利用条形或方块的高度来反映数据的分布。( )
A:对
B:错
喵查答案:对
44、已知a = np.arange(12).reshape(3,4),执行命令a.max()可以求出数组a中沿纵轴方向的最大值。( )
A:对
B:错
喵查答案:错
45、大数据(big data):是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。( )
A:对
B:错
喵查答案:对
46、to_datetime函数的返回值一定是一个时间戳对象。( )
A:对
B:错
喵查答案:错
47、Numpy模块中数组的切片操作会改变原数组的数据,保存为切片操作后的数据内容。( )
A:对
B:错
喵查答案:错
48、重采样是指将时间序列从一个频率转换到另一个频率的处理过程。( )
A:对
B:错
喵查答案:对
49、如果是将高频率数据聚合到低频率数据,则称为升采样。( )
A:对
B:错
喵查答案:错
50、Numpy模块中广播机制能实现对两个或两个以上数组的运算,这些数组的形状可以是任意的。( )
A:对
B:错
喵查答案:错
51、可以通过xticks函数设置要显示的y轴坐标。( )
A:对
B:错
喵查答案:错
52、Pandas中有两个主要的数据结构:Series和DataFrame。( )
A:对
B:错
喵查答案:对
53、Figure对象允许划分为多个绘图区域,每个绘图区域都是一个Axes对象,被称为子图。( )
A:对
B:错
喵查答案:对
54、add_axes函数的参数含义代表的是子图区域的长度。( )
A:对
B:错
喵查答案:错
55、已知a = np.array([2,4,6,8,9,10]),执行语句a.reshape(2,3)后,数组a变为二维数组。( )
A:对
B:错
喵查答案:错
56、滑动窗口指的是根据指定的单位长度来框住时间序列,从而计算框内的统计指标。( )
A:对
B:错
喵查答案:对
57、DataFrame是共享同一个index的Series集合, DataFrame的每一列都是一个序列( Series )。( )
A:对
B:错
喵查答案:对
58、Numpy模块中数组是用来存储若干数据的连续内存空间,其中的元素一般是相同类型的。( )
A:对
B:错
喵查答案:对
59、Series是一个类似一维数组的对象,它能够保存任何类型的数据,主要由一组数据和与之相关的索引两部分构成。( )
A:对
B:错
喵查答案:对
60、numpy.random模块中函数的size参数可以省略,但圆括号不可以省略。( )
A:对
B:错
喵查答案:对
61、Numpy模块中,可以使用dtype属性查看数据类型,数据类型是由一个类型名和元素位长的数字组成。( )
A:对
B:错
喵查答案:对
62、如果希望一次性创建一组子图,则可以通过subplots()函数进行实现。( )
A:对
B:错
喵查答案:对
63、lambda函数也需要使用return语句来返回函数值。( )
A:对
B:错
喵查答案:错
64、如果不希望在默认的画布上绘制图形,则可以调用figure()函数构建一张新的空白画布。( )
A:对
B:错
喵查答案:对
65、in1d()函数用于判断数组中的元素是否在另一个数组中存在,该函数返回的是一个布尔型的数组。( )
A:对
B:错
喵查答案:对
《金融数据分析》补考
1、下面哪项代表时间频率为3天( )。
A:3D
B:3days
C:3H
D:3hours
喵查答案:3D
2、下列函数中,用于移动数据的是( )。
A:shift()
B:date_range()
C:period_range()
D:asfreq()
喵查答案:shift()
3、range(n)如果只有一个参数,那么n值是什么( )
A:初始值
B:终止值
C:步长
D:产生数据的个数
喵查答案:终止值
4、下列函数中,可以为图表设置标题的是( )。
A:legend()
B:xlabel()
C:title()
D:xlim()
喵查答案:title()
5、请阅读下面一段程序:roll_window = ser_obj.rolling(window=10)有关上述程序,下面描述错误的是( )。
A:roll_window是一个Period类对象
B:窗口的大小为10
C:窗口的标签为非居中
D:默认对一列的数据进行计算
喵查答案:roll_window是一个Period类对象
6、能发现数据异常点的是图表类型是( )
A:折线图
B:箱型图
C:饼图
D:条形图
喵查答案:箱型图
7、data是DataFrame类型的对象,下列语句中能实现的data做描述统计的语句是( )。
A:data.describe()
B:data.T()
C:data.min()
D:data.show()
喵查答案:data.describe()
8、下列既可以删除数据框的行也可以删除数据框列的方法是( )
A:.drop()
B:.pop()
C:del
D:其它均可以
喵查答案:.drop()
9、使用Pandas创建的时间序列,在访问具体元素可以使用( )。
A:绝对位置
B:索引值
C:时间字符串
D:其它都对
喵查答案:其它都对
10、a1=np.array([1,2,3,4])a2=a1.reshape(2,2)执行上述程序后,则a1的值为( )
A:[1,2,3,4]
B:[[1,2],[3,4]]
C:[2,2]
D:[1,2,1,2]
喵查答案:[1,2,3,4]
11、s1为Series类型对象,语句s1=s1.drop(‘e’)的功能是( )。
A:删除索引为“e”的值
B:删除索引“e”
C:删除数据“e”
D:删除列名为“e”的列
喵查答案:删除索引为“e”的值
12、下列关于常见图表说法正确的是( )。
A:散点图不能在子图中绘制
B:散点的x轴刻度必须为数值
C:折线图可以用作查看特征间的趋势关系
D:箱形图可以用来查看特征间的相关关系
喵查答案:折线图可以用作查看特征间的趋势关系
13、下列语句能计算序列s1中位数的语句是( )。
A:s1.max()
B:s1.median()
C:s1.mode()
D:s1.mul()
喵查答案:s1.median()
14、下列代码中,绘制散点图的是( )。
A:plt.scatter(x,y)
B:plt.plot(x,y)
C:plt.legend(‘upper left’)
D:plt.xlabel(‘散点图’)
喵查答案:plt.scatter(x,y)
15、下列方法中,能够对常规时间序列数据重新采样的是( )。
A:shift()
B:rolling()
C:asfreq()
D:resample()
喵查答案:resample()
16、df是数据框类型对象,提取列名为“city”中包含“Harbin”的行的语句是( )。
A:df[df[‘city’].str.contains(‘Harbin’)]
B:df[~df[‘city’].str.contains(‘Harbin’)]
C:df[~df[‘Harbin’].str.contains(‘city’)]
D:其它均正确
喵查答案:df[df[‘city’].str.contains(‘Harbin’)]
17、关于降采样的说法中,下列描述错误的是( )。
A:降采样是将高频率数据聚合到低频率数据
B:降采样的时间颗粒会变大
C:降采样的数据量是增加的
D:降采样就相当于另外一种形式的分组聚合操作
喵查答案:降采样的数据量是增加的
18、df是数据框类型对象,df[df[‘age’]>30]语句的功能是( )。
A:读取df中值大于30的列
B:读取df中值大于30的行
C:读取age列值大于30的列
D:读取age列值大于30的行
喵查答案:读取age列值大于30的行
19、下列函数中,用于创建固定频率PeriodIndex对象的是( )。
A:shift()
B:date_range()
C:period_range()
D:asfreq()
喵查答案:period_range()
20、a=np.array([1,2,3,4,5])print((a*3).max())执行上述程序后的输出结果为( )
A:5
B:10
C:15
D:20
喵查答案:15
21、已知a = np.array([4,16]),语句( )可以实现计算数组各元素的平方根。
A:print(np.abs(a))
B:print(np.sqrt(a))
C:print(np.square(a))
D:print(np.floor(a))
喵查答案:print(np.sqrt(a))
22、已知a = np.arange(9).reshape(3,3),执行语句print(a[:1,1:]),输出结果为( )。
A:[[0 1]]
B:[[3 4]]
C:[[1 2]]
D:[[4 5]]
喵查答案:[[1 2]]
23、df是DataFrame类型的对象,df.isnull()语句返回的数据类型是( )。
A:整数
B:浮点型
C:布尔型
D:数据框
喵查答案:数据框
24、在创建Figure对象时,可以指定哪个参数来调整画布每英寸的像素个数?( )
A:num
B:dpi
C:figsize
D:facecolor
喵查答案:dpi
25、请阅读下面一段程序:period = pd.Period(2010)print(period+5)运行上述程序,它最终输出的结果为( )。
A:2015
B:2014
C:2013
D:2012
喵查答案:2015
26、random.randrange(0, 10, 2)可能生成以下哪个答案( )
A:0
B:2
C:10
D:8
喵查答案:028
27、下面属于pandas包的数据类型是( )。
A:list([1,2,3,4])
B:np.array([1,2,3,4])
C:pd.Series([1,2,3,4])
D:pd.DataFrame([1,2,3,4])
喵查答案:pd.Series([1,2,3,4])pd.DataFrame([1,2,3,4])
28、s1为Series类型对象,语句s1[:3]的功能是( )。
A:返回的结果是数据框类型的对象
B:返回的结果是序列类型的对象
C:对s1的前 3 个索引访问
D:对s1的前 3 个数据访问
喵查答案:返回的结果是序列类型的对象对s1的前 3 个数据访问
29、Pandas中,增加数据框的列的方法有( )
A:concat()
B:join()
C:DataFrame()
D:其它均可以
喵查答案:concat()join()DataFrame()其它均可以
30、下列关于Series说法正确的是( )。
A:Pandas中,Series 可以被看作由 1列数据组成的数据集。
B:Series主要由一组数据和与之相关的索引两部分构成。
C:Series数据的索引位于左边,数据位于右边。
D:可以通过列表创建 Series、
喵查答案:Pandas中,Series 可以被看作由 1列数据组成的数据集。Series主要由一组数据和与之相关的索引两部分构成。Series数据的索引位于左边,数据位于右边。可以通过列表创建 Series、
31、in1d()函数用于判断数组中的元素是否在另一个数组中存在,该函数返回的是一个布尔型的数组。( )
A:对
B:错
喵查答案:对
32、可以通过subplot()函数一次性创建一组子图。( )
A:对
B:错
喵查答案:错
33、时间序列的移动是指沿着时间轴方向将数据进行前移或后移。( )
A:对
B:错
喵查答案:对
34、random.random()将生成一个任意的随机实数。( )
A:对
B:错
喵查答案:错
35、位于左上角的子图编号为1。( )
A:对
B:错
喵查答案:错
36、Figure对象允许划分为多个绘图区域,每个绘图区域都是一个Axes对象,被称为子图。( )
A:对
B:错
喵查答案:对
37、直方图可以利用条形或方块的高度来反映数据的分布。( )
A:对
B:错
喵查答案:对
38、subplot(333)和subplot(3,3,3)是等价的。( )
A:对
B:错
喵查答案:对
39、.pop方法可以将所选列从原数据块中弹出,原数据块不再保留该列。( )
A:对
B:错
喵查答案:对
40、在给定收益下,追求更大风险的投资者,属于理性投资者。( )
A:对
B:错
喵查答案:错
41、Numpy模块中广播机制能实现对两个或两个以上数组的运算,这些数组的形状可以是任意的。( )
A:对
B:错
喵查答案:错
42、Numpy模块中使用布尔型索引时,布尔型数组的长度可以是任意的。( )
A:对
B:错
喵查答案:错
43、Matplotlib生成的图表只能在内存中显示,不可以保存在本地。( )
A:对
B:错
喵查答案:错
44、在Pandas中,Period类表示一个时间戳。( )
A:对
B:错
喵查答案:错
45、新版本的tushare工具包中的api接口函数可以任意使用。( )
A:对
B:错
喵查答案:错
46、tushare工具包的stock_basic接口函数的返回值为DataFrame类型的数据。( )
A:对
B:错
喵查答案:对
47、list(range(1, 0))的输出结果是[1]。( )
A:对
B:错
喵查答案:错
48、数据移动后不会出现边界情况。( )
A:对
B:错
喵查答案:错
49、Period对象可以进行算术运算。( )
A:对
B:错
喵查答案:对
50、Numpy模块中,执行语句a = np.arange(12).reshape(2,3,2),可以创建三维数组a。( )
A:对
B:错
喵查答案:对
51、数据可视化是指将数据以图表的形式表示,并利用数据分析发现其中未知信息的处理过程。( )
A:对
B:错
喵查答案:对
52、Numpy模块中使用标准差进行统计分析时,如果对于一组特定的数据其标准差较大,则代表大部分数值和其平均值之间差异不大。( )
A:对
B:错
喵查答案:错
53、绘制图表时,可以使用subplot()函数一次性创建多个子图。( )
A:对
B:错
喵查答案:错
54、apply(f,axis=1) 方法中,axis参数为1是指将函数f作用在原始数据的每一行上。( )
A:对
B:错
喵查答案:对
55、滑动窗口对数据重新聚合后,数据会变得更加平稳。( )
A:对
B:错
喵查答案:对
56、使用命令b = np.ones(5,5)可以创建元素值均为1的二维数组b。( )
A:对
B:错
喵查答案:错
57、ARIMA是一种用于时间序列预测的常见统计模型。( )
A:对
B:错
喵查答案:对
58、针对一维数组,NumPy提供了unique()函数来找出数组中的唯一值,并返回排序后的结果。( )
A:对
B:错
喵查答案:对
59、numpy.random模块中choice的replace参数如果设置为False,则生成的数据是可以重复的。( )
A:对
B:错
喵查答案:错
60、grid函数的参数axis被设置为”x”时,表示网格会平行x轴设置。( )
A:对
B:错
喵查答案:错
61、verify_integrity:默认值为False,如果为True当创建相同的index时会出现ValueError的错误。( )
A:对
B:错
喵查答案:对
62、list(range(0))的输出结果是[0]。( )
A:对
B:错
喵查答案:错
63、对于有明显增长趋势的时间序列数据,不能直接使用ARIMA模型,需要做差分。( )
A:对
B:错
喵查答案:对
64、条形图可以绘制,也可以水平绘制。( )
A:对
B:错
喵查答案:对
65、K线图中开盘价低于收盘价时,叫做阴线。( )
A:对
B:错
喵查答案:错
/pay