WorksheetsITP4(28)
Total questions: 28
Worksheet time: 14mins
Name
Class
Date
1.
資料科學就是以科學的方法,從「資料」中取得「知識」的過程,下列哪一項不屬於從「資料」中可取得的項目?
a)
資訊
b)
分析結果
c)
知識
d)
決策
2.
Bob從「政府資料開放平臺」找到「臺中市各電影院名冊」資料,並使用文字編輯軟體打開後,得到附圖結果,請問下列敘述哪一項錯誤?
a)
Bob下載的是CSV格式檔案
b)
大括號{}內代表一筆資料
c)
字串用雙引號""標註
d)
儲存格式為{屬性:值}
3.
Bob從「政府資料開放平臺」找到每週更新的「全國電影票房統計數據」(如附圖),如果使用文字編輯軟體打開這些CSV格式的資料,請問每個欄位之間會使用下列哪一種符號隔開?
a)
句號
b)
逗號
c)
分號
d)
空格
4.
資料科學是一門涵蓋範圍很廣的學問,請問下列哪一項跟資料科學的相關性最低?
a)
統計學
b)
機器學習
c)
資料探勘
d)
資料壓縮
5.
下列哪一項不屬於巨量資料的特性?
a)
有效性(Validity)
b)
資料大量(Volume)
c)
產生速度快(Velocity)
d)
資料類型多樣性(Variety)
6.
有關「巨量資料(又稱大數據)」可能面臨的挑戰,下列敘述哪一項錯誤?
a)
可能受限電腦運算能力
b)
可能受限資料分析演算法能力
c)
可能觸及個人隱私
d)
可能資料量不足以做為分析之用
7.
Amazon、Facebook及Google等國際大公司,搜集及分析顧客的行為紀錄,進而行銷、精準投放廣告,請問以上描述與下列哪一項無關?
a)
資料科學
b)
開放資料
c)
數據分析
d)
巨量資料
8.
有關「巨量資料(大數據)」目前可能面臨的困難,下列敘述哪一項錯誤?
a)
資料量快速增長,讓自行架設伺服器來儲存與運算的方式已逐漸不適用
b)
企業能由蒐集到的巨量資料中,輕易挖掘出實用性高的知識
c)
即使用戶願意提供個人資料,企業仍必須遵守資料搜集的合法性與正當性
d)
必須不斷研發更有效率、更快速的演算法
9.
有關「開放資料」的敘述,下列哪一項錯誤?
a)
又稱Open Data
b)
秉持著互惠互利、開源共享的精神來分享資料
c)
開放資料註明為免付費取得,即可任意使用
d)
公家跟私人皆能提供開放資料
10.
平時我們在網路上的各種行為,常常會被各平台(如Google、Facebook與網購平台等)搜集並成為巨量資料的一部份,但是資料的搜集不應該包含下列哪一項?
a)
在Google的搜尋紀錄
b)
電子商務網站上的購買紀錄
c)
在Gmail中的聯絡人清單
d)
在Google Maps上的定位紀錄
11.
為了瞭解目前國內高中有哪些科別,Bob由政府開放資料平臺下載「高級中等學校科別資料」的資料集,使用文字編輯軟體打開檔案後(如附圖),請問此檔案採用的格式為下列哪一種?
a)
CSV
b)
XLSX
c)
JSON
d)
XML
12.
在資料科學領域中,有關資料的取得,下列哪一項不是常見的作法?
a)
使用網路爬蟲程式,由網際網路上取得
b)
搜尋及下載開放資料(Open Data)
c)
從事公民科學活動中,由眾多的素人參與者一起搜集取得
d)
使用特洛依木馬程式,由他人的手機或電腦上取得
13.
有關「資料清理」的敘述,下列哪一項錯誤?
a)
可能會刪除某些有缺值的不完整資料
b)
可能會將代表男、女生的字串資料,改為1與0的數值
c)
可能會去除不必要的「欄位」
d)
可能會去除「異常值」
14.
下列哪一種視覺化圖表,適合用來將各類型(不連續)的數值範圍切割成數個區段,以利觀察其變化?
a)
甜甜圈圖
b)
散佈圖
c)
長條圖
d)
直方圖
15.
Alice喜愛校園中的花草樹木,某一天放學時,Alice拾起校門地面上的落葉,並依據樹葉的長度及寬度,製作了附圖的統計圖。請問此統計圖屬於下列哪一種視覺化圖表?
a)
直方圖
b)
折線圖
c)
長條圖
d)
散佈圖
16.
附圖為皇家棋藝學院棋藝競賽選手成績分佈,請問它屬於下列哪一種視覺化圖表?
a)
折線圖
b)
直方圖
c)
長條圖
d)
散佈圖
17.
下列哪一項是資料科學領域中,進行資料分析時常用的技術?
a)
資料清理
b)
資料處理
c)
資料探勘
d)
資料壓縮
18.
電腦科學家嘗試「教」電腦如何辨識人臉,於是想到取出人臉的特徵來反覆訓練電腦,附圖是在Teachable Machine網站,輸入幾類(Class)的照片,進行訓練後,再輸入一張新的照片進行「識別」。這樣的過程,我們稱之為下列哪一項技術?
a)
人臉學習
b)
人工學習
c)
翻轉學習
d)
機器學習
19.
在資料科學的四個過程中,下列哪一項是最核心的工作?
a)
資料搜尋
b)
資料處理
c)
資料分析
d)
資料視覺化
20.
有關「資料分析」的敘述,下列哪一項錯誤?
a)
即使資料有缺漏或錯誤,資料分析仍有神奇的修復能力,最後獲得正確的分析結果
b)
由資料分析建立「車牌識別系統」模型,即使不清楚電腦根據什麼辨識的,但只要把車牌照片給這個模型,它就能辨識出車牌號碼
c)
可以把資料分析模型想成是y=f(x),只要代入x,就能得到y,如果輸入一張貓的照片到模型中,模型會輸出這是「貓」的答案
d)
由資料分析得知「購買尿布的消費者,通常也會同時購買啤酒」。即使不清楚原因,但只要把賣場內的尿布跟啤酒擺放在一起,就可能增加營業額
21.
由附圖的視覺化圖表看來,最有可能搜集了幾種樹木的葉子?
a)
1
b)
2
c)
3
d)
10
22.
下列哪一種情況並不適合利用「K-最近鄰居法」演算法?
a)
資料點混雜
b)
資料點有定義標籤
c)
資料點的每一種類的數量大約一樣多
d)
打算對資料點進行分類
23.
附圖的說明跟下列哪一種機器學習演算法最相關?
a)
決策樹
b)
K-最近鄰居法
c)
K-平均法
d)
迴歸分析
24.
「監督式學習」與「非監督式學習」最大的差異為下列哪一項?
a)
資料取得難易程度
b)
資料是否有標籤
c)
資料分布均勻程度
d)
資料混雜程度
25.
下列哪一項最適合用來作為人類辨識?
a)
身高辨識
b)
指紋辨識
c)
走路速度辨識
d)
體重辨識
26.
當我們上傳與他人的合照到Facebook時,Facebook可能會在照片上標示出某人,這樣的技術跟下列哪一項最有關係?
a)
語音辨識
b)
臉部識別
c)
最近鄰居法
d)
虹膜辨識
27.
有關「自然語言」做為識別之用的敘述,下列哪一項錯誤?
a)
自然語言指的是人類所用的語言
b)
自然語言處理是指如何讓電腦看懂、聽懂,甚至是理解我們的語言
c)
自然語言包含語音辨識、語意分析等
d)
語音辨識是指讓電腦「理解」文字的意思,透過文字的排列、詞性、順序等,來猜測涵義
28.
如果使用Google文件開啟一張用手機拍攝的圖檔(如附圖),即能辨識出圖中的文字出來,請問這是應用下列哪一種技術?
a)
OCR的文字辨識
b)
語意分析
c)
手寫辨識
d)
人臉辨識
100 %
