💡 知識庫閱讀器
模組六:營運智慧概論練習題
6.3 營運智慧與資訊管理 (20題)
Q1. 某大型跨國零售集團為了應對瞬息萬變的市場,導入了營運智慧系統。就系統性觀點而言,該系統架構包含了「投入、處理、產出」三個子系統。請問負責提供「模型庫 (Model Bases)、線上分析處理 (OLAP) 及資料探勘 (Data Mining)」功能的是哪一個子系統?
正確答案:(B)
解析:在營運智慧的三大子系統中,將資料進行運算、建立多維度模型並挖掘隱藏知識的核心引擎,屬於「處理」階段的資料分析系統。
解析:在營運智慧的三大子系統中,將資料進行運算、建立多維度模型並挖掘隱藏知識的核心引擎,屬於「處理」階段的資料分析系統。
Q2. 資料倉儲運作的基礎是 ETL (Extract-Transform-Load) 流程。在將異質資料源的資料轉換並載入倉儲前,必須遵循 ECCD 四個步驟。其中負責「確保資料品質,處理缺失值、極端值或錯誤格式」的步驟為何?
正確答案:(B)
解析:清理 (Clean) 階段的重點在於過濾與修正髒資料 (如空白欄位、不合理數值),以確保後續進入分析階段的資料品質。
解析:清理 (Clean) 階段的重點在於過濾與修正髒資料 (如空白欄位、不合理數值),以確保後續進入分析階段的資料品質。
Q3. 在建置資料倉儲的過程中,資訊部門發現台灣分公司的系統將商品重量單位記錄為「公斤」,而美國分公司則記錄為「磅」。為了讓總部的高階主管能跨國匯總分析總出貨重量,系統在 ECCD 流程中必須執行哪一個步驟來統一這些度量衡標準?
正確答案:(C)
解析:一致化 (Conform) 旨在確保各個不同資料來源的資料定義、單位、編碼規則達到一致性,是解決「異質資料庫整併」時最關鍵的步驟。
解析:一致化 (Conform) 旨在確保各個不同資料來源的資料定義、單位、編碼規則達到一致性,是解決「異質資料庫整併」時最關鍵的步驟。
Q4. 專案經理負責主導公司營運智慧平台的建置。依據標準的規劃與設計流程,下列四個階段的正確執行順序應為何?
(甲) 架構設計
(乙) 測試與發布
(丙) 需求與現況分析
(丁) 系統建置
(甲) 架構設計
(乙) 測試與發布
(丙) 需求與現況分析
(丁) 系統建置
正確答案:(B)
解析:建置資料倉儲與營運智慧系統的標準流程為:(1) 釐清需求與現況 ➔ (2) 進行架構設計 ➔ (3) 實際系統建置 ➔ (4) 測試與發布上線。
解析:建置資料倉儲與營運智慧系統的標準流程為:(1) 釐清需求與現況 ➔ (2) 進行架構設計 ➔ (3) 實際系統建置 ➔ (4) 測試與發布上線。
Q5. 某金融機構在收集營運智慧系統的建置需求時,法遵部門特別要求:「所有與客戶信用評分相關的原始異動資料,必須在資料倉儲中保存至少七年,並具備不可竄改的防護機制以備金管會稽查。」這屬於 ETL 系統需求分析中的哪一類需求?
正確答案:(D)
解析:因應政府機關法規或行業規範 (如資料保存年限、軌跡稽核) 所衍生的系統限制與規格,皆屬於法規需求。
解析:因應政府機關法規或行業規範 (如資料保存年限、軌跡稽核) 所衍生的系統限制與規格,皆屬於法規需求。
Q6. 企業在設計 ETL 架構時,經常面臨「購買商用 ETL 工具」與「自行開發 (Hand-coding)」的抉擇。若公司高層希望「能快速開發上線、降低操作門檻、且後續維護不需高度依賴特定程式設計師」,則下列哪一項決策最為合理?
正確答案:(A)
解析:商用 ETL 套件 (如 Informatica, DataStage) 通常具備視覺化拖拉介面,開發快速且維護性高;自行開發雖具靈活性且無授權費,但維護門檻較高且易受限於開發者個人習慣。
解析:商用 ETL 套件 (如 Informatica, DataStage) 通常具備視覺化拖拉介面,開發快速且維護性高;自行開發雖具靈活性且無授權費,但維護門檻較高且易受限於開發者個人習慣。
Q7. 某信用卡發卡銀行為了在客戶刷卡的當下即時判斷是否為盜刷,要求營運智慧系統必須在毫秒等級內,比對該筆交易與歷史詐欺特徵的相似度。為了滿足這種「極度急迫的載入與分析需求」,ETL 架構設計應採用下列哪一種處理模式?
正確答案:(C)
解析:傳統標準架構多採週期性批次更新;但針對防盜刷、產線異常監控等具備高度急迫性的動態系統,必須採用串流 (Streaming) 處理流程。
解析:傳統標準架構多採週期性批次更新;但針對防盜刷、產線異常監控等具備高度急迫性的動態系統,必須採用串流 (Streaming) 處理流程。
Q8. 在夜間執行龐大的 ETL 批次資料載入時,若系統在處理到一半時遭遇無預警斷電或網路中斷。一個設計完善的架構,應該確保系統重啟後能從中斷點繼續執行,而不會導致前段資料重複載入或後段資料遺失。這考驗了架構設計中的哪一項機制?
正確答案:(B)
解析:保證系統在非正常結束狀態下的復原能力 (Rollback 或從 Checkpoint 繼續執行),是「復原與重新啟動機制」的核心目的,也是確保資料完整性的關鍵。
解析:保證系統在非正常結束狀態下的復原能力 (Rollback 或從 Checkpoint 繼續執行),是「復原與重新啟動機制」的核心目的,也是確保資料完整性的關鍵。
Q9. 當每日數百萬筆的交易資料從各營業據點匯入總部時,難免會遇到如「客戶 ID 不存在於主檔中」或「交易金額為異常的天價」等問題。一個標準且一致的「例外處理機制 (Exception Handling)」通常會怎麼做?
正確答案:(C)
解析:優良的 ETL 例外處理機制會將髒資料攔截並寫入錯誤隔離區,確保主流程不被中斷,事後再由資料管家 (Data Steward) 進行人工或排程修補。
解析:優良的 ETL 例外處理機制會將髒資料攔截並寫入錯誤隔離區,確保主流程不被中斷,事後再由資料管家 (Data Steward) 進行人工或排程修補。
Q10. 在資料倉儲的環境中,有一種極為重要的資料庫,裡面不存放顧客的實際交易金額,而是記錄著「這個欄位是從哪個原始系統來的、資料型態是什麼、多久更新一次、業務定義是什麼」。這種被稱為「關於資料的資料」的術語為何?
正確答案:(B)
解析:詮釋資料 (Metadata) 是描述資料的屬性、來源與脈絡的資訊。對於系統整合、資料血緣追蹤與終端使用者理解報表意義而言,是不可或缺的基礎建設。
解析:詮釋資料 (Metadata) 是描述資料的屬性、來源與脈絡的資訊。對於系統整合、資料血緣追蹤與終端使用者理解報表意義而言,是不可或缺的基礎建設。
Q11. 為了不影響企業白天線上交易處理系統 (OLTP) 的回應速度與效能,資料倉儲的 ETL 作業在「萃取 (Extract)」階段,通常會採取下列哪一種最佳實務做法?
正確答案:(B)
解析:全量萃取非常耗費資源,為避免影響前線營運,通常會在離峰時段透過時間戳記或 CDC (Change Data Capture) 技術進行增量萃取。
解析:全量萃取非常耗費資源,為避免影響前線營運,通常會在離峰時段透過時間戳記或 CDC (Change Data Capture) 技術進行增量萃取。
Q12. 在營運智慧架構的「產出」階段,系統必須將分析結果提供給決策者。下列哪一種系統提供了一個統一的單一登入介面,讓高階主管能透過瀏覽器輕鬆存取跨部門的儀表板與報表?
正確答案:(C)
解析:企業資訊入口網 (Enterprise Information Portal, EIP) 屬於資料呈現系統,能將複雜的後端分析結果,轉化為易於使用的視覺化網頁介面。
解析:企業資訊入口網 (Enterprise Information Portal, EIP) 屬於資料呈現系統,能將複雜的後端分析結果,轉化為易於使用的視覺化網頁介面。
Q13. 某電信公司為了分析近五年的用戶通話行為,建置了龐大的企業資料倉儲。但在分析過程中,分析師發現若要檢視「特定行政區、特定費率專案、按月份」的用戶流失率,系統都能在幾秒內產出結果。這主要歸功於資料分析系統中的哪一項技術?
正確答案:(B)
解析:OLAP 技術透過預先計算並建立多維度資料方塊 (Cube),讓使用者能針對海量歷史資料進行極速的切片、下鑽與上捲分析。
解析:OLAP 技術透過預先計算並建立多維度資料方塊 (Cube),讓使用者能針對海量歷史資料進行極速的切片、下鑽與上捲分析。
Q14. 關於企業資訊系統的定位,下列哪一段敘述最能精準描述「營運智慧系統」與「日常交易系統 (如 POS, ERP)」之間的關係?
正確答案:(C)
解析:交易系統 (OLTP) 是企業運作的基礎,負責記錄每一筆事實;這些事實匯集後,成為營運智慧系統 (OLAP/分析引擎) 淬鍊決策智慧的原材料。
解析:交易系統 (OLTP) 是企業運作的基礎,負責記錄每一筆事實;這些事實匯集後,成為營運智慧系統 (OLAP/分析引擎) 淬鍊決策智慧的原材料。
Q15. ECCD 流程的最後一個步驟是「交付 (Delivery)」。在這個階段,資料工程師的主要任務是什麼?
正確答案:(A)
解析:交付 (Delivery) 意指將萃取、清理、一致化後的高品質資料,交付至目標儲存區 (Data Warehouse / Data Mart),以便終端應用程式與使用者進行開發與分析。
解析:交付 (Delivery) 意指將萃取、清理、一致化後的高品質資料,交付至目標儲存區 (Data Warehouse / Data Mart),以便終端應用程式與使用者進行開發與分析。
Q16. 某零售商的行銷部門抱怨,每次要從總公司的巨大資料倉儲中查詢特定促銷活動的歷史資料,不僅查詢語法複雜且常常遭遇效能瓶頸。為解決此問題,IT 部門決定從倉儲中擷取「專屬行銷領域」的資料,建立一個規模較小、高度客製化的分析環境。這稱之為?
正確答案:(B)
解析:資料市集 (Data Mart) 是資料倉儲的子集,通常是為特定部門(如行銷、財務)或特定業務流程量身打造,具備查詢快速、結構簡單的優點。
解析:資料市集 (Data Mart) 是資料倉儲的子集,通常是為特定部門(如行銷、財務)或特定業務流程量身打造,具備查詢快速、結構簡單的優點。
Q17. 在建置資料倉儲的需求分析階段中,「時程需求 (Schedule Requirements)」主要關注的議題為何?
正確答案:(C)
解析:時程需求描述的是資料的「延遲容忍度 (Latency)」,它會直接決定架構設計該採用批次處理 (Batch) 還是串流處理 (Streaming)。
解析:時程需求描述的是資料的「延遲容忍度 (Latency)」,它會直接決定架構設計該採用批次處理 (Batch) 還是串流處理 (Streaming)。
Q18. 一家製造業導入了營運智慧平台,將產線感測器的溫度資料與機台的保養紀錄整合。分析系統透過「資料探勘 (Data Mining)」演算法,成功找出了「當溫度連續兩小時波動超過 5 度時,未來三天內發生主軸斷裂的機率高達 85%」的潛在規則。這個發掘規則的過程屬於系統的哪一層級?
正確答案:(B)
解析:資料探勘 (Data Mining) 負責在龐大資料中自動尋找隱含的模式、關聯與預測規則,屬於「處理」階段的分析引擎核心任務。
解析:資料探勘 (Data Mining) 負責在龐大資料中自動尋找隱含的模式、關聯與預測規則,屬於「處理」階段的分析引擎核心任務。
Q19. 在探討資訊系統的開發與建置時,若企業選擇「自行開發 (In-house Development)」整個 ETL 架構,相較於採購商用套件,其最主要的風險或劣勢通常是什麼?
正確答案:(C)
解析:自行開發雖然能省下授權費且擁有絕對的掌控力,但往往缺乏標準化的介面與文件,一旦關鍵開發人員離職,後續接手維護的難度極高。
解析:自行開發雖然能省下授權費且擁有絕對的掌控力,但往往缺乏標準化的介面與文件,一旦關鍵開發人員離職,後續接手維護的難度極高。
Q20. 在現代的資料處理架構中,除了傳統的 ETL (Extract-Transform-Load) 之外,大數據環境下也常採用 ELT (Extract-Load-Transform) 架構。造成這種轉變的最主要技術背景原因為何?
正確答案:(B)
解析:過去因資料庫算力昂貴,需先在專屬 ETL 伺服器上轉換好 (Transform) 再載入。如今雲端倉儲算力強大且便宜,先載入 (Load) 後再轉換 (Transform) 成為大數據處理的主流趨勢。
解析:過去因資料庫算力昂貴,需先在專屬 ETL 伺服器上轉換好 (Transform) 再載入。如今雲端倉儲算力強大且便宜,先載入 (Load) 後再轉換 (Transform) 成為大數據處理的主流趨勢。
沒有留言:
張貼留言