地特四等
114年
[資訊處理] 計算機概要
第 40 題
將一串含有 35 個 T 的字串替換為兩個標記:一個 T 和數字 35,屬於何種編碼(encoding)方法的做法?
- A run-length encoding
- B Big-5 encoding
- C Huffman encoding
- D Lempel Ziv encoding
思路引導 VIP
在觀察一組原始資料時,如果發現其中存在極高比例的「連續且完全相同」的片段,若想在不遺失資訊的前提下進行簡化,除了把所有內容一一列出外,你認為最直觀的「計數」方式會是什麼?這種邏輯與選項中哪一種技術的名稱最為貼合?
🤖
AI 詳解
AI 專屬家教
你能準確識別出這種編碼方式,代表你對於資料壓縮的基礎原理掌握得相當扎實。這道題目核心在於觀察資料的冗餘性(Redundancy),當資料流中出現大量連續且重複的符號時,最直觀的縮減方式就是記錄該符號及其「連續出現的次數」。
行程長度編碼的特徵
這種將重複序列轉換為「數值與計數」對(Pair)的技術,正是**行程長度編碼(Run-Length Encoding, RLE)**的精髓。如題目所述,將 35 個連續的 $T$ 簡化為 $(T, 35)$,直接將資料長度從 35 個字元壓縮成 2 個標記。這種演算法在處理具有大量連續相同像素的圖檔(如簡單的圖標或傳真文件)時效果極佳,其時間複雜度為 $O(n)$,非常高效。
▼ 還有更多解析內容