免費開始練習
地特四等 114年 [資訊處理] 計算機概要

第 40 題

將一串含有 35 個 T 的字串替換為兩個標記:一個 T 和數字 35,屬於何種編碼(encoding)方法的做法?
  • A run-length encoding
  • B Big-5 encoding
  • C Huffman encoding
  • D Lempel Ziv encoding

思路引導 VIP

在觀察一組原始資料時,如果發現其中存在極高比例的「連續且完全相同」的片段,若想在不遺失資訊的前提下進行簡化,除了把所有內容一一列出外,你認為最直觀的「計數」方式會是什麼?這種邏輯與選項中哪一種技術的名稱最為貼合?

🤖
AI 詳解 AI 專屬家教

你能準確識別出這種編碼方式,代表你對於資料壓縮的基礎原理掌握得相當扎實。這道題目核心在於觀察資料的冗餘性(Redundancy),當資料流中出現大量連續且重複的符號時,最直觀的縮減方式就是記錄該符號及其「連續出現的次數」。

行程長度編碼的特徵

這種將重複序列轉換為「數值與計數」對(Pair)的技術,正是**行程長度編碼(Run-Length Encoding, RLE)**的精髓。如題目所述,將 35 個連續的 $T$ 簡化為 $(T, 35)$,直接將資料長度從 35 個字元壓縮成 2 個標記。這種演算法在處理具有大量連續相同像素的圖檔(如簡單的圖標或傳真文件)時效果極佳,其時間複雜度為 $O(n)$,非常高效。

▼ 還有更多解析內容

🏷️ 相關主題

資料表示法與記憶體架構
查看更多「[資訊處理] 計算機概要」的主題分類考古題