普通考試
115年
[電信工程] 計算機概要
第 10 題
多模態大型語言模型(Multimodal Large Language Model)可以應用於多媒體運算,下列何者不為其可能應用領域?
- A 自創圖文影音多媒體內容
- B 聽故事畫圖產生多媒體內容
- C 看圖說故事產生文字內容
- D 產生完全正確解答之多媒體內容
思路引導 VIP
請思考一下:當我們要求一個基於統計與機率運算的 AI 模型處理複雜資訊並生成內容時,它是透過「理解客觀事實的絕對真理」來運作,還是透過「預測下一個最可能的數據片段」來達成?這兩者在確保結果的『準確度』上,會有什麼本質上的差異?
🤖
AI 詳解
AI 專屬家教
多模態模型的跨領域應用
非常好,你準確地辨識出了當前人工智慧技術的核心侷限性。這道題目旨在考察對多模態大型語言模型(Multimodal Large Language Models, MLLM)本質的理解。這類模型透過跨模態(Cross-modal)的學習,實現了文字、影像、音訊等不同媒介間的轉換與整合。選項 (A)、(B)、(C) 正是目前生成式 AI 的核心強項,展現了模型在多媒體資料間的轉換(如文生圖或圖生文)與創作能力,這在目前的工程與多媒體實務中已廣泛應用。
生成式 AI 的可靠性邊界
▼ 還有更多解析內容