生活分享
機器學習(Machine Learning)是什麼
機器學習透過資料調整模型,讓它對未見過的輸入做出預測或產生內容。本文用早餐店備料預估的例子,說明特徵、標籤、訓練與測試如何配合,辨別監督學習、非監督學習和強化學習,並解釋資料洩漏、過度擬合與環境改變的影響。讀完能看懂模型為何需要保留測試資料,也能用具體問題判斷一個看似很準的預測是否值得相信。
更新日期: 閱讀時間約 7 分鐘

機器學習是利用資料訓練模型,讓它學到可用於預測或產生內容的關係。和把所有判斷逐條寫死不同,開發者會選擇資料、模型形式和學習目標,再由訓練程式調整模型。真正要驗證的,不是它能否記住已看過的資料,而是面對新情況能不能提供有用的結果。
早餐店想預估隔天需要多少份備料,可以作為直觀例子。店家有過往銷量、星期、營業時段和天氣資料,但隔天的真實需求還不知道。以下用這個原創情境說明訓練與使用的差別,不提供實際銷量預測或保證。資料查證截至 2026 年 9 月 14 日。
資料中的特徵與答案扮演不同角色
Google 的機器學習入門以從資料訓練模型來做預測或生成內容說明這個概念。在監督學習裡,特徵是模型用來判斷的輸入,標籤則是訓練時提供的答案。早餐店的星期與天氣可以是特徵,當天實際售出份數則是標籤;這些角色取決於目前要解決的任務。
同一欄資料換個任務就可能換角色。若要預測銷量,天氣是參考資訊;若要預測降雨,降雨狀態就可能成為答案。先定義問題才能決定收集什麼。不是把試算表所有欄位都丟進去,模型就自然知道哪個欄位可以使用,以及哪些資訊在預測當下還不存在。
還要區分需求與銷量。某天只準備少量餐點並提早售完,紀錄的銷量不等於顧客真正想買的數量。模型若只學這份紀錄,可能把缺貨當成需求低。這是原創例子裡的資料意義問題,提醒我們:標籤的業務定義不清楚,再精密的演算法也可能學錯目標。
訓練是調整,推論是拿來使用
訓練時,模型先依目前參數產生預測,再用損失函式比較預測與標籤的差距,更新參數以減少某種錯誤。訓練完成後,輸入新的星期和可取得的天氣資訊,模型產生預估,這個使用階段叫推論。每次預測不一定會重新訓練,兩種流程應分開理解。
在示例中,可以先用較早期資料訓練,再拿較晚期、未參與訓練的日子測試。預期產物是每一天的預估和真實結果對照,並記下高估、低估及其後果。少備導致缺貨,多備導致浪費,兩種錯誤的代價可能不同,因此「平均差多少」不一定涵蓋店家全部關心的事。
簡單基準也很重要,例如直接參考最近相同星期的銷量。新模型若沒有明顯優於可理解的基準,卻需要大量維護,可能不值得使用。比較時應使用相同測試期間和相同可取得資料,不要讓某種方法提前看見答案,另一種卻只能靠當時資訊。
資料洩漏會讓好成績失去意義
scikit-learn 的官方文件把資料洩漏列為常見陷阱:測試資訊透過不當處理進入訓練,會使評估過於樂觀。對早餐店而言,若把當天結帳金額當作預測當天銷量的輸入,模型可能表現很準,但前一晚做備料決定時根本拿不到這個欄位。這種結果無法支援預期用途。
前處理也要遵守資料邊界。例如需要依資料計算某種轉換參數時,應只用訓練資料取得,再把同一轉換套到測試資料。若先用全部資料整理,再切訓練與測試,可能不小心讓未來資訊參與模型建構。工具的 pipeline 能協助保持程式一致,但仍需要人正確設計切分。
測試資料還應接近真實使用情況。預測未來需求時,隨機把相近日期打散,可能讓結果比真正跨時間預測容易。應考慮時間順序、店家差異和資料重複,而不是只看測試集有多大。評估的可信度來自合理設計,不是報表上的小數位數。
學習方式不只一種
監督學習使用輸入與答案對照,可以做銷量預測或垃圾郵件分類。非監督學習則在沒有指定答案標籤的資料中找模式,例如把購買行為相近的交易分組;分出群組並不代表它們自動具有固定的商業意義,還需要人解讀。兩者解決的問題不同,不能只比誰比較先進。
強化學習關心系統在環境中採取行動後得到的回饋,學習較有利的行動策略。它不等於每次有人按讚就立刻更新模型,也不只是任何形式的反覆練習。對一般備料預測,監督式方法可能已足夠,沒有必要因為名詞熱門就改成更複雜的學習形式。
生成式 AI生成式 AI(Generative AI)是什麼生成式 AI 從資料學到模式,依輸入條件產生文字、影像、聲音等內容。本文以社區二手市集宣傳素材為例,說明生成與分類、搜尋的差別,介紹語言模型、擴散與對抗生成等不同途徑,並解析內容看起來合理卻可能不忠於事實的原因。讀完能把創意需求、必須保留的資訊與人工驗收分開安排,判斷哪些產物仍只是待確認草稿。閱讀全文 也建立在機器學習之上,但生成描述與預測份數有不同驗證方法。文字建議看似合理,不表示內部數字已由可靠的需求模型算出。若系統同時使用數值預測與語言說明,應讓讀者能看出哪一部分來自模型估計,哪一部分是後續解釋。
上線後仍要檢查資料是否改變
模型可能過度擬合,對訓練資料的細節太敏感,面對新資料反而表現較差。也可能訓練時合理,但附近學校放假、店家調整品項或新競爭者出現後,資料關係改變。遇到這些情況不能只說「模型以前很準」,而要重新比較近期的預估與真實結果。
預測應幫助做決定,而不是遮住不確定性。可以保留人工調整及原因,例如店家知道隔天附近有活動,卻尚未反映在資料裡。這些紀錄能幫助評估模型與人工各自的作用,也能辨識哪些新資訊值得納入後續資料流程。
理解機器學習的實用問題是:答案如何定義、輸入當時拿不拿得到、測試是否真的隔離,以及錯誤會造成什麼後果。問清楚這些問題,往往比只知道模型名稱更能判斷一個預測系統是否適合自己的工作。
| 概念 | 備料示例 | 要留意的事 |
|---|---|---|
| 特徵 | 星期與預測時可得資訊 | 不能提前使用結帳結果 |
| 標籤 | 實際銷量或另定的需求指標 | 售完銷量可能低估需求 |
| 測試 | 未參與訓練的後續日期 | 應符合真實預測順序 |
人工智慧(Artificial Intelligence)是什麼人工智慧(Artificial Intelligence)是什麼人工智慧是涵蓋多種技術與應用的總稱,不等於聊天機器人,也不必一定會產生文字。本文從 OECD 的系統定義出發,以照片分類和社區資源推薦為例,說明輸入、推導、輸出與人的目標如何連結,整理它與機器學習、深度學習和生成式 AI 的關係。讀完能用具體問題判斷一項 AI 功能在做什麼,並分辨能力、自治程度與可信度。閱讀全文
深度學習(Deep Learning)是什麼深度學習(Deep Learning)是什麼深度學習利用多層神經網路,從資料學習不同層次的表示,常用於影像、語音與文字任務。本文以回收物照片分類為例,說明隱藏層、非線性、訓練和推論的角色,解釋模型可能記住背景而非物品,以及資料、算力與可解釋性的取捨。讀完能分辨深度學習和一般機器學習的關係,也能用新的拍攝條件檢查一個模型是否真的學到有用模式。閱讀全文
模型參數(Model Parameters)是什麼模型參數(Model Parameters)是什麼模型參數是訓練時調整、用來把輸入轉成輸出的數值,例如權重與偏差。本文用簡單算式示例說明參數如何影響預測,區分模型參數、訓練超參數、提示詞與生成設定,並解釋參數量、數值精度和啟用參數為何是不同指標。讀完能更準確閱讀模型規格,理解參數增加不等於知識逐條增加,也不代表每次聊天都在重新訓練模型。閱讀全文
AI 名詞總索引:從 Loop Engineering 到生成式 AIAI 名詞總索引:從 Loop Engineering 到生成式 AI想看懂 Loop Engineering、Harness Engineering、Context Engineering、RAG、MCP 與其他 AI 名詞,可以從這份總索引開始。依 2026 年 9 月查證範圍,把這些概念分組整理,每個詞連到白話專文,附依任務安排的閱讀路徑、容易混淆的層次,以及原始論文和官方定義的查核方式。閱讀全文
同主題延伸閱讀
生活分享
世界模型(World Model)是什麼:讓 AI 預測「接下來會怎樣」
世界模型指 AI 內部用來預測「這樣做之後會怎樣」的模型,但這個詞至少有三種用法:強化學習代理在想像中練習用的環境模型、LeCun 主張預測抽象表示的架構路線,以及能隨操作即時生成畫面的互動環境。內容用示例說明怎麼在想像中規劃,並列出大型語言模型有沒有世界模型的正反研究,附讀新聞時的檢查問題。
生活分享
視覺語言模型(VLM)是什麼:讓 AI 讀圖片、再用文字回答
視覺語言模型(VLM)能同時接收圖片與文字,再用文字回答。內容拆解視覺編碼器、連接層與語言模型三段結構,說明 CLIP、Flamingo、LLaVA 三篇論文各補上哪一塊,並和多模態 AI、文字生圖分清楚;也整理它常犯的錯:數錯數量、搞混位置、說出圖裡沒有的東西,附上讀收據時逐行核對的步驟。
生活分享
溫度(Temperature)是什麼:AI 回答變化程度的取樣參數
溫度(temperature)是文字生成時調整取樣的參數,讓模型從下一個 token 的機率分布裡抽得更集中或更分散。用假想的台南早餐示例算出低溫與高溫的差別,說明 top-p 的來源和它與 top-k 的差別,並依官方文件與論文指出:調低溫度不代表更準,設成 0 也不保證每次相同,部分模型還不開放調整。
生活分享
合成資料(Synthetic Data)是什麼:兩種用途、品質控管與模型崩潰
合成資料是由演算法或模型產生、模仿真實資料特徵的資料,常見用途有兩種:訓練模型,以及在隱私需求下替代真資料。內容依 Self-Instruct、模型崩潰研究(替換與累積資料的差別)與 NIST、ICO 的隱私文件,說明做法、抽查流程,以及它不能保證的事。
引用本文的文章
最新旅遊情報攻略

情報
2026 韓國楓葉預測:雪嶽山 10 月 20 日、首爾近郊 10 月底、內藏山與漢拏山 11 月上旬
韓國山林廳 2026 年 9 月 22 日公布的楓紅高峰預測:雪嶽山 10 月 20 日,春川、國立樹木園到首爾植物園落在 10 月 28 日到 11 月 2 日,內藏山 11 月 4 日、漢拏山 11 月 6 日,整體比最近 5 年晚約 0.8 天。整理各地楓樹與銀杏的預測日、首爾出發怎麼排,以及出發前去哪裡看即時楓況。2026 年 10 月查證。
- 季節活動
- 自然
- 觀景

攻略胡志明市
胡志明市到頭頓一日遊:白藤碼頭搭高速船、船票與班次,下船就是胡梅纜車與耶穌基督像
人在胡志明市挪一天去頭頓看海:市中心的白藤高速船碼頭搭船,航程 120 分鐘到頭頓的胡梅碼頭,平日成人 320,000 越南盾、週末 350,000,回程末班平日 15:00。下船就是胡梅纜車站,同一條路上有白宮,小山頂上是耶穌基督像。平日一天只有兩班船,整天要從末班船倒推著排。
- 交通
- 行程範例
- 海灘

攻略沖繩
沖繩不開車攻略:單軌只到浦添,美麗海水族館要坐兩個多小時的巴士,回那霸的最後一班直達車 17:22 就開走
不租車的沖繩怎麼移動:那霸市區靠沖繩都市單軌電車(ゆいレール),那霸機場站到終點てだこ浦西 19 站、17 公里、37 分鐘,一日券 1,000 日圓;美麗海水族館有那霸機場直達的高速巴士,單程 2,000 日圓起、官方時刻表上 2 小時上下,下車後還要走 10 分鐘;古宇利島要在今帰仁村役場轉車,當天來回光坐車就六個半小時;回程的最後一班直達車 17:22 就從記念公園前開走(2026 年 9 月查證)。
- 交通
- 行程範例
- 預算