Mark học AI

Video #42 · AI học như thế nào · Phần 5/7

Overfitting là gì? Khi AI học vẹt thay vì học hiểu

Vì sao AI có lúc giỏi bài quen mà hỏng bài lạ? Vì máy cũng có thể học vẹt.

Giỏi bài quen, hỏng bài lạ

Phần trước, AI truy ngược lỗi để vặn đúng núm. Nhưng vặn quá kỹ cũng có hại: máy có thể thuộc lòng đề mà không hiểu bài.

VÍ DỤ

Hai bạn ôn thi

Hình dung hai bạn ôn thi toán. An học thuộc đáp án của 100 bài mẫu. Bình thì học cách giải, dù còn sai vài bài.

ĐỀ MỚI

Lật đề thi ra

Hôm thi, đề chỉ đổi con số. An đứng hình, vì bài này chưa từng thuộc. Bình vẫn làm được, vì bạn ấy nắm cách làm, không nắm đáp án.

HỌC VẸT

Máy cũng học vẹt

Máy cũng vậy. Vặn núm quá kỹ cho khớp từng ví dụ luyện, nó nhớ cả chi tiết vụn vặt. Đó là quá khớp, tiếng Anh là overfitting: bài luyện đúng gần hết, gặp dữ liệu mới thì sai.

ĐỀ GIẤU KÍN

Luôn giữ một đề chưa thấy

Vì vậy, người huấn luyện luôn cất riêng một phần dữ liệu, máy không được nhìn lúc học. Học xong mới đem ra thi. Điểm trên đề lạ mới là điểm thật.

VÌ SAO

Quen thì trơn, lạ thì đoán

AI trò chuyện học từ lượng chữ khổng lồ, nên câu quen thuộc trên mạng nó trả lời rất trơn. Gặp tình huống lạ chưa ai viết ra, nó có thể đoán sai mà giọng vẫn tự tin.

PHẦN 6

Vì sao AI giỏi vọt lên?

Học hiểu thì tốt rồi. Nhưng vì sao mấy năm nay AI bỗng giỏi vọt lên? Hẹn bạn ở phần 6.

Đây là bài viết từ video Học vẹt và học hiểu của kênh Mark học AI. Xem video để thấy phần minh họa bằng hình động.