Bắt đầu với AI

AI tạo sinh là gì? Văn bản, hình ảnh, âm thanh và video được tạo ra ra sao?

Bức tranh thống nhất về Generative AI: tạo nội dung khác phân loại ra sao, multimodal là gì và các giới hạn phổ biến.

Trần Phương Nam Đăng 22 thg 9, 2026
Trong bài này

Generative AI là nhóm hệ thống AI có khả năng tạo nội dung mới dựa trên các mẫu đã học từ dữ liệu. Nội dung có thể là văn bản, hình ảnh, âm thanh, video hoặc kết hợp nhiều dạng dữ liệu.

Tạo nội dung khác phân loại và dự đoán

Mô hình phân loại trả lời dữ liệu thuộc nhóm nào; mô hình dự đoán ước lượng kết quả; còn mô hình tạo sinh tạo nội dung mới phù hợp yêu cầu.

Sinh văn bản ở mức token

Với mô hình ngôn ngữ, đầu ra được tạo tuần tự bằng việc dự đoán token tiếp theo theo context.

Hình ảnh và dữ liệu đa phương thức

Mô hình tạo ảnh học các biểu diễn từ dữ liệu hình ảnh; hệ thống multimodal có thể làm việc với nhiều loại dữ liệu cùng lúc.

Ứng dụng và giới hạn

Generative AI hỗ trợ soạn thảo, sáng tạo và tóm tắt, nhưng đầu ra vẫn có thể sai, thiếu context hoặc cần kiểm tra bản quyền và độ chính xác.

Điều cần nhớ

  • Generative AI tập trung vào tạo nội dung mới.
  • Text generation thường diễn ra theo token.
  • Nội dung tạo sinh vẫn cần con người kiểm tra.

Kiểm tra nhanh

  • Phân loại email có nhất thiết là Generative AI không?
  • Multimodal nghĩa là gì?
  • Sinh văn bản thường liên quan token như thế nào?
  • Nêu một trường hợp đầu ra cần kiểm tra lại.
Kiểm tra kiến thức

Kiểm tra nhanh những nội dung chính trong bài viết này.

Kiểm tra bài này