Mô hình ngôn ngữ lớn là động cơ đằng sau phần lớn AI dạng văn bản, gồm ChatGPT, Claude và Gemini. Chúng đưa AI từ các công cụ hẹp, chuyên một tác vụ, sang các hệ thống tổng quát xử lý được nhiều loại việc ngôn ngữ chỉ từ một mô hình, đó là lý do chúng giờ nằm dưới rất nhiều sản phẩm.
LLM hoạt động thế nào?
LLM chia văn bản thành các đơn vị nhỏ gọi là token và học, từ dữ liệu huấn luyện khổng lồ, các quan hệ thống kê giữa chúng. Để trả lời, nó dự đoán token kế tiếp lặp đi lặp lại, mỗi lần cân nhắc mọi thứ đã viết, cho tới khi thành một câu trả lời hoàn chỉnh. Nó không tra cứu sự thật; nó tạo ra phần nối tiếp hợp lý nhất dựa trên mẫu đã học, điều giải thích cả sự trôi chảy lẫn các kiểu lỗi của nó.
LLM khác foundation model ở đâu?
LLM là loại phổ biến nhất của foundation model, nhưng hai khái niệm không đồng nhất. Foundation model là phạm trù rộng hơn, gồm cả các mô hình làm việc với hình ảnh, âm thanh và video, không chỉ văn bản. LLM là một foundation model chuyên về ngôn ngữ. Trong đời thường hai từ thường bị dùng lẫn, vì các foundation model mà đa số người tiếp xúc chính là mô hình ngôn ngữ.
LLM dùng để làm gì?
- Trả lời câu hỏi và giải thích khái niệm.
- Viết và biên tập văn bản, từ email tới tài liệu dài.
- Tóm tắt và trích xuất thông tin từ nguồn.
- Vận hành trợ lý chat và, khi nối với công cụ, các AI agent.
Giới hạn của LLM là gì?
Vì LLM dự đoán văn bản hợp lý chứ không truy xuất sự thật đã kiểm chứng, nó có thể tạo phát biểu sai một cách tự tin, tức AI hallucination. Kiến thức của nó đóng băng ở mốc huấn luyện trừ khi được ghép với truy xuất như RAG, và nó có thể phản ánh thiên lệch trong dữ liệu huấn luyện. Những giới hạn này là lý do việc nối đất và con người rà soát vẫn quan trọng để dùng đáng tin cậy.
Câu hỏi thường gặp
LLM là viết tắt của gì?+
LLM là viết tắt của large language model (mô hình ngôn ngữ lớn). Đây là mô hình AI huấn luyện trên lượng văn bản khổng lồ, hiểu và tạo ngôn ngữ bằng cách dự đoán đoạn văn bản kế tiếp có khả năng cao nhất, nhờ đó trả lời, viết, tóm tắt và trò chuyện.
LLM có phải là foundation model không?+
Không hẳn. LLM là một foundation model chuyên về ngôn ngữ. Foundation model là phạm trù rộng hơn, gồm cả mô hình cho hình ảnh, âm thanh và video. Hai từ thường được dùng thay nhau vì các foundation model nổi tiếng nhất chính là mô hình ngôn ngữ.
Ví dụ về LLM là gì?+
GPT (đằng sau ChatGPT), Claude và Gemini là các mô hình ngôn ngữ lớn. Chúng vận hành trợ lý chat, các công cụ viết và tóm tắt, và khi nối với công cụ bên ngoài thì thành các AI agent.