Vấn đề: Bạn là một AI Engineer/Developer, bạn thường xuyên xây dựng các sản phẩm dựa trên các mô hình AI như OpenAI, Anthropic, Google AI? Và đến một ngày bạn muốn hiểu làm thế nào mà API bạn sử dụng có thể trả về kết quả tốt, thông minh? Vậy thì hãy học cách tạo ra một phiên bản đơn giản hơn của hệ thống phức tạp đó. Một LLM tự bạn xây dựng.
Tự học là một điều khá thú vị, trước khi thực sự sáng tạo ra một điều gì đấy, việc đầu tiên là học những ưu điểm từ những người thầy tốt nhất. Đọc sách là một cách học hỏi vô cùng thú vị. Tuy nhiên nếu chỉ học thụ động thì chúng ta sẽ không học được gì cả, vậy nên là đây là một nơi để viết ra những suy nghĩ và tư duy của mình trong quá trình đọc cuốn sách này.
Introduction
Yêu cầu:
- Hiểu xác xuất là gì?
- Biết một hàm xác suất hoạt động như thế nào?
Nếu bạn có background về Software engineer, khi tạo ra một ngôn ngữ lập trình mới chẳng hạn, làm thế nào để máy tính có thể hiểu được logic của ngôn ngữ lập trình? Nếu bạn là một người cha, bạn có đặt câu hỏi là dạy con học một ngôn ngữ mới như thế nào không?
Có phải đầu tiên là chúng ta sẽ dạy chúng biết bập bẹ từng từ vựng, rồi sau đó học cách kết hợp giữa các từ với nhau.
Tương tự, hãy hình dung mô hình LLM giống như một đứa trẻ, chúng ta cần dạy chúng