66B là một mô hình ngôn ngữ khổng lồ được xây dựng dựa trên kiến trúc transformer. Với quy mô lên tới khoảng 66 tỷ tham số, nó có khả năng hiểu và sinh văn bản ở nhiều ngôn ngữ, thực hiện phân tích ngữ cảnh và trả lời câu hỏi với mức độ linh hoạt cao.
Kiến trúc của 66B dựa trên các lớp transformer với cơ chế self-attention và feed-forward sâu. Số tham số lớn cho phép mô hình nắm bắt mối quan hệ ngữ cảnh dài và biểu đạt sự đa dạng ngôn ngữ. Tuy nhiên, hiệu năng còn phụ thuộc vào dữ liệu huấn luyện và phương thức tối ưu hóa.
66B được huấn luyện trên corpus đa ngôn ngữ, đa thể loại văn bản từ nguồn mở và dữ liệu được lọc để giảm thiểu nội dung gây hại. Mục tiêu là tối ưu hóa chất lượng sinh ngôn ngữ, độ liên quan và tính nhất quán.
Ứng dụng của 66B bao gồm tổng hợp nội dung, hỗ trợ viết văn, dịch máy, trả lời câu hỏi và hỗ trợ lập trình. Tuy nhiên, mô hình vẫn có hạn chế như thiếu kiến thức thời sự sau thời điểm huấn luyện, tiềm ẩn sai lệch và rủi ro khuếch đại thiên vị nếu dữ liệu huấn luyện không được cân bằng.
