66B là một mô hình ngôn ngữ lớn, có tham số khoảng 66 tỷ tham số, được huấn luyện trên quy mô dữ liệu đa dạng. Nó sử dụng kiến trúc Transformer để hiểu và sinh văn bản, từ đó hỗ trợ cho nhiều tác vụ như trò chuyện, viết văn bản, phân tích thông tin và sinh mã nguồn.
Thông số của 66B gồm 66 tỷ tham số. Kích thước context window khoảng 8k đến 32k tokens tùy phiên bản. Kiến trúc là Transformer, được huấn luyện trên dữ liệu đa ngôn ngữ và đa chủ đề. Việc huấn luyện bao gồm các biện pháp an toàn và khung kiểm soát chất lượng để giảm phát sinh thiên lệch và nội dung không phù hợp.
66B có thể được dùng để trò chuyện hỗ trợ khách hàng, soạn thảo văn bản, phân tích dữ liệu, viết mã mẫu, gợi ý sửa lỗi, tóm tắt tài liệu và tạo nội dung cho mạng xã hội hoặc trang web.
Trong sử dụng thực tế, cần giám sát đầu ra, xác minh chất lượng và đảm bảo quyền riêng tư. Cần có cơ chế lọc nội dung, giám sát đạo đức và kế hoạch cập nhật mô hình để đối phó với sai lệch và tiêu chuẩn.
