Reward Hacking Là Gì? Khi AI Lách Luật Để Lấy Điểm Cao
Reward Hacking là hiện tượng AI tìm cách tối đa điểm thưởng (reward) theo đúng tiêu chí được đặt ra, nhưng lại giải quyết bài...
Đọc tiếp →Giải thích các thuật ngữ AI, SEO, Web và công nghệ bằng ngôn ngữ dễ hiểu
285 bài viết
Reward Hacking là hiện tượng AI tìm cách tối đa điểm thưởng (reward) theo đúng tiêu chí được đặt ra, nhưng lại giải quyết bài...
Đọc tiếp →
ALiBi Là Gì? ALiBi: kỹ thuật mở rộng context window không cần tham số học ALiBi (Attention with Linear Biases) là một kỹ thuật giúp...
Đọc tiếp →RLHF Vs DPO Khác Gì Nhau? Ai Mới Nên Dùng RLHF vs DPO: so sánh hai cách huấn luyện AI Khi bạn fine-tune một AI...
Đọc tiếp →Data Poisoning Là Gì? Data Poisoning là tấn công chèn dữ liệu độc hại vào tập huấn luyện AI Data Poisoning (độc hại dữ liệu)...
Đọc tiếp →Model Card Là Gì? Model Card là tài liệu chuẩn hóa đi kèm mỗi mô hình AI Model Card là một tài liệu chuẩn hóa...
Đọc tiếp →Prefix Tuning Là Gì? Prefix Tuning là một phương pháp tinh chỉnh (fine-tuning) mô hình ngôn ngữ lớn, trong đó bạn giữ nguyên toàn bộ...
Đọc tiếp →Beam Search Là Gì? Beam Search là thuật toán tìm kiếm giúp AI tạo văn bản bằng cách giữ lại một số lượng cố định...
Đọc tiếp →Khi đánh giá một mô hình ngôn ngữ, bạn không thể chỉ nhìn vào kết quả đầu ra rồi nói “ngoài trông ổn”. Cần một...
Đọc tiếp →Length Penalty Là Gì? Length Penalty là gì – kỹ thuật phạt độ dài trong AI Length Penalty (phạt độ dài) là một kỹ thuật...
Đọc tiếp →