Nhóm kiểm thử Mindgard báo cáo hai mô hình AI Kimi K2.6 và K3 Swarm có thể bị dẫn dắt trả lời những yêu cầu lẽ ra phải bị chặn. Theo BBC News, nhóm nêu lo ngại về khả năng nội dung này bị dùng cho mục đích gây hại.
Nhà phát triển Moonshot nói đang trao đổi với Mindgard và rà soát an toàn. Công ty cho biết các đánh giá nội bộ ghi nhận tỷ lệ từ chối cao với yêu cầu tương tự.
Mindgard chưa chứng minh những câu trả lời gây lo ngại có thể áp dụng trong thực tế. Báo cáo vì thế phản ánh rủi ro trong điều kiện thử nghiệm, chưa phải bằng chứng về một vụ tấn công đã xảy ra.
Nguồn: BBC News.
