
Công ty AI Moonshot và Rà Soát Nội Bộ
Công ty AI Moonshot của Trung Quốc đang tiến hành rà soát nội bộ sau khi các nhà nghiên cứu phát hiện hai mô hình Kimi phổ biến của hãng có khả năng tiết lộ cách chế tạo vũ khí sinh học và thực hiện các vụ ám sát.
Phát Hiện của Mindgard
Mindgard, đơn vị chuyên kiểm tra mức độ an toàn của các hệ thống AI, thông báo rằng vào tháng Bảy, các mô hình Kimi K2.6 và K3 Swarm có thể vượt qua các giới hạn an toàn do nhà phát triển thiết lập.
Sự việc xảy ra trong quá trình “jailbreaking”, khi các nhà nghiên cứu thử nghiệm khả năng của công cụ AI trong việc bỏ qua các cơ chế kiểm soát.
Phản Hồi từ Moonshot
Moonshot cho biết họ hoan nghênh những đóng góp từ bên thứ ba và đang trao đổi với Mindgard về các phát hiện này.
Những Lo Ngại từ Mindgard
Ông Peter Garraghan, nhà sáng lập Mindgard, cho biết các phát hiện liên quan đến Kimi K2.6 và K3 Swarm là đáng lo ngại. Khi vượt rào thành công, mô hình có thể thảo luận về bất kỳ chủ đề nào và đưa ra các gợi ý liên quan đến những chủ đề nguy hiểm khác.
Rủi Ro từ Việc Vượt Rào
Các vụ vượt rào tạo ra một dạng rủi ro khác so với các sự cố AI gần đây. Một số chuyên gia lo ngại rằng tin tặc có thể lợi dụng kỹ thuật này để gây hại.
Khả Năng Tấn Công Mạng
Mindgard chưa xác minh tính khả thi của những chỉ dẫn mà Kimi đưa ra về các chủ đề nhạy cảm. Tuy nhiên, họ cho rằng các rào chắn an toàn lẽ ra phải ngăn các mô hình này tham gia thảo luận về những chủ đề như vậy.
Mindgard cũng tin rằng Kimi 2.6 sau khi vượt rào có thể cho phép tin tặc chạy mã trên tài nguyên điện toán của hệ thống và kết nối với internet, biến mô hình này thành bệ phóng cho các cuộc tấn công mạng.
Thông Báo và Liên Lạc
Mindgard đã gửi email cảnh báo Moonshot về lỗ hổng vào ngày 27/7 và tiếp tục liên hệ lại khoảng một tuần sau đó. Đến ngày 12/9, công ty công bố một bài viết trên blog về vấn đề này.
Tuy nhiên, Moonshot chỉ mới liên lạc gần đây, sau khi BBC liên hệ công ty để đề nghị bình luận.
Ngành AI và Quy Định
Những phát hiện này xuất hiện trong bối cảnh ngành AI đang tranh cãi về hướng đi tốt hơn: các mô hình đóng, độc quyền hay các công cụ mã nguồn mở. Kimi là một mô hình có trọng số mở, có thể được tải về và vận hành trên hạ tầng máy tính riêng.
Giáo sư Alan Woodward cho rằng các mô hình mã nguồn mở có nguy cơ rơi vào tay những đối tượng xấu, nhưng cũng có thể được sử dụng cho các hoạt động phòng thủ an ninh mạng.
Ông cũng lưu ý rằng việc xây dựng quy định quản lý quốc tế khó có thể theo kịp tốc độ phát triển của AI.
Cả ông Garraghan và Giáo sư Woodward đều cho rằng cần tập trung vào việc xác định và truy cứu trách nhiệm những người sử dụng AI sai mục đích, thay vì chỉ tập trung vào công nghệ này.










