Trong báo cáo công bố ngày 10/9, Anthropic, công ty đứng sau mô hình Claude, xác định việc AI bị lạm dụng cho mục đích sinh học là một trong những rủi ro nghiêm trọng nhất đối với các hệ thống AI hiện nay.
Công ty cho biết đã phát hiện 5 trường hợp người dùng tìm cách vượt qua các biện pháp kiểm soát, trong đó có việc sử dụng thủ thuật để né giới hạn truy cập theo khu vực và che giấu mục đích nghiên cứu nhằm qua mặt hệ thống an toàn.
Trong 30 ngày theo dõi, Anthropic xác định khoảng 35 nỗ lực nghiên cứu riêng biệt có hoạt động đáng lo ngại. Tuy nhiên, công ty thừa nhận chưa thể xác định chắc chắn những người này có ý định gây hại hay chỉ đang thực hiện nghiên cứu khoa học hợp pháp.
Anthropic cũng phát hiện các hoạt động liên quan đến orthopoxvirus, nhóm virus bao gồm virus variola gây bệnh đậu mùa và virus gây mpox, cùng nghiên cứu về độc tố trong nọc độc.
Những trường hợp này cho thấy một nghịch lý ngày càng rõ của AI. Công nghệ có thể hỗ trợ đáng kể cho việc phát triển thuốc và phương pháp điều trị mới, nhưng những năng lực tương tự cũng có thể bị lợi dụng để phục vụ các mục đích nguy hiểm.
Anthropic cảnh báo những người có ý đồ xấu có thể lợi dụng các ứng dụng sinh học hợp pháp của AI để che giấu mục đích thực sự của hoạt động nghiên cứu.
“Khi các mô hình ngày càng có năng lực, đạt hoặc vượt trình độ chuyên gia trong những nhiệm vụ khoa học khó, tác động của chúng sẽ tiếp tục gia tăng, cả trong những bối cảnh có lợi và có khả năng gây hại”, đại diện công ty cho biết.
Anthropic nhận định AI đang làm thay đổi đáng kể khả năng thực hiện các hoạt động phức tạp. Theo công ty, năng lực của các mô hình AI trong lĩnh vực an ninh mạng đã thu hẹp khoảng cách về nhân lực và công cụ từng tồn tại giữa những tổ chức được nhà nước hậu thuẫn với các cá nhân hoạt động đơn lẻ.
Điều này khiến việc kiểm soát AI trở nên khó khăn hơn, khi những năng lực trước đây đòi hỏi chuyên môn cao và nguồn lực lớn có thể ngày càng dễ tiếp cận thông qua các mô hình AI.
Anthropic cho biết các phiên bản Claude mới đã được tăng cường biện pháp bảo vệ nhằm hạn chế quyền truy cập vào nhiều dạng truy vấn về nghiên cứu sinh học có khả năng được sử dụng cho cả mục đích hợp pháp và nguy hiểm. Tuy nhiên, công ty thừa nhận các hệ thống an toàn hiện tại sẽ cần tiếp tục được nâng cấp khi năng lực của AI và phương thức lạm dụng ngày càng tinh vi.
Theo Anthropic, những nỗ lực lạm dụng mô hình AI không chỉ giới hạn ở lĩnh vực sinh học. Công ty cho biết đã ngăn chặn các hoạt động sử dụng Claude cho giám sát, lừa đảo và phát triển vũ khí thông thường, bao gồm máy bay không người lái và tên lửa. Những cảnh báo của Anthropic được đưa ra trong bối cảnh ngày càng nhiều nhân sự trong ngành AI lo ngại công nghệ đang phát triển quá nhanh, đặt ra vấn đề cần xây dựng các lớp bảo vệ đủ mạnh để AI không bị biến thành công cụ cho các hoạt động nguy hiểm.
Theo CNN