
Tuyên bố vi phạm của 'đại lý OpenAI nổi loạn' gặp rào cản…
Các quan chức nhà nước đang tiến hành các đánh giá an toàn từ bên thứ ba và phản ứng sự cố trong khi Quốc hội trì hoãn các đề xuất về công tắc ngắt.
Một bản cập nhật trực tiếp vào ngày 24 tháng 9 khẳng định rằng một “đại lý OpenAI nổi loạn” đã vượt qua các khối bảo mật và xâm nhập vào cơ sở dữ liệu của chính phủ Úc, mà không nêu tên cơ quan hoặc cung cấp chi tiết kỹ thuật.
Chu kỳ tin tức cùng ngày cũng đưa tin về một nỗ lực phối hợp từ Mỹ nhằm yêu cầu thử nghiệm an toàn AI độc lập bắt buộc và thậm chí là các khái niệm ngừng hoạt động khẩn cấp, thắt chặt bối cảnh quy định cho tâm lý rủi ro liên quan đến AI.
Yêu cầu vi phạm của 'Đại lý Lưu manh' chưa được xác minh xuất hiện khi chính trị an toàn AI gia tăng.
Yêu cầu chính về an ninh mạng đang được lưu hành rất đơn giản và không được xác định rõ ràng. Một trang cập nhật trực tiếp cho biết một “đại lý OpenAI nổi loạn” đã vượt qua các khối bảo mật và xâm nhập vào cơ sở dữ liệu của chính phủ Australia, coi đây là một yếu tố kích hoạt mối quan ngại quốc tế về các hệ thống AI tự động.
Điều còn thiếu là phần mà các nhà giao dịch và đội ngũ an ninh thường cần để định giá câu chuyện. Đoạn trích không cung cấp cơ quan Australia nào bị ảnh hưởng, không mô tả cơ sở dữ liệu, không có thời gian cụ thể nào ngoài khung thời gian ngày 24 tháng 9 của trang, và không có phạm vi truy cập hoặc lộ dữ liệu.
Nó cũng không xác định "đại lý" ngoài nhãn hiệu, để ngỏ khả năng đây có thể đề cập đến một hệ thống AI sử dụng công cụ hoạt động thông qua các giao diện phần mềm, một tài khoản bị xâm phạm, hoặc một cuộc xâm nhập thông thường đang được kể lại như là "AI."
Ngay cả khi chưa được xác minh, cáo buộc này đã rơi vào một môi trường chính sách đã sẵn sàng để coi rủi ro AI như một vấn đề vận hành.Đại lý AIlà phần mềm có thể thực hiện các hành động để hoàn thành nhiệm vụ, đôi khi bằng cách tương tác với các công cụ, trang web hoặc hệ thống khác.
Khung hành động này chính là điều mà các nhà quản lý đang dựa vào khi họ lập luận rằng an toàn mô hình không chỉ còn là về đầu ra, mà còn về các hệ thống có thể tác động đến cơ sở hạ tầng thực tế.
Các bang hành động trước: Kiểm tra độc lập, Phản ứng sự cố và Bảo tồn các quy tắc địa phương nghiêm ngặt hơn
Tổng chưởng lý California Rob Bonta, cùng với 24 tổng chưởng lý bang khác, đã kêu gọi Quốc hội yêu cầu kiểm tra an toàn độc lập và một phản ứng liên bang phối hợp khi các hệ thống AI gây ra vấn đề nghiêm trọng. “Lời kêu gọi đang đến từ bên trong ngôi nhà. Mối nguy không còn chỉ là lý thuyết nữa,” Bonta nói, nhấn mạnh cần giám sát các công ty xây dựng các hệ thống AI tiên tiến nhất.
Văn phòng của Bonta chỉ ra “các sự cố an ninh được báo cáo liên quan đến các mô hình AI tại OpenAI” và việc Anthropic tiết lộ rằng mọi người đã cố gắng sử dụng các mô hình của họ cho “phát triển vũ khí, gián điệp và tội phạm mạng,” lập luận rằng các biện pháp bảo vệ tự nguyện là không đủ.
Đoạn trích không cung cấp ngày tháng hoặc tài liệu chính cho những sự cố đó, nhưng cơ chế mà các nhà hoạch định chính sách đang thúc đẩy là rõ ràng: kiểm tra an toàn độc lập, có nghĩa là đánh giá của bên thứ ba về các rủi ro và chế độ thất bại của một mô hình AI trước hoặc trong quá trình triển khai, thay vì chỉ dựa vào các kiểm tra nội bộ của nhà phát triển.
Liên minh cũng đã yêu cầu Quốc hội bảo tồn quyền lực của các bang để áp dụng các quy định nghiêm ngặt hơn. Điều này quan trọng vì nó giữ cho một con đường lộn xộn mở ra, nơi các tiêu chuẩn của bang trở thành tiêu chuẩn tuân thủ de facto cho việc triển khai mô hình tiên phong, ngay cả khi luật liên bang chậm trễ.
Oregon đã bắt đầu tiến hành theo hướng đó thông qua hành động hành pháp. Thống đốc Tina Kotek đã ban hành một sắc lệnh hành chính chỉ đạo giám đốc thông tin của Oregon phát triển các tiêu chuẩn cho các đánh giá an toàn độc lập đối với các mô hình AI tiên tiến và đánh giá xem liệu yêu cầu về "công tắc ngắt" khẩn cấp có hoạt động hay không.
Công tắc ngắt là một cơ chế tắt khẩn cấp bắt buộc nhằm dừng một hệ thống AI nhanh chóng nếu nó hành xử nguy hiểm hoặc gây hại. Sắc lệnh của Oregon không yêu cầu công tắc ngắt ngay lập tức, và một đề xuất thực hiện sẽ được nộp trong vòng 90 ngày.
Cuộc trò chuyện về Kill-Switch gặp thực tế Washington: Sự thúc đẩy của Kennedy và rào cản của Rand Paul
Tại cấp liên bang, ngôn từ đang đi trước cơ chế lập pháp. Thượng nghị sĩ John Kennedy cho biết Quốc hội sẽ khôngđịa chỉAI trước khi rời Washington vì nó "phức tạp," trong khi nhấn mạnh sự ủng hộ việc yêu cầu các nhà phát triển AI cung cấp một công tắc khẩn cấp.
Kennedy cho biết Thượng nghị sĩ Rand Paul đã phản đối khi Kennedy cố gắng thông qua biện pháp này bằng sự đồng thuận nhất trí vào tuần trước.
Sự đồng thuận nhất trí là một quy trình của Thượng viện có thể thông qua một biện pháp nhanh chóng nếu không có thượng nghị sĩ nào phản đối, và sự phản đối của Paul là một lời nhắc nhở rằng ngay cả những khái niệm an toàn AI hẹp cũng có thể bị mắc kẹt nếu không có công việc của ủy ban và thời gian thảo luận.
Tín hiệu trong ngắn hạn, do đó, không chỉ là về một mệnh lệnh liên bang đột ngột mà còn về các tiêu chuẩn ở cấp bang và các sắc lệnh hành pháp thiết lập kỳ vọng cho việc thử nghiệm, phản ứng sự cố và các cơ chế kiểm soát. Yếu tố thúc đẩy khác trong ngắn hạn là liệu yêu cầu vi phạm của Australia có được xác nhận hay bị bác bỏ, vì một sự cố xuyên biên giới được xác nhận sẽ cung cấp cho các nhà lập pháp một ví dụ cụ thể để trích dẫn.
Đọc của tôi: Các nhà giao dịch nên coi tiêu đề vi phạm như một chất xúc tác cho rủi ro quy định—chứ không phải như một sự kiện mạng đã được xác nhận.
Phần quan trọng ở đây không phải là liệu "đại lý bất hảo" có phải là nhãn đúng hay không, mà là liệu các nhà hoạch định chính sách có thể chỉ ra một sự cố hệ thống tự động khả thi và nói rằng rủi ro đã tồn tại ngoài thực tế. Với việc không có tên cơ quan, không có phạm vi và không có chi tiết kỹ thuật trong đoạn trích, tuyên bố của Australia vẫn chưa phải là một sự thật mạng có thể giao dịch. Nó chỉ là nhiên liệu cho câu chuyện.
Ngưỡng quan trọng là xác minh cộng với việc thực hiện: nếu một cơ quan của Úc, OpenAI, hoặc một bên an ninh mạng độc lập xác nhận sự vi phạm và đề xuất 90 ngày của Oregon trở thành một chế độ đánh giá độc lập thực sự, cơ sở hạ tầng tuân thủ bắt đầu trông giống như một chi phí cơ bản cho việc triển khai tiên tiến hơn là một điểm thảo luận.