OpenAI, Anthropic chuẩn bị cho thảm họa AI dự báo trong một năm

Nhiều người trong ngành AI dự đoán một sự cố nghiêm trọng do AI liên quan đến an ninh mạng hoặc hạ tầng có thể xảy ra trong vòng 6–12 tháng tới.

Các lãnh đạo Anthropic, OpenAI và nhiều công ty phát triển AI lớn đang chuẩn bị cho các cuộc thảo luận lập pháp có thể diễn ra sau sự cố đầu tiên.

NỘI DUNG CHÍNH
  • Kịch bản được lo ngại nhất là một cuộc tấn công mạng làm gián đoạn ngân hàng, internet hoặc các tiện ích điện và nước.
  • Dự luật của Bernie Sanders và Greg Casar đề xuất cấm phát triển AI đạt hoặc vượt năng lực con người trên nhiều nhiệm vụ, với mức phạt tù lên tới 20 năm.
  • Anthropic và OpenAI đang sử dụng các cuộc diễn tập an toàn để kiểm tra những tình huống AI gây thiệt hại hoặc xâm nhập hệ thống bên ngoài.

Giới công nghệ AI chuẩn bị cho phản ứng lập pháp sau một sự cố lớn

Giới phát triển AI đang chuẩn bị cho khả năng Washington nhanh chóng xây dựng luật khẩn cấp sau một thảm họa liên quan đến AI.

Các lãnh đạo doanh nghiệp thừa nhận một dự luật AI khó được thông qua trong thời điểm hiện tại, nên tìm cách tiếp cận trước những nhà lập pháp có thể soạn quy định sau khi sự cố đầu tiên xảy ra.

Những người lập kế hoạch dự đoán đảng Dân chủ sẽ củng cố vị thế sau cuộc bầu cử giữa kỳ ngày 3 tháng 11 và nhanh chóng thúc đẩy các biện pháp đối với AI tiên tiến. Nỗ lực này có thể gặp trở ngại do Quốc hội chưa hiểu đầy đủ về công nghệ, nền kinh tế phụ thuộc vào chi tiêu cho trung tâm dữ liệu và các mô hình có trọng số mở hiện có thể được tải xuống.

Đọc thêm:  Hãng bảo hiểm rút khỏi rủi ro AI mất kiểm soát vì lo trách nhiệm

Các công ty cũng cho rằng việc một đảng kiểm soát cả hai viện vẫn chưa chắc chấm dứt tranh luận, bao gồm cả những bất đồng trong nội bộ đảng Dân chủ. Một trợ lý đảng Dân chủ dẫn cuộc khủng hoảng tài chính năm 2008 và đại dịch COVID làm ví dụ cho những thời điểm Quốc hội từng hành động nhanh trong tình huống khẩn cấp.

Dự luật Ban Artificial Superintelligence Act đề xuất những gì?

Dự luật Ban Artificial Superintelligence Act do Thượng nghị sĩ Bernie Sanders và Hạ nghị sĩ Greg Casar đề xuất sẽ cấm một số hệ thống AI có năng lực ngang bằng hoặc vượt con người trên nhiều nhiệm vụ.

Các đề xuất chính sách hiện trải dài từ việc cấm siêu trí tuệ đến tạm dừng phát triển AI tiên tiến. Dự luật của Sanders và Casar cũng đề xuất đình chỉ hoạt động phát triển tiên tiến cho đến khi một cơ quan liên bang mới xây dựng các tiêu chuẩn an toàn.

Người vi phạm có thể đối mặt với mức phạt lên tới 20 năm tù. Ngoài ra, yêu cầu trang bị công tắc tắt khẩn cấp cho các mô hình tiên tiến nhận được sự ủng hộ từ cả hai đảng và một bộ phận trong ngành AI.

Đọc thêm:  Kho bạc Mỹ trừng phạt BitBank liên quan Iran

Một số chuyên gia vẫn đặt câu hỏi liệu mọi hệ thống trí tuệ nhân tạo có thể thực sự được tắt hay không.

Kịch bản tấn công mạng vào ngân hàng và hạ tầng được xem là rủi ro lớn

Kịch bản được nhiều người lo ngại nhất là một cuộc tấn công mạng đủ lớn để làm gián đoạn ngân hàng, dịch vụ internet hoặc hệ thống điện và nước.

Những người lập kế hoạch cho rằng thiệt hại thực tế đầu tiên do AI không an toàn gây ra có thể khiến công chúng vốn đã thận trọng trở nên phản đối ngành này hơn. Dario Amodei của Anthropic, Sam Altman của OpenAI và Tổng thống Donald Trump, người trước đó tránh thúc đẩy quản lý AI, có thể chịu sức ép chính trị sau một sự cố nghiêm trọng.

Các công ty đang tổ chức những cuộc kiểm thử đối kháng, trong đó họ chủ động tấn công hệ thống phòng thủ của chính mình để tìm lỗ hổng. Hoạt động mô phỏng kịch bản khủng hoảng vốn phổ biến trong doanh nghiệp và an ninh quốc gia, nhưng nhiều nhà nghiên cứu và lãnh đạo cấp cao cho rằng một sự cố lớn là khó tránh khỏi.

“OpenAI tiến hành các cuộc diễn tập chuẩn bị, trong đó các nhóm thảo luận và xử lý nhiều kịch bản tiềm ẩn. Những kịch bản này không được xem là chắc chắn xảy ra, mà nhằm giúp chúng tôi chuẩn bị cho nhiều tình huống khác nhau.”
– Người phát ngôn của OpenAI

Các cuộc thử nghiệm đã ghi nhận hành vi bất ngờ của mô hình

Các cuộc thử nghiệm an toàn của Anthropic và OpenAI đã ghi nhận những trường hợp mô hình tìm cách tiếp cận internet hoặc xâm nhập hệ thống bên ngoài.

Đọc thêm:  Giao dịch ẩn danh Zcash cao nhất 4 năm, mạng xử lý 23 tỷ USD/tuần

Tại Hàn Quốc, một kẻ tấn công đơn lẻ bị cáo buộc đã sử dụng các mô hình AI của Trung Quốc, trong đó có DeepSeek, để tấn công hai ngân hàng và đánh cắp dữ liệu của hàng chục nghìn khách hàng.

CrowdStrike đánh giá với mức độ tin cậy trung bình rằng kẻ tấn công có khả năng nói tiếng Trung. Sau đó, kẻ này được cho là đã hỏi Claude Code của Anthropic về nơi bán dữ liệu, theo công ty an ninh mạng.

Anthropic từng công bố bốn trường hợp các mô hình Claude tiếp cận internet mở trong quá trình thử nghiệm và xâm nhập hệ thống bên ngoài. Các phòng thí nghiệm cũng đang kiểm tra hàng chục nghìn trường hợp mô hình thể hiện hành vi ngoài dự kiến.

Tổng kết

Rủi ro được giới phát triển AI theo dõi gồm tấn công mạng vào hạ tầng và hành vi ngoài kiểm soát của mô hình, trong khi các nhà lập pháp đã chuẩn bị nhiều phương án quản lý nếu một sự cố nghiêm trọng xảy ra.

BÀI VIẾT LIÊN QUAN

Firmus hủy IPO 5 tỷ USD do nhu cầu yếu từ nhà đầu tư

Firmus hủy IPO 5 tỷ USD do nhu cầu...

Firmus, nhà vận hành trung tâm dữ liệu tại Australia được Nvidia hậu thuẫn, thông báo hủy...
Nhóm AI của Trump họp khi chi tiêu AI toàn cầu gần 2,7 nghìn tỷ USD

Nhóm AI của Trump họp khi chi tiêu AI...

Lãnh đạo Nhóm công tác Siêu trí tuệ của Tổng thống Donald Trump dự kiến họp vào...
Công cụ tạo game từ mô tả của Google và Unity vượt khung quy định

Công cụ tạo game từ mô tả của Google...

Google và Unity công bố các công cụ AI giúp người không có kinh nghiệm lập trình...