Vitalik chỉ trích tiêu chuẩn kép trong quản lý an toàn AI

Vitalik Buterin cảnh báo “an toàn AI” đang bị các công ty và chính phủ tận dụng như một công cụ thiết lập luật chơi theo lợi ích của bên mạnh nhất.

Trên X, đồng sáng lập Ethereum cho rằng việc một số phòng thí nghiệm AI tự quyết định tiêu chuẩn “an toàn” có thể dẫn đến độc quyền, làm suy yếu tính bền vững của quy định và khiến thế giới nguy hiểm hơn nếu bị trộn lẫn với tham vọng quyền lực quốc gia.

NỘI DUNG CHÍNH
  • Vitalik Buterin lo ngại “an toàn AI” bị diễn giải theo hướng phục vụ lợi ích doanh nghiệp và chủ quyền quốc gia.
  • Ông cho rằng các rào chắn kiểu “chặn việc xấu” trong mô hình AI mong manh vì dễ bị jailbreak hoặc fine-tune.
  • Vitalik ủng hộ d/acc: phát triển và mã nguồn mở các “lá chắn” trước, và đã phân bổ 40 triệu USD cho phần cứng an toàn, phòng thủ sinh học, an ninh mạng.

“An toàn AI” có thể bị biến thành công cụ thống trị toàn cầu

Vitalik Buterin cho rằng khi một vài công ty lớn hoặc lợi ích quốc gia chi phối khái niệm “an toàn AI”, các quy tắc có nguy cơ được viết bởi bên mạnh nhất thay vì dựa trên đồng thuận và kiểm chứng.

Trên X, ông nêu lo ngại rằng các doanh nghiệp AI hàng đầu không nên đóng vai “trọng tài” quyết định biện pháp nào là phù hợp, vì điều đó có thể dẫn đến cơ chế quản trị nơi sức mạnh thị trường và ảnh hưởng chính trị quyết định chuẩn mực.

Ông lấy ví dụ Anthropic từng được khen vì không cho phép cơ quan nhà nước hoặc tổ chức chính phủ dùng mô hình Claude cho giám sát hàng loạt hay vũ khí hoàn toàn tự động. Tuy nhiên, công ty cũng hủy “cam kết tạm dừng khi rủi ro” vốn yêu cầu ngừng vô điều kiện việc huấn luyện và triển khai nếu năng lực mô hình vượt quá khả năng chứng minh an toàn.

Đọc thêm:  SEC yêu cầu công ty đầu tư chứng minh quyền sở hữu cổ phiếu startup nóng 马会

Vitalik chỉ ra rằng Anthropic từng chỉ trích đối thủ vì học từ đầu ra của Claude, nhưng vấp phải phản ứng mạnh, đặc biệt từ các ý kiến tại Trung Quốc, cho rằng chính Claude cũng được huấn luyện từ kho tri thức công khai khổng lồ trên internet.

Vấn đề cốt lõi, theo Vitalik, là: nếu các đối thủ mã nguồn mở bị coi là “thiếu rào chắn”, vì sao một công ty lại có quyền quyết định “rào chắn an toàn” nào là đúng? Ông nói điều này gợi ra một hệ thống nơi “luật lệ được tạo ra bởi kẻ mạnh”.

Vitalik cảnh báo nếu “an toàn AI” trở nên khó phân biệt với tư duy “công ty của chúng ta/quốc gia của chúng ta xứng đáng điều hành thế giới”, kết quả có thể là một trật tự nguy hiểm hơn. Ông cũng cho rằng nếu quy định an toàn rốt cuộc luôn miễn trừ cho các tổ chức an ninh quốc gia, các quy định đó sẽ trở nên mong manh.

Siết chặt AI theo kiểu “chặn cái xấu” có thể phản tác dụng

Vitalik Buterin đánh giá các hạn chế kiểu buộc mô hình AI từ chối “việc xấu” là mong manh vì có thể bị vượt qua bằng jailbreak hoặc fine-tune, và có nguy cơ trở thành lý do để cấm AI mã nguồn mở nhằm duy trì độc quyền “phe tốt”.

Ông nhắc lại bối cảnh: trước đây Vitalik là một trong những nhà tài trợ lớn của Future of Life Institute (FLI). Năm 2021, ông nhận được lượng lớn token Shiba Inu (SHIB) từ đội ngũ dự án; khi “bong bóng dog coin” đạt đỉnh, giá trị sổ sách vượt 1 tỷ USD. Ông đã gấp rút quyên góp trước khi sự quan tâm suy giảm và chuyển khoảng 500 triệu USD SHIB cho FLI.

Đọc thêm:  Kraken giúp phiếu giảm lạm phát Solana vượt ngưỡng 2/3

Thời điểm đó, FLI tập trung vào các rủi ro như đe dọa sinh học và chiến tranh hạt nhân. Nhưng Vitalik cho biết tổ chức này về sau chuyển hướng sang hành động chính trị và vận động hành lang mạnh hơn, thường thúc đẩy các quy định khiến ông lo ngại, đặc biệt là cách tiếp cận “gắn rào chắn” vào mô hình để từ chối những thứ bị coi là “xấu”.

Vitalik xem các hạn chế này như giải pháp dễ vỡ vì có thể bị vô hiệu hóa tương đối dễ dàng. Nguy hiểm hơn, ông sợ chúng mở đường cho một kịch bản đen tối: cấm mã nguồn mở để bảo vệ độc quyền của một nhóm được xem là “người tốt”.

d/acc là cách Vitalik đề xuất để giảm rủi ro công nghệ nguy hiểm

Vitalik ủng hộ “defensive accelerationism” (d/acc): thay vì chỉ hạn chế, cần tăng tốc xây dựng các lớp phòng thủ và mã nguồn mở chúng trước để giảm động cơ lạm dụng và nâng mức an toàn thực tế.

Theo ông, triết lý d/acc cho rằng cách ứng phó tốt nhất với công nghệ nguy hiểm là phát triển “lá chắn” trước và công khai để nhiều bên có thể kiểm tra, triển khai và cải tiến, thay vì phụ thuộc vào lời hứa tự điều chỉnh của một nhóm nhỏ.

Đọc thêm:  Lỗ hổng Symbiosis phơi bày rủi ro cầu nối Bitcoin, không ảnh hưởng Bitcoin

Vitalik cho biết ông đã phân bổ 40 triệu USD cho các dự án như phần cứng an toàn, phòng thủ sinh học và an ninh mạng nhằm hỗ trợ hệ tư tưởng này. Ông mô tả phần cứng an toàn hướng tới chip khó bị xâm nhập để không thể bị dùng cho giám sát diện rộng.

Với phòng thủ sinh học, ông đề cập các hướng như lọc không khí tiên tiến và xét nghiệm PCR thụ động để phát hiện sớm và chặn đại dịch. Ở mảng an ninh mạng, mục tiêu là tăng khả năng kiểm chứng phần mềm để các cuộc tấn công do AI hỗ trợ không dễ làm tê liệt hạ tầng trọng yếu.

Những câu hỏi thường gặp

Vitalik Buterin lo ngại điều gì về khái niệm “an toàn AI”?

Ông lo “an toàn AI” bị các công ty lớn và lợi ích quốc gia chiếm dụng để đặt ra luật chơi có lợi cho họ, tạo ra hệ thống nơi bên mạnh nhất quyết định tiêu chuẩn và làm thế giới nguy hiểm hơn.

Tại sao Vitalik cho rằng các rào chắn kiểu “chặn việc xấu” trong AI là mong manh?

Vì chúng có thể bị vượt qua bằng jailbreak hoặc fine-tune, nên không phải biện pháp phòng vệ bền vững. Ông cũng lo cách tiếp cận này bị dùng để biện minh cho việc hạn chế hoặc cấm AI mã nguồn mở.

d/acc là gì theo quan điểm của Vitalik?

d/acc (defensive accelerationism) là cách tiếp cận tăng tốc xây dựng các lớp phòng thủ và mã nguồn mở “lá chắn” trước, như phần cứng an toàn, phòng thủ sinh học và an ninh mạng, nhằm giảm rủi ro từ công nghệ nguy hiểm.

BÀI VIẾT LIÊN QUAN

Thượng nghị sĩ Cộng hòa Mỹ chất vấn các thương vụ crypto của Tổng thống Mỹ

Thượng nghị sĩ Cộng hòa Mỹ chất vấn các...

Thượng nghị sĩ John Curtis đề nghị điều tra hoạt động kinh doanh của Donald Trump Jr....
Spaces ra mắt Trust Anchor xác thực danh tính Bitcoin không tập trung

Spaces ra mắt Trust Anchor xác thực danh tính...

Spaces đã ra mắt Trust Anchor, công cụ cho phép ứng dụng xác minh định danh dễ...
California thông qua 7 luật định hình lại AI compute

California thông qua 7 luật định hình lại AI...

Thống đốc California Gavin Newsom đã ký gói 7 đạo luật siết yêu cầu báo cáo về...