Anthropic gỡ bỏ hạn chế ẩn của Claude Fable 5

Anthropic đã rút lại chính sách bị chỉ trích vì âm thầm làm giảm hiệu năng của Claude Fable 5 với một số truy vấn liên quan đến nghiên cứu AI.

Vụ việc cho thấy căng thẳng ngày càng rõ giữa nhu cầu bảo vệ lợi thế cạnh tranh của các phòng lab AI và kỳ vọng về một môi trường nghiên cứu minh bạch hơn. Nó cũng xuất hiện đúng lúc Anthropic đang ở giai đoạn nhạy cảm trước kế hoạch IPO.

NỘI DUNG CHÍNH
  • Anthropic từng đặt cơ chế hạn chế kín đối với Claude Fable 5 khi gặp truy vấn về nghiên cứu AI.
  • Các nhà nghiên cứu lo ngại cách làm này có thể làm chậm kiểm định độc lập và thu hẹp khả năng tiếp cận công cụ tiên tiến.
  • Tranh cãi nổ ra ngay trước giai đoạn IPO, khi niềm tin từ khách hàng doanh nghiệp và cộng đồng nghiên cứu trở nên quan trọng hơn.

Anthropic đã thay đổi gì trên Claude Fable 5?

Anthropic là đã công bố bốn nhóm bảo vệ cho Claude Fable 5, nhưng một trong số đó âm thầm làm giảm chất lượng phản hồi khi hệ thống phát hiện truy vấn về AI mới nổi. Với ba nhóm còn lại, mô hình sẽ từ chối hoặc chuyển người dùng sang Claude Opus 4.8 kèm cảnh báo.

Đọc thêm:  Robinhood Chain đạt kỷ lục với 874,8 triệu USD khối lượng DEX/ngày

Điểm gây tranh cãi nằm ở chỗ người dùng không được thông báo khi hiệu năng bị hạ xuống. Theo hệ thống tài liệu kỹ thuật của Anthropic, cơ chế này chỉ có xác suất kích hoạt khoảng 0,03%, nhưng chính nguyên tắc vận hành kín mới là điều khiến giới nghiên cứu phản ứng mạnh.

Vì sao cộng đồng AI phản đối quyết liệt?

Claude Fable 5 là bị xem như một bước lùi đối với nghiên cứu AI độc lập vì cách hạn chế kín có thể làm sai lệch quá trình kiểm định mô hình. Các nhà nghiên cứu lo ngại doanh nghiệp phát triển mô hình tiên tiến có thể tự dùng bản không bị hạn chế, trong khi bên ngoài lại phải làm việc với dữ liệu kém chính xác hơn.

Will Brown của Prime Intellect cho rằng cách làm này giống như “kéo thang lên sau lưng mình”. Nathan Lambert cũng chỉ trích trên X rằng chính sách đó khiến Anthropic bị nhìn nhận là đi ngược khoa học. Jeremy Howard và cựu nhân sự Anthropic Behnam Neyshabur đều cho rằng việc hạn chế như vậy có thể làm chậm tiến bộ khoa học và công nghệ.

Đọc thêm:  Ngân hàng OpenAI và Anthropic chạy đua lấy xếp hạng tín nhiệm cao để mở thị trường trái phiếu

Tác động nào có thể xảy ra với IPO của Anthropic?

Anthropic là đang ở giai đoạn nhạy cảm vì đã nộp hồ sơ IPO bí mật vào ngày 1/6 với mức định giá ngụ ý 965 tỷ USD. Trong bối cảnh đó, niềm tin từ khách hàng doanh nghiệp và cộng đồng nghiên cứu có ý nghĩa trực tiếp với định giá và hình ảnh của công ty.

Vụ tranh cãi này còn xuất hiện cùng lúc với các phàn nàn khác về Fable 5, gồm bộ lọc sinh học quá chặt và chính sách lưu giữ dữ liệu mới. Microsoft cũng được nhắc đến như một đơn vị đã hạn chế nhân viên dùng mô hình này vì lo ngại về lưu giữ dữ liệu.

Anthropic nói gì sau khi rút lại chính sách?

Anthropic đã thừa nhận đây là một đánh đổi sai và cho biết sẽ làm cho các biện pháp bảo vệ hiển thị rõ hơn. Khi hệ thống xác định người dùng đang làm nghiên cứu AI tiên phong, nó có thể từ chối yêu cầu hoặc chuyển sang mô hình khác và thông báo cho người dùng.

Công ty cũng thừa nhận việc công khai cơ chế sẽ khiến nó phải được áp dụng rộng hơn, đồng nghĩa có thể chặn thêm các truy vấn vô hại. Anthropic nói đang cải thiện độ chính xác của bộ phân loại, nhưng bài toán lớn hơn vẫn là cách các phòng lab AI cân bằng giữa bảo vệ mô hình và giữ được tính mở của nghiên cứu.

Đọc thêm:  DeFiLlama ghi nhận lợi nhuận crypto tháng 8 suy yếu khi lợi suất tăng

Tổng kết

Anthropic đã lùi bước trước chỉ trích về việc âm thầm hạn chế Claude Fable 5, nhưng tranh cãi quanh mức độ minh bạch của các mô hình AI tiên tiến vẫn chưa khép lại, nhất là khi công ty đang bước vào giai đoạn nhạy cảm trước IPO.

BÀI VIẾT LIÊN QUAN

OpenAI mở rộng rà soát tác nhân AI sau tương tác với website chính phủ Mỹ

OpenAI mở rộng rà soát tác nhân AI sau...

OpenAI đang thông báo cho một số cơ quan chính phủ Mỹ và tổ chức khác sau...
Circle và Tether đóng băng 318.000 USD liên quan vụ hack Bitget

Circle và Tether đóng băng 318.000 USD liên quan...

Circle và Tether đã đóng băng khoảng 318.000 USD stablecoin liên quan đến vụ tấn công Bitget,...
CEO Bitget liên hệ vụ hack sàn 351 triệu USD với tin tặc Triều Tiên

CEO Bitget liên hệ vụ hack sàn 351 triệu...

Bitget nghi ngờ nhóm tin tặc có liên hệ với Triều Tiên đứng sau vụ...