Sau Anthropic, đến lượt 2 kỹ sư của Google DeepMind nghỉ việc để cảnh báo AI: Chuyện gì đang xảy ra?

Admin

Cả 2 kỹ sư này đều làm việc trong nhóm an toàn AGI của Google DeepMind và đều lần lượt nghỉ việc để cảnh báo mọi người về sự nguy hiểm của AI đối với nhân loại.

Hai người từng làm việc về an toàn và căn chỉnh AGI tại Google DeepMind lần lượt rời công ty, công khai cảnh báo rằng AI có thể gây ra những hậu quả nghiêm trọng đối với nhân loại. Đáng chú ý, động thái này diễn ra chỉ ít ngày sau khi một cựu nghiên cứu viên Anthropic nghỉ việc và cảnh báo AI có thể giết toàn bộ con người vào cuối thập kỷ.

Làn sóng cảnh báo từ bên trong các phòng thí nghiệm AI hàng đầu đang ngày càng trở nên đáng chú ý.

Josh Engels, người từng làm việc trong nhóm an toàn AGI của Google DeepMind, rời công ty khoảng 3 tuần trước và gia nhập METR, một tổ chức chuyên đánh giá các hệ thống AI. Engels cho biết anh từng rất yêu thích công việc tại DeepMind, thậm chí đã từ chối lời mời từ Anthropic và OpenAI.

Sau Anthropic, đến lượt 2 kỹ sư của Google DeepMind nghỉ việc để cảnh báo AI: Chuyện gì đang xảy ra?- Ảnh 1.

Bài đăng trên X của Josh Engels

Tuy nhiên, anh vẫn quyết định rời đi vì cho rằng rủi ro từ AI đã trở nên quá lớn.

Trên X, Engels viết rằng anh cho rằng có một khả năng “đáng sợ” các hệ thống AI sẽ gây ra “tổn hại khủng khiếp” trong 5 năm tới. Anh thừa nhận không biết chính xác xác suất là bao nhiêu, nhưng cho rằng mức độ rủi ro đã đủ cao để an toàn AI trở thành “vấn đề quan trọng nhất trên thế giới”.

Mối lo lớn nhất của Engels nằm ở một khái niệm mà giới nghiên cứu AI gọi là tự cải thiện đệ quy. Khi một hệ thống AI có khả năng thiết kế hoặc cải thiện một hệ thống AI khác, hệ thống mới lại có thể trở nên giỏi hơn trong việc cải thiện AI. Quá trình này có thể tạo thành một vòng lặp, khiến năng lực của AI tăng nhanh.

Engels lo ngại điều gì sẽ xảy ra nếu một hệ thống như vậy không được căn chỉnh đúng với mục tiêu của con người.

Theo anh, các công ty AI hiện đều đang hướng tới việc xây dựng những hệ thống siêu trí tuệ, có khả năng vượt xa con người trên nhiều nhiệm vụ. Nhưng giới nghiên cứu vẫn chưa biết làm thế nào để bảo đảm những hệ thống này đủ an toàn trước khi cho phép chúng tự cải thiện.

Sau Anthropic, đến lượt 2 kỹ sư của Google DeepMind nghỉ việc để cảnh báo AI: Chuyện gì đang xảy ra?- Ảnh 2.

Bilal Chughtai (trái) và Josh Engels (phải), hai kỹ sư của Google DeepMind mới nghỉ việc để cảnh báo về mức độ nguy hiểm của AI

Đáng chú ý, Engels không kêu gọi ngành AI dừng phát triển hoàn toàn. Anh muốn tốc độ phát triển chậm lại đủ để nghiên cứu an toàn có thể bắt kịp năng lực của các mô hình.

Sau khi gia nhập METR, Engels sẽ nghiên cứu nguồn gốc của hiện tượng AI không tuân thủ mục tiêu con người, kiểm tra hiệu quả của các biện pháp an toàn hiện tại và đánh giá liệu giới nghiên cứu có đang đi đúng hướng để giải quyết bài toán căn chỉnh AI hay không.

Nhưng Engels không phải người duy nhất rời Google DeepMind để lên tiếng.

Bilal Chughtai, một cựu nghiên cứu viên từng làm việc về an toàn AGI và căn chỉnh AI tại Google DeepMind, cũng đã nghỉ việc vào tháng 7/2026. Chughtai từng là research engineer và đồng tác giả của một số công trình nghiên cứu khi làm việc tại DeepMind.

Trong một bài đăng, Chughtai nói anh “thực sự tin rằng AI có tiềm năng giết tất cả chúng ta” và con người có thể đang dần hết thời gian để tránh kịch bản này.

Chughtai đặc biệt lo ngại về tốc độ tiến bộ của AI kể từ khi anh bước vào lĩnh vực này vào đầu năm 2022. Anh dẫn ra khả năng của các tác nhân AI trong việc giải quyết những bài toán toán học khó và một sự cố trong đó các tác nhân của OpenAI được cho là đã thoát khỏi kiểm soát và xâm nhập Hugging Face.

Sau Anthropic, đến lượt 2 kỹ sư của Google DeepMind nghỉ việc để cảnh báo AI: Chuyện gì đang xảy ra?- Ảnh 3.

Theo Chughtai, vấn đề cốt lõi vẫn là căn chỉnh AI, tức bảo đảm các hệ thống ngày càng mạnh có thể thực hiện đúng mục tiêu mà con người mong muốn. Anh cho rằng hiểu biết hiện tại về cách huấn luyện những hệ thống “thực sự muốn điều chúng ta muốn” vẫn còn rất sơ khai, trong khi năng lực AI đang tiến bộ nhanh hơn nghiên cứu về căn chỉnh.

Dù vậy, Chughtai cũng cho rằng kết cục nguy hiểm không phải điều đã được định trước. Anh kêu gọi các công ty AI phối hợp để chấm dứt “cuộc đua điên cuồng” và đưa tốc độ phát triển về mức mà xã hội có thể kiểm soát.

Hai trường hợp tại Google DeepMind xuất hiện ngay sau một cảnh báo tương tự từ Anthropic.

Đầu tháng này, Jacob Coxon, một cựu nghiên cứu viên Anthropic từng làm việc tại OpenAI, đã nghỉ việc và cảnh báo rằng những người đang xây dựng AI nghiêm túc tin rằng công nghệ này có thể giết toàn bộ con người vào cuối thập kỷ. Evan Hubinger, lãnh đạo khoa học căn chỉnh của Anthropic, sau đó đồng tình với đánh giá này và cho rằng xác suất AI giết toàn nhân loại trong thập kỷ tới là trên 10%.

Những cảnh báo này xuất hiện trong lúc chính các lãnh đạo ngành AI cũng tranh luận về tốc độ phát triển công nghệ.

CEO Anthropic Dario Amodei đã kêu gọi ngành AI “đi chậm lại”, cho rằng AI có thể vượt qua khả năng hiểu và kiểm soát của con người. CEO Google DeepMind Demis Hassabis cũng ủng hộ hướng tiếp cận này, đồng thời thừa nhận AI đang tiến nhanh hơn khả năng của xã hội trong việc hiểu các rủi ro mà công nghệ mang lại.

Vì vậy, câu hỏi đáng chú ý lúc này không chỉ là AI sẽ mạnh đến đâu. Đó còn là liệu con người có thể xây dựng được những cơ chế an toàn đủ nhanh trước khi các hệ thống AI bước sang giai đoạn có khả năng tự cải thiện và vượt xa năng lực kiểm soát hiện tại hay không.