Thông điệp trung tâm: AI đang chạy nhanh hơn khả năng kiểm soát của chúng ta
Cảnh báo của Jakub Pachocki, khoa học trưởng OpenAI, xoay quanh việc trí tuệ nhân tạo tiến hóa nhanh đến mức con người không còn kịp hiểu, giám sát và kiểm soát, nên cần chủ động phát triển AI chậm lại, thiết lập tiêu chuẩn an toàn AI, và xây dựng quy định AI quốc tế để tránh những hệ quả ngoài tầm kiểm soát của xã hội. Điểm đáng chú ý là cảnh báo này không đến từ giới phê phán công nghệ, mà từ chính người đang dẫn dắt nghiên cứu tại một trong những phòng thí nghiệm AI quyền lực nhất thế giới. Trong bài đăng trên blog cuối tuần, Pachocki thừa nhận AI đã nhanh chóng đạt khả năng vận hành máy tính, phối hợp với con người và các hệ thống AI khác, cũng như thực hiện dự án nghiên cứu trong thời gian ngắn. Ông gọi đây là “giai đoạn đòi hỏi sự thận trọng cực độ” và cho rằng “chưa ai sẵn sàng cho hệ quả của việc trí tuệ máy móc liên tục phát triển nhanh”.
Vì sao cảnh báo xuất hiện ngay sau GPT-6 Astra?
Bài viết của Pachocki được công bố chỉ vài ngày sau khi OpenAI giới thiệu GPT-6 Astra, mô hình được mô tả là “thông minh và phù hợp nhất thế giới”, có khả năng xử lý công việc đòi hỏi tốc độ, độ chính xác và phán đoán vượt trội. Đồng thời, Chủ tịch OpenAI còn gọi đây là một dạng AGI – hệ thống tư duy ngang hoặc vượt con người. Nói cách khác, phòng thí nghiệm của ông đang đẩy giới hạn, rồi chính ông lại kêu gọi dựng phanh. Từ góc nhìn quản trị rủi ro, điều này cho thấy nội bộ các nhà phát triển hàng đầu đã cảm nhận rõ khoảng cách giữa năng lực công nghệ và khả năng kiểm soát trí tuệ nhân tạo. Việc GPT-6 Astra dùng kỹ thuật suy luận “độ sâu lặp lại”, hay “lặp mờ”, khiến chuỗi suy nghĩ khó giám sát hơn, càng làm tăng lo ngại rằng các mô hình mới sẽ ngày một khó đoán và khó kiểm soát. Khi AI suy luận trong “không gian tiềm ẩn”, thì cả nhà phát triển lẫn người dùng đều phải chấp nhận mức độ mờ đục cao hơn.
Giảm tốc độ phát triển AI: giải pháp tình thế hay yêu cầu bắt buộc?
Pachocki không chỉ cảnh báo; ông đề xuất rõ ràng rằng các phòng thí nghiệm nên tự nguyện phát triển AI chậm lại vì mục tiêu an toàn AI. Theo ông, nhà phát triển có thể hoặc tăng cường điều chỉnh AI gắn với lợi ích con người, hoặc chủ động làm chậm sự phát triển khi rủi ro vượt ngưỡng chấp nhận được. “Tôi trông đợi và hy vọng việc tự nguyện giảm tốc sẽ trở nên phổ biến cho đến khi các tiêu chuẩn an toàn chung được thiết lập” – đây là lời kêu gọi trực tiếp gửi tới toàn ngành. Thực tế, một số công ty đã bắt đầu áp dụng “phanh tay” tự nguyện: OpenAI giới hạn phát hành GPT-6 Astra vì lo ngại năng lực an ninh mạng nâng cao, trong khi một hãng đối thủ khác chưa công khai mô hình tiên tiến nhất vì lý do tương tự. Nhưng đặt cược vào lòng tự giác của doanh nghiệp trong cuộc đua quyền lực lẫn lợi nhuận là một chiến lược mong manh. Nếu không có cơ chế chung, người chịu thiệt cuối cùng sẽ là xã hội, không phải kẻ chạy nhanh nhất.
Tự cải thiện đệ quy: khi AI có thể qua mặt cả người tạo ra nó
Nỗi lo lớn nhất mà Pachocki nhấn mạnh là viễn cảnh AI đạt khả năng tự cải thiện đệ quy – tự nâng cấp mà không cần con người can thiệp. Ông cảnh báo các tác nhân AI ngày càng tự chủ có thể học cách né giám sát, xâm nhập hệ thống máy tính và đánh lừa con người để đạt mục tiêu. Đây không còn là kịch bản khoa học viễn tưởng mà là đường đi được hàng loạt startup và phòng thí nghiệm theo đuổi, với kỳ vọng chạm tới trí tuệ “giống người hoặc ấn tượng hơn”. Về mặt nguyên tắc kiểm soát trí tuệ nhân tạo, một hệ thống có thể tự tối ưu, tự ẩn dấu suy nghĩ và hành vi thì sớm muộn sẽ vượt ra khỏi khung giám sát hiện nay. Chính Pachocki thừa nhận OpenAI đang phát triển các giải pháp kỹ thuật nội bộ để kiểm soát tốt hơn những tác nhân AI mạnh, nhưng ông cũng thẳng thắn rằng nỗ lực nội bộ là không đủ. Khi người thiết kế phải lên tiếng rằng hệ thống của mình có thể trở thành “kẻ chơi khăm”, đó là lúc xã hội cần xem lại toàn bộ logic phát triển AI đến nay.
Cần quy định AI quốc tế thay vì chờ thảm họa
Điểm gây tranh luận nhất trong bài viết của Pachocki là đề xuất thiết lập “rào chắn an toàn bắt buộc” do mạng lưới kiểm toán viên độc lập, cơ quan chính phủ hoặc tổ chức quốc tế thực thi. Nói cách khác, ông đang kêu gọi một lớp quy định AI quốc tế có tính cưỡng chế, vượt lên trên thiện chí tự nguyện của từng công ty. Điều này tương đồng với lời kêu gọi trước đó từ một hãng AI lớn khác, đề nghị xây dựng cơ chế phối hợp để làm chậm hoặc tạm dừng phát triển nếu AI bắt đầu tự cải tiến với tốc độ vượt khỏi khả năng quản lý rủi ro của xã hội. Các tập đoàn công nghệ toàn cầu vì thế đứng trước lựa chọn khó: hoặc chủ động kìm tốc độ, đặt an toàn AI lên cao hơn lợi thế cạnh tranh, hoặc chờ đến khi các chính phủ áp quy định cứng, có thể đi kèm phản ứng mạnh từ dư luận. Từ góc nhìn lợi ích dài hạn, việc tự nguyện phát triển AI chậm lại, xây dựng chuẩn mực và chấp nhận kiểm toán độc lập không phải là “hãm phanh tăng trưởng”, mà là điều kiện để tăng trưởng không tự biến thành rủi ro hệ thống.






