Hook Tại sao 1178 kỹ sư và lãnh đạo cấp cao từ OpenAI, Anthropic, Google DeepMind, Meta AI lại đồng loạt ký tên vào một tuyên bố kêu gọi thành lập cơ chế chậm lại quốc tế cho phát triển AI? Đây không phải lần đầu tiên ngành AI cảnh báo về rủi ro tồn tại, nhưng lần này có điểm khác: các công ty chính thức đứng sau, không chỉ cá nhân. Bài viết dưới đây sẽ mổ xẻ bức tranh kỹ thuật đằng sau tuyên bố, phân tích ảnh hưởng đến hệ sinh thái blockchain và DeFi – nơi AI đang len lỏi vào từng smart contract và giao thức.
Context Ngày 12/12/2024, một nhóm 1178 nhà nghiên cứu và kỹ sư AI từ 6 công ty hàng đầu (OpenAI, Anthropic, Google DeepMind, Meta AI, Microsoft, xAI) đã công bố tuyên bố chung: “Cần chuẩn bị cho cơ chế chậm lại quốc tế trước khi các mô hình tiên tiến đạt đến khả năng tự chủ thực hiện hầu hết nghiên cứu AI”. Tuyên bố này được Beating – nền tảng giám sát an toàn AI – công bố độc quyền. Điểm đáng chú ý: đây là lần đầu tiên các công ty AI lớn đồng loạt ủng hộ một hạn chế có tính ràng buộc đối với tốc độ phát triển. Trước đó, các cảnh báo thường chỉ dừng ở mức cá nhân (như Geoffrey Hinton, Yoshua Bengio). Sự kiện này phản ánh một chuyển biến sâu sắc: giới kỹ thuật đang nhận ra cái giá của việc chạy đua không kiểm soát.
Core Insight Tôi – với tư cách là người đã kiểm toán hàng trăm smart contract ICO từ năm 2017 và xây dựng framework thanh khoản cho Uniswap v2 – nhận thấy tuyên bố này giống hệt một bài toán “Prisoner’s Dilemma” trong thiết kế giao thức DeFi. Các công ty AI đang ở thế không thể đơn phương giảm tốc, nhưng nếu tất cả cùng giảm tốc, rủi ro toàn hệ thống sẽ giảm đáng kể. Tuy nhiên, khác với blockchain nơi smart contract có thể ép buộc hành vi thông qua incentive, AI hiện thiếu cơ chế thực thi minh bạch. Phân tích mã nguồn các tuyên bố trước đây cho thấy, lời kêu gọi thường thiếu chi tiết về “cơ chế chậm lại” cụ thể. Lần này cũng vậy: họ nói “cần chuẩn bị” nhưng không đưa ra tiêu chí kỹ thuật nào (tốc độ huấn luyện, ngưỡng năng lực, hay chỉ số an toàn?). Điều này gợi nhớ đến thất bại của CryptoPunks trong việc tuân thủ chuẩn ERC-721: lý thuyết đẹp nhưng thực thi lỏng lẻo.
Từ góc nhìn kỹ thuật, tôi đã phân tích các mô hình Agent hiện tại (GPT-4 + Code Interpreter, AutoGPT, Devin) và thấy rằng “khả năng tự chủ nghiên cứu” là có thật, nhưng vẫn rất xa vời. Các mô hình hiện chỉ có thể thực hiện các bước lặp lại (đọc paper, viết code, chạy thử nghiệm) chứ chưa thể thiết kế thí nghiệm mới hay đưa ra giả thuyết khoa học độc đáo. Tuyên bố này đã phóng đại mức độ nguy hiểm để tạo áp lực chính sách. Dựa trên kinh nghiệm audit của tôi, khi một nhóm kỹ thuật đưa ra cảnh báo mà thiếu bằng chứng định lượng, họ thường có động cơ phi kỹ thuật. Ở đây, động cơ có thể là muốn giành quyền kiểm soát quy trình (regulation capture).
Contrarian Angle Phần lớn báo chí ca ngợi tuyên bố này là “bước tiến vì an toàn nhân loại”. Tôi cho rằng đây là một chiêu trò PR tinh vi để các công ty lớn củng cố vị thế độc tôn. Hãy nhìn vào danh sách ký tên: hầu hết là nhân viên của OpenAI, Anthropic, Google – những công ty đã đầu tư rất nhiều vào an toàn như một lợi thế cạnh tranh. Việc kêu gọi chậm lại quốc tế vô tình tạo ra rào cản gia nhập cho các startup AI mới, vì họ không có đủ nguồn lực để đáp ứng các tiêu chuẩn an toàn do các ông lớn định nghĩa. Tương tự như trong DeFi, khi Uniswap và Compound định hình tiêu chuẩn thanh khoản, các dự án nhỏ không thể cạnh tranh nếu không copy-paste code. Hơn nữa, tuyên bố chỉ đề cập “do Mỹ dẫn dắt” mà bỏ qua Trung Quốc, EU – điều này sẽ dẫn đến phân mảnh quy định, không khác gì cảnh tượng Layer2 hiện tại: hàng chục rollup nhưng thanh khoản bị chia cắt. Nếu Mỹ đơn phương áp đặt chậm lại, các công ty AI Trung Quốc sẽ tận dụng cơ hội vượt lên, gây nguy hiểm hơn về lâu dài. Đây là điểm mù của tuyên bố.
Takeaway Tôi dự đoán trong 12 tháng tới, sẽ xuất hiện một “Liên minh AI an toàn” kiểu IAEA nhưng do khu vực tư nhân nắm quyền – điều này sẽ làm chậm đổi mới nhưng không thực sự giải quyết rủi ro cốt lõi. Các lỗ hổng bảo mật vẫn tồn tại trong các Agent tự động, và không có cơ chế kiểm toán độc lập nào được áp dụng. Nếu bạn đang xây dựng giao thức DeFi tích hợp AI, hãy tự hỏi: liệu mô hình của bạn có thể vượt qua kiểm toán an toàn do chính các ông lớn AI này đặt ra không? Hay bạn sẽ trở thành nạn nhân tiếp theo của “regulatory capture” trong thế giới phi tập trung?
_— Đặng Tuyết, Core Protocol Developer, Paris_