Một cuộc điều tra chuyên sâu dài kỳ vừa được The Wall Street Journal công bố đã hé lộ những góc khuất trong cuộc nội chiến tư tưởng dữ dội nhất lịch sử Thung lũng Silicon: cuộc đụng độ giữa phong trào các nhà cảnh báo ngày tận thế (Doomers) và phe những người lạc quan công nghệ. Khởi nguồn từ triết lý Chủ nghĩa vị tha hiệu quả (Effective Altruism), nỗi ám ảnh về rủi ro sinh tồn (existential risk hay X-risk) – nơi trí tuệ nhân tạo có thể dẫn đến sự diệt vong của loài người – đã vượt ra khỏi các diễn đàn học thuật để trở thành kim chỉ nam chi phối hàng tỷ USD dòng vốn đầu tư và định hình văn hóa quản trị tại các công ty AI hàng đầu như Anthropic và OpenAI. Câu châm ngôn “Thời kỳ yên ả sẽ không bao giờ quay lại” (Things will never be chill again) đang biến các phòng thí nghiệm AI từ những trung tâm sáng tạo thuần túy thành những pháo đài phòng thủ công nghệ cao với các quy trình thẩm định an toàn khắt khe đến nghẹt thở.
Nguồn gốc phong trào Doomer và sự trỗi dậy của triết lý Effective Altruism
Phong trào Doomer không hình thành từ nỗi sợ hãi mơ hồ của công chúng, mà bắt rễ sâu sắc từ mạng lưới các nhà toán học, triết học và kỹ sư phần mềm theo đuổi trường phái Effective Altruism. Họ nhìn nhận sự phát triển thần tốc của AI biên giới như một bài toán xác suất thảm họa, đo lường bằng chỉ số P(doom) – tức xác suất AI tiêu diệt hoặc tước đoạt quyền tự quyết của nền văn minh nhân loại.
Tư tưởng này chính là nguyên nhân trực tiếp dẫn tới sự ra đời của Anthropic:
- Sự ly khai khỏi OpenAI: Năm 2021, nhóm cựu lãnh đạo và nhà nghiên cứu an toàn do Dario Amodei và Daniela Amodei dẫn đầu đã rời bỏ OpenAI do bất đồng quan điểm về tốc độ thương mại hóa, lập nên Anthropic với mục tiêu duy nhất: xây dựng các hệ thống AI an toàn có thể kiểm chứng được.
- Mô hình Claude và nguyên lý Constitutional AI: Thay vì để AI tự học hành vi tự do, Anthropic xây dựng dòng mô hình Claude dựa trên bộ khung “Hiến pháp kỹ thuật số”, kiểm duyệt mọi câu trả lời qua các nguyên tắc nhân bản và an toàn nghiêm ngặt.
- Văn hóa phòng thủ tuyệt đối: Tại các doanh nghiệp này, các nhà nghiên cứu an toàn AI nắm quyền phủ quyết kỹ thuật, sẵn sàng làm chậm ngày phát hành sản phẩm để chạy hàng nghìn kịch bản kiểm thử độc tố (toxicity) và khả năng tự nhân bản của mô hình.
Cuộc đối đầu giữa phe Doomer và nhóm ‘Lạc quan khải huyền’ (Cheerful Apocalyptics)
Ở bên kia chiến tuyến, một làn sóng phản kháng mạnh mẽ đang trỗi dậy từ những nhà sáng lập và quỹ đầu tư mạo hiểm hàng đầu, được WSJ định danh là nhóm “Cheerful Apocalyptics” (những người lạc quan trước biến động lớn). Phe này lập luận rằng lịch sử loài người luôn đồng hành cùng các cuộc cách mạng công nghệ gây xáo trộn, và việc áp đặt các rào cản hành chính thái quá lên AI sẽ bóp nghẹt động lực tăng trưởng kinh tế, đồng thời khiến phương Tây đánh mất lợi thế chiến lược trước các đối thủ cạnh tranh toàn cầu.
| Tiêu chí so sánh | Phe Doomer (An toàn AI tối thượng) | Phe Cheerful Apocalyptics (Tăng tốc đổi mới) |
|---|---|---|
| Đại diện tiêu biểu | Anthropic, viện nghiên cứu Alignment, nhóm EA | Giới đầu tư mạo hiểm Silicon Valley, liên minh Open-source |
| Đánh giá rủi ro | Coi AI siêu trí tuệ là mối đe dọa sinh tồn nhân loại | Coi rủi ro AI có thể quản lý được như Internet hay điện năng |
| Phương pháp tiếp cận | Áp đặt chuẩn an toàn bắt buộc, cấp phép ngặt nghèo | Thúc đẩy mã nguồn mở, thương mại hóa nhanh để thị trường tự điều chỉnh |
| Mục tiêu ưu tiên | Đảm bảo chỉ số an toàn P(doom) tiệm cận mức 0% | Tối đa hóa năng suất lao động và mở rộng biên độ thị trường |
Cuộc chiến tư tưởng này không chỉ dừng lại trong phạm vi nội bộ các công ty công nghệ mà đang trực tiếp định hình các dự luật quản lý trí tuệ nhân tạo tại Thượng viện Mỹ, buộc mọi doanh nghiệp trong chuỗi cung ứng toàn cầu phải chuẩn bị cho những tiêu chuẩn kiểm định an toàn ngặt nghèo hơn trong tương lai gần.
Đối với cộng đồng công nghệ và các nhà hoạch định chính sách tại Việt Nam, cuộc tranh luận giữa Doomer và phe lạc quan mang đến bài học sâu sắc về sự cân bằng chiến lược: chúng ta không thể vì nỗi sợ hãi viển vông mà bỏ lỡ cơ hội bứt phá năng suất lao động từ AI, nhưng cũng không thể chủ quan thả nổi việc kiểm soát dữ liệu cá nhân, quyền sở hữu trí tuệ và an ninh thuật toán trong các ứng dụng thực tế.