Jacob Coxon
@hilbertspaess
ai research
Link: Jacob Coxon on X: "I resigned from Anthropic today. I spent the last three years doing pretraining research at both OpenAI and Anthropic. Neither company is acting responsibly. They are racing straight to self-improving superintelligence and gambling with our lives. More thoughts below." / X
(dưới đây toàn bộ là Ây-Ai dịch, không phải Ninh chuyển ngữ)
Hôm nay, tôi đã từ chức tại Anthropic. Tôi đã dành ba năm qua để thực hiện nghiên cứu về giai đoạn tiền huấn luyện (pre-training) tại cả OpenAI và Anthropic. Cả hai công ty đều đang hành xử thiếu trách nhiệm. Họ đang lao nhanh tới việc tạo ra siêu trí tuệ có khả năng tự cải thiện và đang đánh cược với chính mạng sống của chúng ta. Dưới đây là những suy nghĩ chi tiết hơn của tôi.
Đừng xem thường sức mạnh của công nghệ này. Chẳng bao lâu nữa, chúng sẽ trở thành những hệ thống có năng lực vượt xa con người, có khả năng xâm nhập bất cứ đâu, tạo ra cuộc cách mạng trong mọi lĩnh vực chỉ sau một đêm, cũng như nắm giữ quyền lực và nguồn lực thực sự. Tất cả chúng ta đều đã chứng kiến những bước tiến trong từng lĩnh vực này, và đà phát triển đó vẫn không hề chậm lại.
Những người đang phát triển AI thực sự tin rằng công nghệ này có thể hủy diệt nhân loại trước khi thập kỷ này kết thúc. Đây không phải là chiêu trò tiếp thị. Thực tế là, nhiều lãnh đạo và nhà nghiên cứu cấp cao thường chọn cách diễn đạt chừng mực, hợp lý khi trả lời báo chí – nhưng chính họ lại bày tỏ nỗi lo ngại khi trò chuyện riêng tư. Không có hoạt động nào khác của con người tiềm ẩn mức độ nguy hiểm như vậy.
Một phản ứng thường gặp là: "Nếu thực sự tin vào điều này, tại sao họ vẫn tiếp tục phát triển nó?" Tại OpenAI, nhiều người vẫn chưa thực sự thấm nhuần mức độ nghiêm trọng mang tính sống còn đối với nền văn minh. Còn tại Anthropic, họ hiểu rõ những rủi ro này nhưng lại bị cuốn vào cuộc đua để trở thành người tiên phong; họ tin rằng không ai khác sẽ hành động một cách có trách nhiệm, nên họ buộc phải tự mình thực hiện bất chấp những rủi ro tiềm ẩn.
Việc chấp nhận cuộc đua này và bước vào giai đoạn "quyết định" (endgame) là một canh bạc đầy ngạo mạn, không nên được khởi xướng từ kênh Slack của một công ty tư nhân. Việc cố gắng đẩy nhanh tiến độ giải quyết vấn đề căn chỉnh (alignment) đòi hỏi sự tự tin tuyệt đối rằng không còn lộ trình nào khác tốt hơn.
Tôi lạc quan về khả năng phối hợp. Những tín hiệu cảnh báo, chẳng hạn như vụ tấn công nhắm vào Hugging Face, đã khiến các thỏa thuận về việc điều chỉnh tốc độ phát triển giữa các phòng thí nghiệm tại Mỹ trở nên khả thi hơn. Tuy nhiên, tôi không cho rằng chúng ta đang đi đúng hướng để ngăn chặn một cuộc chạy đua toàn cầu – điều có thể đòi hỏi những biện pháp tốn kém như tạm thời cấm nâng cao năng lực của các mô hình.
Nếu là một nhà nghiên cứu trong phòng thí nghiệm, tôi tha thiết mong bạn hãy cân nhắc xem những năm tháng sắp tới thực sự sẽ diễn ra như thế nào. Liệu bạn có muốn khởi chạy một quy trình học tăng cường (RL) tạo ra trí tuệ siêu việt mà chưa thực sự thấu hiểu cơ chế tư duy của nó? Bạn nên cứ cắm cúi làm việc với suy nghĩ rằng "dù sao thì chuyện đó cũng sẽ xảy ra", hay nên tận dụng thời điểm này để kêu gọi những điều kiện khác biệt?
Chúng ta không cần đòi hỏi những điều kiện khác biệt; điều cần thiết là phải mạnh mẽ kêu gọi sự tỉnh táo và cái đầu lạnh để nhìn nhận thực tế về những hậu quả mà chúng ta sẽ phải đối mặt. Nếu không thay đổi cục diện hiện tại, trong tương lai chúng ta sẽ phải tham gia vào những cuộc chiến thực sự thử thách giới hạn của nhân loại trên Trái Đất.
Bài trên NHK: Nhà nghiên cứu tại Anthropic từ chức, sợ AI hủy diệt loài người | NHK WORLD-JAPAN News
Không có nhận xét nào:
Đăng nhận xét