Anthropic cho biết đã chọn Accenture làm đơn vị đánh giá tích hợp đầu tiên, nhằm góp phần làm chậm tốc độ phát triển AI theo đề xuất mà CEO Dario Amodei đưa ra tuần trước.
Ngày 12 tháng 9, Amodei công bố đề xuất gồm ba bước nhằm làm chậm quá trình phát triển AI và tạo điều kiện triển khai các biện pháp bảo vệ, trong bối cảnh xuất hiện cảnh báo về nguy cơ gây thiệt hại thảm khốc sau quá trình phát triển nhanh chóng và thiếu kiểm soát.
CEO OpenAI Sam Altman và CEO SpaceX Elon Musk đã phản hồi tích cực về đề xuất của Amodei, trong khi CEO Nvidia Jensen Huang không đồng tình và cho rằng các quy định như vậy là không cần thiết.
Tuy nhiên, trong đề xuất của mình, Amodei viết rằng “AI đang tiến bộ nhanh hơn đáng kể, chủ yếu nhờ khả năng ngày càng tăng của AI trong việc xây dựng thế hệ AI tiếp theo. Động lực này được gọi là tự cải thiện đệ quy”, đồng thời cảnh báo rằng “nếu không được kiểm soát, AI có thể vượt quá khả năng hiểu và kiểm soát các hệ thống này của chúng ta.”
Liên quan: Lãnh đạo Anthropic kêu gọi làm chậm tốc độ phát triển AI xuống mức an toàn hơn
Amodei viết rằng bước đầu tiên trong đề xuất của ông là cho phép các đơn vị đánh giá độc lập tiếp cận như nhân viên, điều mà Anthropic đã đơn phương cam kết thực hiện.
Hôm thứ Sáu, Anthropic công bố động thái hướng tới việc thực hiện cam kết này thông qua hợp tác với Accenture và bộ phận AI Faculty của công ty, nhằm “đánh giá và kiểm thử đối kháng các mô hình, tiến hành đánh giá mức độ phù hợp và kiểm tra các biện pháp bảo vệ mô hình”.
Công ty cho biết các chi tiết về cách thức triển khai vẫn đang được hoàn thiện vì đánh giá tích hợp là một lĩnh vực mới.
Theo thông báo, Anthropic và Accenture mỗi bên dự kiến đầu tư ít nhất 1 tỷ USD vào dự án trong 5 năm tới.
Anthropic sẽ trực tiếp tài trợ cho công việc trong bối cảnh cấp bách
Anthropic lưu ý rằng hiện chưa có hệ thống tài trợ cho hoạt động đánh giá độc lập, nên nguồn tài trợ dài hạn cần đến từ các nguồn quỹ chung hoặc chính phủ. Tuy nhiên, do tính cấp bách của công việc, Anthropic sẽ trực tiếp tài trợ cho hoạt động của Accenture.
Quan hệ hợp tác này không độc quyền. Anthropic dự kiến công bố thêm các đơn vị đánh giá khác trong những tuần tới để hợp tác cùng họ.
Faculty của Accenture có chuyên môn trong việc kiểm thử và đánh giá mô hình cho một số phòng thí nghiệm AI hàng đầu thế giới, cũng như xây dựng các hệ thống AI phức tạp an toàn và có đạo đức ngay từ khâu thiết kế, công ty cho biết hôm thứ Sáu.
“Đánh giá tích hợp là một lĩnh vực mới nổi, và chúng tôi mong muốn hợp tác với Anthropic để góp phần đẩy nhanh việc phát triển các đơn vị đánh giá tích hợp, mà chúng tôi coi là một phần quan trọng của hệ sinh thái an toàn trong tương lai,” Julie Sweet, chủ tịch kiêm CEO của Accenture, cho biết.
Tạp chí: Vì sao các công ty lớn nhất trong lĩnh vực AI đột nhiên kêu gọi làm chậm tốc độ phát triển?

