Anthropic cho biết đã chọn Accenture làm đơn vị đánh giá tích hợp đầu tiên nhằm giúp làm chậm tốc độ phát triển AI theo đề xuất CEO Dario Amodei đưa ra vào tuần trước.
Ngày 12 tháng 9, Amodei công bố đề xuất gồm ba bước nhằm làm chậm quá trình phát triển AI và cho phép triển khai các biện pháp bảo vệ, trong bối cảnh có cảnh báo về nguy cơ gây thiệt hại thảm khốc sau quá trình phát triển nhanh chóng và không được kiểm soát.
CEO OpenAI Sam Altman và CEO SpaceX Elon Musk đã phản hồi tích cực trước đề xuất của Amodei, trong khi CEO Nvidia Jensen Huang không đồng tình và cho rằng quy định như vậy là không cần thiết.
Tuy nhiên, trong đề xuất của mình, Amodei viết rằng “AI đang tiến bộ nhanh hơn đáng kể, chủ yếu nhờ khả năng ngày càng tăng của AI trong việc xây dựng thế hệ AI tiếp theo. Động lực này được gọi là tự cải thiện đệ quy”, đồng thời cảnh báo rằng “nếu không được kiểm soát, quá trình này có thể vượt qua khả năng hiểu và kiểm soát các hệ thống đó của chúng ta”.
Amodei viết rằng bước đầu tiên trong đề xuất của ông là có các đơn vị đánh giá độc lập được tiếp cận như nhân viên, một cam kết mà Anthropic trước đó đã đơn phương đưa ra.
Anthropic thông báo hôm thứ Sáu rằng công ty đang tiến tới thực hiện cam kết này bằng cách hợp tác với Accenture và bộ phận AI Faculty của công ty trong việc “đánh giá và red-team các mô hình, tiến hành đánh giá mức độ phù hợp và kiểm thử các biện pháp bảo vệ mô hình”.
Công ty cho biết chi tiết về cách thức triển khai vẫn đang được hoàn thiện, vì đánh giá tích hợp là một lĩnh vực mới.
Theo thông báo, Anthropic và Accenture mỗi bên dự kiến đầu tư ít nhất 1 tỷ USD vào dự án trong 5 năm tới.
Anthropic sẽ trực tiếp tài trợ công việc trong bối cảnh cấp bách
Anthropic lưu ý rằng hiện cũng chưa có hệ thống để tài trợ cho hoạt động đánh giá độc lập, vì vậy nguồn tài trợ dài hạn nên đến từ các nguồn vốn chung hoặc chính phủ. Tuy nhiên, do tính cấp bách của công việc, Anthropic sẽ trực tiếp tài trợ cho hoạt động của Accenture.
Quan hệ hợp tác này không mang tính độc quyền. Anthropic dự kiến sẽ công bố thêm các đơn vị đánh giá mà công ty sẽ hợp tác trong những tuần tới.
Faculty, thuộc Accenture, có chuyên môn trong việc kiểm thử và đánh giá mô hình cho một số phòng thí nghiệm AI hàng đầu thế giới, cũng như xây dựng các hệ thống AI phức tạp an toàn và có đạo đức ngay từ khâu thiết kế, công ty cho biết hôm thứ Sáu.
“Đánh giá tích hợp là một lĩnh vực mới nổi, và chúng tôi mong muốn hợp tác với Anthropic để giúp thúc đẩy sự phát triển của các đơn vị đánh giá tích hợp, mà chúng tôi xem là một phần quan trọng trong bối cảnh an toàn thời gian tới”, Julie Sweet, chủ tịch hội đồng quản trị kiêm CEO của Accenture, cho biết.

