Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo
.webp)
Anthropic công bố chính sách mở rộng có trách nhiệm cho các hệ thống AI
Generatived
19:46 20/9/23
Anthropic đã công bố Chính sách mở rộng có trách nhiệm (RSP) mới, phác thảo một bộ giao thức tổ chức và kỹ thuật nhằm quản lý rủi ro liên quan đến việc phát triển các hệ thống AI ngày càng tinh vi. RSP này giới thiệu một khuôn khổ được gọi là Cấp độ An toàn AI (ASL) được thiết kế để giải quyết các rủi ro thảm khốc tiềm ẩn. Hệ thống này dựa trên các tiêu chuẩn về mức độ an toàn sinh học của chính phủ Hoa Kỳ để xử lý các vật liệu sinh học nguy hiểm và yêu cầu các tiêu chuẩn về an toàn, an ninh và vận hành được điều chỉnh phù hợp với các rủi ro thảm khốc tiềm tàng của mô hình. Hệ thống ASL được chia thành nhiều cấp độ. ASL-1 đề cập đến các hệ thống AI không gây ra rủi ro thảm khốc đáng kể, chẳng hạn như hệ thống LLM 2018 và AI được thiết kế dành riêng cho cờ vua. ASL-2 liên quan đến các hệ thống có dấu hiệu sớm về khả năng nguy hiểm, chẳng hạn như khả năng cung cấp hướng dẫn chế tạo vũ khí sinh học, nhưng không đủ tin cậy hoặc thiếu thông tin cụ thể; ASL-3 được gán cho các hệ thống làm tăng đáng kể nguy cơ khai thác thảm khốc so với các đường cơ sở không phải AI, chẳng hạn như công cụ tìm kiếm hoặc sách giáo khoa hoặc có mức độ chức năng tự trị thấp. Các cấp độ ngoài ASL-4 vẫn chưa được xác định vì chúng khác xa với hệ thống hiện tại. Tuy nhiên, chúng được cho là có khả năng xảy ra sự lạm dụng thảm khốc và sự leo thang đáng kể về quyền tự chủ. Các biện pháp đối phó với ASL-4 vẫn chưa được thiết lập nhưng được hứa hẹn sẽ được phát triển trước khi đạt tới ASL-3. Những điều này có thể yêu cầu giải pháp cho các câu hỏi nghiên cứu hiện chưa được giải quyết, chẳng hạn như việc sử dụng các kỹ thuật có thể diễn giải để chứng minh rằng một mô hình khó có thể biểu hiện một số hành vi thảm khốc nhất định.
Chia sẻ bài viết này:
Tin tức mới nhất
OpenAIセキュリティ支援拡大
14:00 12/8/26
OpenAI(サンフランシスコ)は、同社の最先端サイバーセキュリティ向けAIモデルを世界中のセキュリティ企業やITコンサルティング会社へ提供するパートナープログラムの拡大を発表した模様だ。
Copyright © 2024 Generatived - All right Reserved.
Chia sẻ bài viết này:
Chia sẻ bài viết này:
Danh mục
Tin tức
AI và luật/hệ thống/kinh tế/xã hội
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Tin tức mới nhất
OpenAIセキュリティ支援拡大
14:00 12/8/26
OpenAI(サンフランシスコ)は、同社の最先端サイバーセキュリティ向けAIモデルを世界中のセキュリティ企業やITコンサルティング会社へ提供するパートナープログラムの拡大を発表した模様だ。




%20(1).webp)

