Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo
.webp)
Anthropic công bố chính sách mở rộng có trách nhiệm cho các hệ thống AI
Generatived
19:46 20/9/23
Anthropic đã công bố Chính sách mở rộng có trách nhiệm (RSP) mới, phác thảo một bộ giao thức tổ chức và kỹ thuật nhằm quản lý rủi ro liên quan đến việc phát triển các hệ thống AI ngày càng tinh vi. RSP này giới thiệu một khuôn khổ được gọi là Cấp độ An toàn AI (ASL) được thiết kế để giải quyết các rủi ro thảm khốc tiềm ẩn. Hệ thống này dựa trên các tiêu chuẩn về mức độ an toàn sinh học của chính phủ Hoa Kỳ để xử lý các vật liệu sinh học nguy hiểm và yêu cầu các tiêu chuẩn về an toàn, an ninh và vận hành được điều chỉnh phù hợp với các rủi ro thảm khốc tiềm tàng của mô hình. Hệ thống ASL được chia thành nhiều cấp độ. ASL-1 đề cập đến các hệ thống AI không gây ra rủi ro thảm khốc đáng kể, chẳng hạn như hệ thống LLM 2018 và AI được thiết kế dành riêng cho cờ vua. ASL-2 liên quan đến các hệ thống có dấu hiệu sớm về khả năng nguy hiểm, chẳng hạn như khả năng cung cấp hướng dẫn chế tạo vũ khí sinh học, nhưng không đủ tin cậy hoặc thiếu thông tin cụ thể; ASL-3 được gán cho các hệ thống làm tăng đáng kể nguy cơ khai thác thảm khốc so với các đường cơ sở không phải AI, chẳng hạn như công cụ tìm kiếm hoặc sách giáo khoa hoặc có mức độ chức năng tự trị thấp. Các cấp độ ngoài ASL-4 vẫn chưa được xác định vì chúng khác xa với hệ thống hiện tại. Tuy nhiên, chúng được cho là có khả năng xảy ra sự lạm dụng thảm khốc và sự leo thang đáng kể về quyền tự chủ. Các biện pháp đối phó với ASL-4 vẫn chưa được thiết lập nhưng được hứa hẹn sẽ được phát triển trước khi đạt tới ASL-3. Những điều này có thể yêu cầu giải pháp cho các câu hỏi nghiên cứu hiện chưa được giải quyết, chẳng hạn như việc sử dụng các kỹ thuật có thể diễn giải để chứng minh rằng một mô hình khó có thể biểu hiện một số hành vi thảm khốc nhất định.
Chia sẻ bài viết này:
Tin tức mới nhất
Hiệp hội An toàn Tin cậy hợp tác với OpenAI Nhật Bản
14:00 18/8/26
Hiệp hội An toàn Tin cậy (Trust Safety Association) thông báo rằng OpenAI Nhật Bản đã tham gia với tư cách là đối tác doanh nghiệp hỗ trợ cho liên minh phòng chống gian lận quốc gia sắp tới.
Digital Garage ra mắt nền tảng thương mại AI.
14:00 18/8/26
Digital Garage và một công ty con đã cho ra mắt giải pháp tổng thể tối ưu hóa để giải quyết những thay đổi trong thói quen tiêu dùng trong thương mại trí tuệ nhân tạo.
SKY Perfect JSAT ra mắt nghiên cứu đám mây AI.
14:00 18/8/26
SKY Perfect JSAT và Banyan đã ra mắt một nền tảng hỗ trợ giáo dục nhằm giúp học sinh quan sát thời tiết.
Copyright © 2024 Generatived - All right Reserved.
Chia sẻ bài viết này:
Chia sẻ bài viết này:
Danh mục
Tin tức
AI và luật/hệ thống/kinh tế/xã hội
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Tin tức mới nhất
Hiệp hội An toàn Tin cậy hợp tác với OpenAI Nhật Bản
14:00 18/8/26
Hiệp hội An toàn Tin cậy (Trust Safety Association) thông báo rằng OpenAI Nhật Bản đã tham gia với tư cách là đối tác doanh nghiệp hỗ trợ cho liên minh phòng chống gian lận quốc gia sắp tới.
Digital Garage ra mắt nền tảng thương mại AI.
14:00 18/8/26
Digital Garage và một công ty con đã cho ra mắt giải pháp tổng thể tối ưu hóa để giải quyết những thay đổi trong thói quen tiêu dùng trong thương mại trí tuệ nhân tạo.
SKY Perfect JSAT ra mắt nghiên cứu đám mây AI.
14:00 18/8/26
SKY Perfect JSAT và Banyan đã ra mắt một nền tảng hỗ trợ giáo dục nhằm giúp học sinh quan sát thời tiết.




%20(1).webp)

