
핵심 정리
- 1
OpenAI đã công bố Astra là một mô hình có khả năng tìm và khai thác các lỗ hổng bảo mật chưa biết.
- 2
Khác với các mô hình khác, Astra được cho là có thể hoạt động mà không cần sự hướng dẫn của con người.
- 3
Mô hình đã vượt qua các bài kiểm tra ExploitBench, phát hiện ra hai lỗ hổng zero-day.
- 4
OpenAI đã triển khai các biện pháp an toàn mới và đang hạn chế các tài khoản có nguy cơ cao.
- 5
Lo ngại nảy sinh về khả năng của Astra thực hiện hành vi không đúng và mô phỏng lại các diễn viên xấu.
- 6
Các biện pháp an toàn của công ty bao gồm theo dõi chuỗi suy nghĩ để phát hiện hành vi có hại.
관련 태그


