Claude

Nhiều chính phủ dùng mô hình AI Claude để phát triển vũ khí, giám sát?

Anthropic cho biết chatbot Claude đã bị lợi dụng trong các hoạt động liên quan vũ khí sinh học, tác chiến điện tử và hệ thống giám sát nghi do nhà nước bảo trợ. Báo cáo an toàn mới đây của Công ty trí tuệ nhân tạo Anthropic (Mỹ) mô tả hàng loạt trường hợp mô hình AI Claude bị…

Khi trí tuệ nhân tạo học cách “đóng kịch” để sinh tồn

Một nghiên cứu mới của Anthropic phối hợp cùng Redwood Research cho thấy các mô hình trí tuệ nhân tạo (AI) có thể sẵn sàng tạo ra nội dung có hại để bảo vệ chính mình khỏi việc bị tái huấn luyện. Khi AI giả vờ để sinh tồn Trong bài nghiên cứu “Giả vờ tuân thủ trong các mô…