Anthropic

Tin tặc giả danh nhân viên Anthropic để nhắm vào chuyên gia AI Mỹ

Các chuyên gia AI tại Mỹ trở thành mục tiêu khi nhóm TA419 giả danh nhân viên Anthropic, xây dựng lòng tin rồi tìm cách đánh cắp thông tin đăng nhập. Theo báo cáo từ công ty an ninh mạng Proofpoint, nhóm tin tặc TA419 được đánh giá có liên hệ với Trung Quốc, đã thực hiện nhiều chiến dịch…

Khi trí tuệ nhân tạo học cách “đóng kịch” để sinh tồn

Một nghiên cứu mới của Anthropic phối hợp cùng Redwood Research cho thấy các mô hình trí tuệ nhân tạo (AI) có thể sẵn sàng tạo ra nội dung có hại để bảo vệ chính mình khỏi việc bị tái huấn luyện. Khi AI giả vờ để sinh tồn Trong bài nghiên cứu “Giả vờ tuân thủ trong các mô…