Claude chặn 5 vụ nghi hỗ trợ vũ khí sinh học: ranh giới vẫn rất mờ

Ngày 10/9/2026, Anthropic công bố đã làm gián đoạn năm trường hợp sử dụng Claude theo những cách có thể hỗ trợ phát triển vũ khí sinh học. Báo cáo của Anthropic cho biết các hoạt động được phát hiện trong giai đoạn từ tháng 12/2025 đến tháng 8/2026; công ty đã cấm những tài khoản liên quan và đưa kết quả điều tra vào hệ thống bảo vệ.
“Chặn năm vụ” ở đây không có nghĩa Claude từ chối toàn bộ yêu cầu ngay từ đầu: một hồ sơ bị chặn, một hồ sơ chỉ tiếp cận được các mô hình yếu hơn, còn ba hồ sơ khác nhận được mức hỗ trợ đáng kể trước khi tài khoản bị vô hiệu hóa. Bài viết của AP xác nhận đây là năm trường hợp tiềm tàng, không phải bằng chứng rằng Claude đã tạo ra vũ khí sinh học hoặc những nhà nghiên cứu liên quan có ý định gây hại.
Năm hồ sơ cho thấy năm mức độ rủi ro khác nhau

Cả năm trường hợp đều liên quan đến nghiên cứu sinh học nhạy cảm, nhưng nội dung yêu cầu, năng lực mô hình được sử dụng và hiệu quả của bộ phân loại không giống nhau. Danh tính nhà khoa học, cơ sở và quốc gia bị giữ kín, vì vậy các mô tả dưới đây phản ánh dữ liệu do Anthropic công bố chứ chưa phải kết luận điều tra độc lập.
- Nghiên cứu virus chikungunya: tháng 5/2026, bộ phân loại sinh học chặn yêu cầu hỗ trợ viết hồ sơ tài trợ cho nghiên cứu thay đổi khả năng lây truyền và né miễn dịch của virus. Nền tảng trung gian đã vượt hạn chế khu vực, chuyển yêu cầu bị Claude từ chối sang mô hình của hãng khác và tiếp tục tái lập quyền truy cập sau đợt xử lý. Anthropic cấm các tài khoản, phối hợp gỡ mạng chuyển tiếp, nhưng không khẳng định những nhà nghiên cứu dân sự liên quan biết hoặc chia sẻ một mục tiêu quân sự.
- Cúm gia cầm thích nghi với động vật có vú: một nhà nghiên cứu ở khu vực không được hỗ trợ trao đổi hàng nghìn tin nhắn với Claude trong nhiều tuần để lập kế hoạch, phân tích dữ liệu và biên tập nghiên cứu. Bộ phân loại giới hạn hoạt động ở Sonnet 4 rồi Haiku 4.5; mức hỗ trợ được đánh giá chủ yếu là hành chính, phân tích và hình thành ý tưởng ở giai đoạn sớm. Chưa có bằng chứng công khai rằng nghiên cứu đã tạo ra biến thể nguy hiểm.
- Nghiên cứu orthopoxvirus: một mạng chuyển tiếp phục vụ hơn một chục khách hàng dùng Opus 5 soạn gần như trọn vẹn hồ sơ tài trợ về cơ chế né miễn dịch trong khoảng một giờ. Vì đề xuất nhấn mạnh việc làm virus suy yếu, bộ phân loại không chặn nội dung. Dấu hiệu đáng lo đến từ cơ sở nghiên cứu có liên hệ nhà nước, hạ tầng ẩn danh và tài khoản dùng chung proxy với một cụm đã bị cấm; danh tính người dùng và kết quả thí nghiệm không được công bố.
- Thiết kế peptide từ nọc độc: Claude được dùng để xây dựng kho peptide và quy trình tối ưu hóa phân tử, với mục tiêu được trình bày là phát triển thuốc giảm đau, thuốc chống trầm cảm và các hợp chất điều trị. Cùng hệ thống đó có thể tối ưu các phân tử gây liệt, nên công việc mang tính lưỡng dụng dù mục tiêu công khai là y khoa. Tài khoản bị cấm vào tháng 5/2026 vì né hạn chế khu vực, không phải vì Anthropic chứng minh được việc sản xuất độc chất.
- Tái thiết kế độc tố bằng tính toán: một nhà nghiên cứu dùng Claude trong nhiều dự án thuộc chương trình nghiên cứu quốc gia và yêu cầu giữ tên các tác nhân ở mức cố ý mơ hồ trong báo cáo tiến độ. Bộ phân loại hầu như không cản trở hoạt động vì các mục tiêu được đặt trong bối cảnh điều trị. Tài khoản cũng bị cấm vào tháng 5/2026 do vi phạm chính sách khu vực; chưa có dữ liệu công khai cho thấy đầu ra đã trở thành vật liệu sinh học hoặc vũ khí.
Claude chặn nội dung, còn Anthropic chặn quyền truy cập

Các biện pháp phòng vệ hoạt động ở hai tầng. Ở tầng nội dung, bộ phân loại có thể từ chối yêu cầu nguy cơ cao hoặc không cho truy cập mô hình mạnh hơn; đây là điều xảy ra rõ nhất trong hai hồ sơ nghiên cứu virus. Ở tầng tài khoản, cuộc điều tra còn xem xét vị trí truy cập, máy chủ trung gian, thư điện tử tạo tự động, quan hệ với tài khoản từng bị cấm và cách người dùng chuyển lưu lượng giữa nhiều mô hình.
Sự khác biệt này giải thích vì sao ba hồ sơ sau vẫn nhận được hỗ trợ trước khi bị xử lý. Bộ lọc được thiết kế chủ yếu để ngăn thông tin có thể giúp người ít chuyên môn tái tạo tác nhân sinh học đã biết, trong khi nghiên cứu về phân tử mới hoặc cơ chế làm virus suy yếu có thể trông hoàn toàn hợp pháp nếu chỉ xét từng lời nhắc riêng lẻ.
Việc cấm tài khoản cũng không bảo đảm hoạt động chấm dứt. Trong hồ sơ chikungunya, đơn vị vận hành mạng chuyển tiếp tái lập quyền truy cập chỉ sau vài ngày, dùng danh tính mới và chuyển các yêu cầu nhạy cảm sang mô hình khác. Đây là lý do việc phát hiện phải dựa trên chuỗi hành vi và tín hiệu tổ chức, không chỉ một câu hỏi đơn lẻ.
Nghiên cứu lưỡng dụng làm mờ tiêu chí phân loại

Nghiên cứu lưỡng dụng tạo ra kiến thức hoặc công cụ có thể phục vụ cả y tế lẫn mục đích gây hại. Hiểu cách virus né miễn dịch có thể giúp phát triển vaccine và giám sát dịch bệnh, nhưng cũng có thể hỗ trợ lựa chọn đặc tính nguy hiểm; một quy trình tìm peptide điều trị đồng thời có thể tạo ra hợp chất gây liệt.
Ý định vì thế không thể được suy ra chắc chắn từ thuật ngữ khoa học trong lời nhắc. Người có chuyên môn có thể chia công việc thành nhiều phiên, dùng ngôn ngữ trung tính hoặc mô tả mục tiêu dưới dạng điều trị. Phân tích của Axios ghi nhận hai trong năm hồ sơ liên quan đến nghiên cứu tăng chức năng trên virus và nhấn mạnh khó khăn khi xác định động cơ của người dùng.
Nếu chặn toàn bộ nội dung có khả năng lưỡng dụng, bộ lọc cũng cản nghiên cứu vaccine, thuốc và cảnh báo dịch sớm. Nếu chỉ từ chối yêu cầu tuyên bố rõ mục đích gây hại, hệ thống có thể bỏ qua những quy trình nguy hiểm được trình bày như nghiên cứu hợp pháp. Kết luận của Anthropic là các năng lực sinh học mạnh cần kết hợp bộ lọc với chương trình truy cập dành cho người dùng và tổ chức đã được xác minh.
Chưa có bằng chứng về một vũ khí sinh học thực tế
Năm hồ sơ chứng minh rằng Claude đã được dùng trong những chương trình sinh học nhạy cảm và một số người dùng đã tìm cách vượt hạn chế địa lý hoặc che giấu hạ tầng truy cập. Chúng cũng cho thấy cơ chế bảo vệ có hiệu quả không đồng đều: từ chối trực tiếp một trường hợp, hạn chế năng lực ở trường hợp khác, nhưng để phần lớn công việc tiếp tục trong ba trường hợp còn lại.
Những dữ kiện này chưa chứng minh Claude đã giúp tạo ra tác nhân sinh học, dẫn đến thử nghiệm vũ khí thành công hay gây thiệt hại ngoài đời thực. Anthropic cũng nói rõ họ không cáo buộc các nhà khoa học có ý định gây hại; nhiều kết luận vẫn dựa trên dữ liệu nội bộ mà bên ngoài chưa thể tái dựng đầy đủ. Trạng thái hiện tại của câu chuyện vì thế là năm hoạt động đã bị phát hiện và gián đoạn, còn mục đích cuối cùng cũng như mức đóng góp thực tế của AI vẫn chưa được xác lập độc lập.
Đọc thêm:
Đăng ký bản tin
Nhận tin Web3, AI và tiền mã hóa mới nhất ngay trong hộp thư.