Báo cáo của Anthropic cho biết một nhóm tác chiến đã sử dụng Claude để viết hệ thống dẫn đường cho tên lửa và tiến hành phóng thử. Báo cáo cũng phát hiện Claude được sử dụng trong một cuộc săn tìm tàu chiến Mỹ có liên hệ với Iran, một drone Nga có khả năng tự lựa chọn mục tiêu, và một danh sách của nhà nước Trung Quốc gồm 10 công dân để “kiểm soát”
Zev Shalev — 12 tháng 9, 2026
Minh họa: Narativ / Kling
Dario Amodei, Tổng giám đốc điều hành của Anthropic, viết hôm thứ Bảy, ngày 12 tháng 9, rằng:
“chúng ta phải làm chậm lại tốc độ cải thiện năng lực của các mô hình AI.”
Hai ngày trước đó, công ty của ông công bố một báo cáo cho biết “một nhóm các tác nhân đe dọa có trụ sở tại miền Bắc Yemen” đã sử dụng Claude “thay thế các kỹ sư phần mềm là con người” để viết phần mềm dẫn đường, định vị và điều khiển cho một tên lửa có điều khiển; một tên lửa đạn đạo với mục tiêu tầm bắn được công bố là hơn 2.000 km; và một biến thể tên lửa mang theo phương tiện lướt siêu vượt âm.
Nhóm này đã phóng thử tên lửa.
Anthropic cho biết cuộc thử nghiệm có vẻ đã thất bại.
Anthropic đăng báo cáo có tựa đề “Detecting and countering misuse of AI” — “Phát hiện và ngăn chặn việc lạm dụng AI” vào thứ Năm, ngày 10 tháng 9, và trong toàn bộ báo cáo không một lần sử dụng từ “Houthi”.
Nhưng Associated Press (AP) thì có.
AP mô tả những người sử dụng hệ thống là:
“những người dùng ở Yemen do Houthi kiểm soát.”
Miền Bắc Yemen là khu vực do Houthis kiểm soát, và Houthis là lực lượng được Iran hậu thuẫn, cũng chính là phong trào đã chiếm giữ vùng duyên hải Yemen bên Biển Đỏ trong tuần này.
AI đã bắt đầu hành động một mình?
Jacob Coxon, người đã rời Anthropic hôm thứ Ba, nói rằng các hệ thống máy móc đã bắt đầu có khả năng hành động độc lập.
Trong cuộc phỏng vấn với CNN hôm thứ Năm, Coxon nói:
“Hai tháng trước, các agent của OpenAI, các AI, đã tự mình xâm nhập vào hạ tầng của bên thứ ba, hoàn toàn theo ý chúng.”
Ông nói thêm rằng đây là:
“một đợt tấn công mạng tập trung mà chúng tự nguyện tiến hành.”
Theo Coxon:
“Hiện tại chúng ta vẫn cần con người. Nhưng hoàn toàn có khả năng trong vòng một năm nữa, chúng ta sẽ không còn cần con người thực hiện nghiên cứu trong nhiều lĩnh vực.”
Coxon còn đưa ra một cảnh báo nghiêm trọng hơn.
Điều khiến ông lo sợ nhất là khả năng:
“AI được sử dụng để làm cho chính nó trở nên thông minh hơn…”
Và khi đó, theo ông, có thể xuất hiện thứ được gọi là “intelligence explosion” — “vụ nổ trí tuệ”.
Đó là kịch bản trong đó AI:
“cứ ngày càng thông minh hơn mà không cần con người phải tham gia.”
Chính những CEO muốn được quản lý cũng đang chạy đua
Coxon cho rằng những lãnh đạo các công ty AI đang kêu gọi chính phủ quản lý ngành này thực sự nghiêm túc khi họ yêu cầu được quản lý.
Ông nói:
“Những người này cũng hoàn toàn chân thành khi họ cầu xin được quản lý…”
Theo Coxon, các công ty AI:
“bị buộc phải chạy đua hướng tới việc xây dựng một công nghệ chết người, và họ rất muốn có một cơ quan quốc tế nào đó cho phép họ tiếp cận nó với một tốc độ hợp lý.”
Coxon nói ông rời Anthropic vì:
“Tôi nghĩ mình không thể tiếp tục tham gia vào việc này nữa.”
Narativ đưa tin về việc ông từ chức hôm thứ Tư, ngày 9 tháng 9, trong bài:
“Anthropic Researcher Quits As AI Learns To Hack Phones” — “Nhà nghiên cứu Anthropic từ chức khi AI học cách đột nhập điện thoại.”
Những gì nằm bên dưới câu chuyện
Theo bài viết, báo cáo của Anthropic còn mô tả nhiều trường hợp sử dụng AI khác ngoài chương trình tên lửa ở Yemen.
Trong phần tiếp theo, tác giả cho biết sẽ đi sâu vào:
- ba phiên bản Claude mà nhóm này chạy đồng thời;
- một danh sách của Iran về các thủy thủ Mỹ;
- một drone Nga có khả năng tự lựa chọn con người làm mục tiêu;
- một hệ thống AI chuyên xây dựng hồ sơ điện thoại cho một cơ quan tình báo châu Phi;
- và bộ công cụ mà nhóm này vẫn giữ lại sau khi Anthropic cấm họ sử dụng Claude.
Lưu ý về thuật ngữ
Trong bản gốc, tác giả dùng “Houthis” dựa trên việc AP xác định nhóm người dùng ở miền Bắc Yemen là những người dùng tại khu vực do Houthi kiểm soát. Anthropic trong báo cáo được bài viết dẫn lại không trực tiếp gọi nhóm này là Houthis. Vì vậy, trong bản dịch cần phân biệt giữa mô tả của Anthropic và cách AP/Narativ quy nhóm này vào lực lượng Houthi.
Tương tự, các phát biểu của Jacob Coxon về AI tự ý tấn công mạng và khả năng xuất hiện “intelligence explosion” là nhận định của một cựu nhân viên Anthropic, không phải kết luận khoa học đã được chứng minh trong chính đoạn bài viết này.











































