
AI từ “trợ lý” thành “chỉ huy”: Anthropic phát hiện nguy cơ lạm dụng trong vũ khí, sinh học và tấn công mạng
Trí tuệ nhân tạo đang bước vào một giai đoạn phát triển mới, trong đó các mô hình AI không còn chỉ đóng vai trò cung cấp thông tin hoặc hỗ trợ con người thực hiện từng nhiệm vụ riêng lẻ. Theo một báo cáo mới của Anthropic, AI tiên tiến đã bị các tổ chức có liên hệ với chính phủ và tội phạm ở nhiều quốc gia lợi dụng để tham gia sâu hơn vào các hoạt động tấn công mạng, phát triển vũ khí, thao túng thông tin và nghiên cứu sinh học có nguy cơ gây hậu quả nghiêm trọng.
Điều đáng chú ý nhất là AI đang được sử dụng theo mô hình có tính tự động hóa cao hơn. Con người có thể chỉ xác định mục tiêu, trong khi các tác nhân AI đảm nhiệm nhiều công đoạn như thu thập thông tin, viết và kiểm tra mã, mô phỏng, phân tích kết quả và phối hợp các nhiệm vụ khác nhau.
Báo cáo của Anthropic cho thấy ranh giới giữa một “cố vấn AI” và một “hệ thống thực thi” đang ngày càng trở nên mờ nhạt.
Anthropic phát hiện nhiều trường hợp lạm dụng Claude
Ngày 10, theo giờ địa phương, công ty AI Anthropic công bố báo cáo về việc phát hiện và ứng phó với tình trạng lạm dụng các mô hình AI.
Báo cáo tập trung vào những trường hợp sử dụng Claude, bao gồm cả các khả năng lập trình và tự động hóa mới hơn, trong khoảng thời gian từ tháng 12 năm trước đến tháng 8 năm nay.
Theo Anthropic, công ty đã phát hiện và chặn các tài khoản bị nghi ngờ sử dụng Claude cho nhiều mục đích nguy hiểm, bao gồm phát triển vũ khí thông thường, nghiên cứu sinh học có nguy cơ bị lạm dụng, tấn công mạng và hoạt động giám sát trái phép.
Điểm đáng chú ý không chỉ nằm ở số lượng trường hợp mà còn ở mức độ mà AI được cho là đã tham gia vào quy trình.
Trong một số tình huống, AI không chỉ trả lời câu hỏi của người sử dụng mà còn thực hiện những công việc vốn trước đây đòi hỏi kỹ năng chuyên môn của con người.
Đây là nguyên nhân khiến các nhà phát triển AI ngày càng phải đối mặt với một bài toán khó: làm thế nào để duy trì khả năng hữu ích của các mô hình tiên tiến nhưng đồng thời ngăn chúng trở thành công cụ hỗ trợ trực tiếp cho những hoạt động nguy hiểm.
AI bị sử dụng trong nghiên cứu và phát triển vũ khí
Một trong những nhóm trường hợp đáng lo ngại nhất mà Anthropic xác định liên quan đến vũ khí thông thường.
Theo báo cáo, có sáu trường hợp lạm dụng liên quan đến lĩnh vực này, trong đó ba trường hợp được xác định tại Trung Quốc, hai trường hợp tại Nga và một trường hợp tại Yemen.
Một tổ chức phát triển vũ khí ở miền bắc Yemen được cho là đã sử dụng Claude Code để hỗ trợ phát triển phần mềm điều khiển bay cho tên lửa dẫn đường.
Claude cũng được sử dụng trong các hoạt động mô phỏng liên quan tới đường bay của tên lửa đạn đạo nhiều tầng và phương tiện lượn siêu thanh.
Những trường hợp này cho thấy AI có thể được đưa vào các giai đoạn kỹ thuật tương đối phức tạp của quá trình phát triển hệ thống vũ khí.
Điều đáng lo ngại không nhất thiết là AI có thể tự mình tạo ra một hệ thống vũ khí hoàn chỉnh. Vấn đề lớn hơn là AI có thể làm giảm thời gian, công sức và lượng nhân lực cần thiết để thực hiện một số công đoạn chuyên môn.
Nếu trước đây một nhóm nhỏ phải mất nhiều thời gian nghiên cứu, viết phần mềm, kiểm tra và sửa lỗi, các công cụ AI có thể hỗ trợ tự động hóa một phần đáng kể quy trình đó.
Trường hợp liên quan đến Trung Quốc
Theo báo cáo của Anthropic, một số trường hợp bị phát hiện tại Trung Quốc liên quan đến các dự án kỹ thuật quân sự.
Một trường hợp được cho là liên quan đến phần mềm điều khiển hỏa lực cho hệ thống chống ngư lôi.
Một trường hợp khác liên quan đến việc soạn thảo một đề xuất kỹ thuật dài hơn 200 trang dành cho Hải quân Quân Giải phóng Nhân dân Trung Quốc.
Ngoài ra, một nhà nghiên cứu Trung Quốc được cho là đã sử dụng Claude để xây dựng khoảng 16 mô-đun phần mềm phục vụ các hoạt động liên quan đến tác chiến điện tử và chế áp hệ thống phòng không. Những mô-đun này được cho là đã được cải tiến nhiều lần.
Điểm đáng chú ý ở đây là AI không chỉ được sử dụng như một công cụ tìm kiếm thông tin.
Thay vào đó, mô hình được đưa vào quá trình phát triển phần mềm, chỉnh sửa, đánh giá và cải tiến sản phẩm.
Điều này phản ánh sự thay đổi quan trọng trong cách AI có thể được sử dụng trong những lĩnh vực có yêu cầu kỹ thuật cao.
Nga và nguy cơ AI hỗ trợ máy bay không người lái tự động
Một nhóm trường hợp khác được Anthropic xác định tại Nga liên quan tới các nhà phát triển tự do.
Theo báo cáo, những người này sử dụng Claude để hỗ trợ phát triển phần mềm cho một nhóm máy bay không người lái cảm tử có khả năng hoạt động ở mức độ tự động cao.
Hệ thống được mô tả là có khả năng phân loại con người thành mục tiêu và thực hiện hành động tấn công.
Đây là một trong những khía cạnh nhạy cảm nhất của việc ứng dụng AI vào lĩnh vực quân sự.
Khi AI được kết hợp với hệ thống tự động và máy bay không người lái, vai trò của con người trong quá trình ra quyết định có thể bị thu hẹp.
Vấn đề không chỉ nằm ở năng lực kỹ thuật mà còn liên quan đến trách nhiệm. Nếu một hệ thống tự động đưa ra quyết định sai, câu hỏi đặt ra là ai chịu trách nhiệm đối với hậu quả: nhà phát triển, người vận hành, tổ chức sở hữu hệ thống hay người thiết kế thuật toán?
Đây là một trong những vấn đề mà cộng đồng quốc tế vẫn đang tranh luận khi AI ngày càng được tích hợp sâu vào các hệ thống tự động.
AI và rủi ro nghiên cứu virus
Không chỉ lĩnh vực vũ khí, Anthropic còn phát hiện các trường hợp sử dụng Claude trong nghiên cứu sinh học có nguy cơ bị lạm dụng.
Theo báo cáo, công ty xác định năm trường hợp có khả năng liên quan đến việc sử dụng AI cho mục đích phát triển hoặc nghiên cứu vũ khí sinh học.
Một trường hợp đặc biệt đáng chú ý liên quan tới nghiên cứu virus cúm gia cầm.
Theo Anthropic, một nhà nghiên cứu đã sử dụng Claude trong một nghiên cứu nhằm tìm hiểu cách thay đổi virus để tăng khả năng lây nhiễm sang người và động vật có vú, đồng thời tăng khả năng lan truyền qua không khí.
AI được cho là đã hỗ trợ nhiều công đoạn của quá trình nghiên cứu, bao gồm thiết kế phương pháp thí nghiệm, phân tích kết quả và xác định hướng thử nghiệm tiếp theo.
Anthropic cho rằng dù nghiên cứu vẫn ở giai đoạn ban đầu, nguy cơ bị sử dụng sai mục đích là đủ nghiêm trọng để công ty chặn tài khoản liên quan.
Đây là một ví dụ cho thấy rủi ro của AI trong lĩnh vực sinh học khác với rủi ro của AI trong an ninh mạng.
Nếu một mô hình AI có thể giúp người sử dụng hiểu nhanh hơn về các quy trình sinh học phức tạp, nó đồng thời cũng có khả năng làm giảm rào cản kiến thức đối với những người có ý định sử dụng công nghệ cho mục đích nguy hiểm.
AI đang chuyển từ “cố vấn” thành “người thực thi”
Có lẽ điểm quan trọng nhất trong báo cáo của Anthropic không phải là từng trường hợp riêng lẻ mà là sự thay đổi về bản chất của cách AI được sử dụng.
Trong giai đoạn đầu, AI thường được xem như một “cố vấn”.
Con người đặt câu hỏi, AI cung cấp thông tin, sau đó con người tự thực hiện công việc.
Nhưng với các mô hình AI mới, vai trò này đang thay đổi.
Một tác nhân AI có thể đảm nhiệm nhiều bước liên tiếp trong cùng một quy trình. Nó có thể thu thập dữ liệu, phân tích thông tin, viết mã, kiểm tra mã, sửa lỗi, mô phỏng một tình huống và tiếp tục sử dụng kết quả để thực hiện bước tiếp theo.
Khi nhiều tác nhân AI được kết hợp, mỗi tác nhân có thể đảm nhiệm một nhiệm vụ khác nhau.
Một tác nhân có thể thu thập thông tin.
Tác nhân khác viết phần mềm.
Một hệ thống khác kiểm tra mã.
Một hệ thống khác phân tích kết quả mô phỏng.
Tất cả được kết nối thành một quy trình tương đối liền mạch.
Đây chính là lý do khiến khả năng lạm dụng AI trở nên đáng lo ngại hơn khi công nghệ ngày càng phát triển.
Các đối tượng bị phát hiện tìm cách vượt qua biện pháp kiểm soát
Một vấn đề khác được Anthropic đề cập là những người muốn sử dụng AI cho mục đích xấu không đơn giản chấp nhận việc tài khoản bị khóa.
Theo báo cáo, một số nhóm bị phát hiện đã tìm cách tiếp cận Claude thông qua các máy chủ trung gian ở nhiều quốc gia.
Các tài khoản cũng được cho là sử dụng danh tính giả hoặc nhiều hình thức thanh toán và thông tin đăng ký không chính thống.
Khi một tài khoản bị chặn, những người này có thể tìm cách chuyển sang tài khoản khác.
Điều này tạo ra một cuộc chạy đua giữa các nhà phát triển AI và những người muốn khai thác mô hình cho mục đích bất hợp pháp.
Nếu nhà phát triển tăng cường hệ thống phát hiện, những người lạm dụng lại tìm cách thay đổi phương thức truy cập.
Đây là lý do tại sao việc kiểm soát AI không thể chỉ dựa vào việc khóa từng tài khoản.
Các nhà cung cấp mô hình cần phát triển hệ thống phát hiện hành vi bất thường, kiểm soát quyền truy cập, giám sát hoạt động và phối hợp với các cơ quan chức năng khi phát hiện nguy cơ nghiêm trọng.
Tại sao AI ngày càng khó kiểm soát?
Một trong những nguyên nhân là năng lực của mô hình AI đang tăng nhanh.
Một mô hình chỉ có khả năng trả lời câu hỏi sẽ tạo ra mức rủi ro khác hoàn toàn so với một mô hình có thể sử dụng công cụ, viết phần mềm, xử lý dữ liệu và thực hiện nhiều nhiệm vụ liên tiếp.
Khi khả năng tự động hóa tăng lên, lượng công việc con người phải trực tiếp thực hiện giảm xuống.
Điều này có thể tạo ra lợi ích lớn cho doanh nghiệp và người dùng hợp pháp, nhưng đồng thời cũng có thể tạo ra lợi thế cho những người muốn sử dụng AI vào mục đích nguy hiểm.
Vì vậy, câu hỏi quan trọng trong giai đoạn AI hiện nay không còn chỉ là “AI thông minh đến đâu?” mà còn là “AI có thể tự mình thực hiện bao nhiêu công việc?”.
Khoảng cách giữa hai câu hỏi này có ý nghĩa rất lớn đối với an ninh mạng, quốc phòng, nghiên cứu sinh học và an toàn xã hội.
Các công ty AI phải đối mặt với bài toán mới
Những phát hiện của Anthropic đặt ra thách thức trực tiếp cho toàn ngành AI.
Các công ty phát triển mô hình ngày càng phải cân bằng giữa hai mục tiêu tưởng như đối lập.
Một mặt, họ phải phát triển các mô hình đủ mạnh để cạnh tranh trong lập trình, nghiên cứu khoa học, phân tích dữ liệu và tự động hóa doanh nghiệp.
Mặt khác, họ phải ngăn những năng lực tương tự bị khai thác cho các mục đích nguy hiểm.
Đây không phải bài toán có thể giải quyết hoàn toàn bằng một bộ lọc nội dung.
Một người dùng có thể không trực tiếp yêu cầu AI tạo ra một sản phẩm nguy hiểm, nhưng có thể chia nhỏ quá trình thành nhiều yêu cầu tưởng như riêng biệt.
Khi kết hợp lại, những yêu cầu đó có thể tạo thành một quy trình hoàn chỉnh.
Vì vậy, các hệ thống an toàn AI ngày càng cần khả năng đánh giá cả bối cảnh và chuỗi hành vi thay vì chỉ kiểm tra từng câu hỏi riêng lẻ.
AI có thể trở thành một “đòn bẩy” mới cho tấn công mạng
Ngoài vũ khí và sinh học, tấn công mạng cũng là một lĩnh vực được nhắc đến trong báo cáo.
AI có khả năng hỗ trợ con người trong việc phân tích mã, tìm lỗi, tự động hóa một số tác vụ và xử lý lượng thông tin lớn.
Những năng lực này có giá trị rất lớn trong an ninh mạng hợp pháp, nhưng cũng có thể bị lạm dụng.
Điểm khác biệt so với các công cụ truyền thống là AI có thể giúp người dùng chưa có trình độ chuyên môn quá cao thực hiện một số nhiệm vụ phức tạp hơn.
Nếu xu hướng này tiếp tục, lợi thế về kỹ thuật trong hoạt động tấn công mạng có thể dần bị thu hẹp.
Điều đó khiến các doanh nghiệp, tổ chức tài chính, cơ quan chính phủ và hạ tầng quan trọng phải đầu tư mạnh hơn vào khả năng phòng thủ.
Anthropic cảnh báo rủi ro sẽ tăng cùng năng lực AI
Thông điệp quan trọng được Anthropic đưa ra là sự phát triển của AI phải đi kèm với các biện pháp bảo vệ tương ứng.
Nếu năng lực của mô hình tăng nhanh hơn khả năng kiểm soát, khoảng cách này có thể tạo ra những rủi ro mới.
AI không tự tạo ra động cơ phạm tội. Nhưng nó có thể trở thành một công cụ giúp những người đã có ý định xấu thực hiện công việc nhanh hơn, rộng hơn và hiệu quả hơn.
Đây là điểm khiến việc quản lý AI khác với việc quản lý một phần mềm thông thường.
Một phần mềm truyền thống thường thực hiện một nhóm chức năng tương đối cố định. Trong khi đó, mô hình AI có thể được sử dụng cho hàng nghìn mục đích khác nhau, tùy thuộc vào người sử dụng và công cụ mà nó được kết nối.
Những phát hiện được Anthropic công bố cho thấy cuộc tranh luận về an toàn AI đang bước sang một giai đoạn mới.
Trước đây, phần lớn lo ngại tập trung vào việc AI có thể cung cấp thông tin nguy hiểm. Nhưng khi các mô hình ngày càng có khả năng lập trình, sử dụng công cụ, phân tích dữ liệu và thực hiện nhiều nhiệm vụ liên tiếp, vấn đề đã chuyển sang một cấp độ khác: AI có thể tham gia trực tiếp vào quá trình thực hiện một hoạt động nguy hiểm đến mức nào?
Các trường hợp liên quan tới phát triển phần mềm quân sự, máy bay không người lái, nghiên cứu virus và tấn công mạng cho thấy khả năng này không còn hoàn toàn mang tính giả thuyết.
Điều đó không có nghĩa AI sẽ trở thành “chỉ huy” của mọi hoạt động nguy hiểm. Tuy nhiên, nó cho thấy ranh giới giữa công cụ hỗ trợ và tác nhân thực thi đang thay đổi nhanh chóng.
Trong những năm tới, cuộc cạnh tranh giữa các công ty AI có thể không chỉ xoay quanh việc mô hình nào thông minh hơn mà còn phụ thuộc vào việc mô hình nào có thể duy trì năng lực cao nhưng vẫn kiểm soát được rủi ro tốt hơn.
Khi AI ngày càng có khả năng hành động thay vì chỉ trả lời, yêu cầu về an toàn, giám sát và trách nhiệm cũng sẽ phải tăng tương ứng.
Câu hỏi về nguy cơ làm dụng AI
1. Anthropic phát hiện điều gì trong báo cáo mới?
Anthropic cho biết họ đã phát hiện và chặn nhiều trường hợp sử dụng Claude cho những hoạt động có nguy cơ gây hại, bao gồm phát triển vũ khí thông thường, nghiên cứu sinh học có khả năng bị lạm dụng, tấn công mạng và giám sát trái phép.
2. AI có thực sự tự phát triển vũ khí hay không?
Không nên hiểu theo nghĩa AI tự mình chế tạo một hệ thống vũ khí hoàn chỉnh. Theo nội dung báo cáo, AI được sử dụng để hỗ trợ nhiều công đoạn kỹ thuật như lập trình, mô phỏng, phân tích và thiết kế. Con người vẫn đóng vai trò xác định mục tiêu và tổ chức quá trình.
3. Vì sao AI trong nghiên cứu sinh học lại đáng lo ngại?
AI có khả năng xử lý lượng kiến thức khoa học lớn và hỗ trợ các bước nghiên cứu. Nếu bị sử dụng sai mục đích, năng lực này có thể làm giảm rào cản kiến thức đối với những nghiên cứu có nguy cơ gây hại, đặc biệt trong lĩnh vực virus và sinh học.
4. “AI từ cố vấn thành chỉ huy” nghĩa là gì?
Khái niệm này mô tả sự chuyển dịch từ việc AI chỉ trả lời câu hỏi sang việc AI có thể thực hiện nhiều nhiệm vụ liên tiếp. AI có thể thu thập thông tin, viết mã, kiểm tra, mô phỏng và phân tích kết quả thay vì chỉ đưa ra một câu trả lời cho người dùng.
5. Vì sao các đối tượng lạm dụng AI khó bị ngăn chặn hoàn toàn?
Những người muốn lạm dụng AI có thể sử dụng nhiều tài khoản, thay đổi phương thức truy cập hoặc tìm cách vượt qua các biện pháp kiểm soát. Vì vậy, việc bảo vệ AI cần kết hợp giữa kiểm soát tài khoản, phát hiện hành vi bất thường, giám sát hệ thống và hợp tác với cơ quan chức năng.
6. AI có phải là mối đe dọa tất yếu đối với an ninh không?
Không. AI đồng thời mang lại nhiều lợi ích lớn trong khoa học, y tế, lập trình, giáo dục và kinh doanh. Rủi ro chủ yếu đến từ cách con người sử dụng công nghệ. Thách thức hiện nay là xây dựng các biện pháp bảo vệ đủ mạnh để hạn chế việc AI bị khai thác cho mục đích nguy hiểm mà không làm mất đi những lợi ích hợp pháp của công nghệ.
Theo dõi những diễn biến mới nhất về AI và công nghệ
Cập nhật nhanh các tin tức nổi bật về trí tuệ nhân tạo, công nghệ, tài chính, doanh nghiệp và những thay đổi đang tác động đến thị trường toàn cầu tại Điểm Tin Nhanh.
Xem tin mới nhất tại DiemTinNhanh.com



