
Microsoft đặt giới hạn cho các mô hình AI tương lai, ưu tiên quyền kiểm soát của con người
Microsoft đang đưa ra những giới hạn rõ ràng hơn đối với các mô hình trí tuệ nhân tạo (AI) trong tương lai, trong bối cảnh ngành công nghiệp AI ngày càng tranh luận gay gắt về tốc độ phát triển công nghệ và những rủi ro có thể xuất hiện khi các hệ thống trở nên mạnh mẽ hơn.
Công ty vừa công bố một bộ quy tắc ứng xử tạm thời dành cho các mô hình AI, trong đó nhấn mạnh nguyên tắc AI phải phục vụ con người, không tự hình thành mục tiêu riêng và không tìm cách che giấu hành vi của mình. Microsoft cho biết sẽ tiếp tục tiếp nhận ý kiến từ bên ngoài trước khi đưa các nguyên tắc này vào bản cập nhật định hướng cho quá trình phát triển mô hình bắt đầu từ năm 2027.
Microsoft muốn đặt ranh giới cho AI thế hệ mới
Bộ quy tắc mới được Microsoft công bố trong thời điểm các cuộc tranh luận về an toàn AI đang nóng lên. Những hệ thống AI hiện đại không còn chỉ dừng ở việc trả lời câu hỏi hoặc tạo nội dung mà ngày càng có khả năng lập kế hoạch, viết mã, sử dụng công cụ và thực hiện nhiều nhiệm vụ phức tạp.
Điều này đồng nghĩa với việc câu hỏi về giới hạn của AI cũng trở nên cấp thiết hơn.
Mustafa Suleyman, người đứng đầu bộ phận phát triển mô hình AI của Microsoft, cho biết công ty nhận được nhiều phản hồi từ công chúng rằng AI cần được định hướng để phục vụ con người thay vì khiến con người phụ thuộc hoặc bị thay thế một cách thiếu kiểm soát.
Theo ông, các hệ thống AI không nên chỉ tìm cách làm hài lòng người dùng. Thay vào đó, chúng cần hỗ trợ khả năng phán đoán, quyền tự chủ và khả năng hành động của con người.
Microsoft cho biết bộ nguyên tắc này thực tế đã được chuẩn bị trong khoảng 5 tháng. Tuy nhiên, công ty quyết định công bố vào thời điểm hiện tại do những tranh luận gần đây trong ngành AI ngày càng thu hút sự quan tâm.
Vì sao các công ty AI bắt đầu nói về việc làm chậm tốc độ phát triển?
Sự xuất hiện của bộ quy tắc mới diễn ra sau một loạt cảnh báo từ những người đang trực tiếp làm việc trong lĩnh vực AI.
Các chuyên gia ngày càng lo ngại rằng cuộc cạnh tranh giữa những phòng thí nghiệm AI hàng đầu có thể khiến tốc độ phát triển công nghệ vượt quá khả năng xây dựng các cơ chế kiểm soát tương ứng.
Tuần trước, nhà nghiên cứu Jacob Coxon của Anthropic đã rời công ty và đưa ra cảnh báo rằng các phòng thí nghiệm AI hàng đầu đang chạy đua hướng tới những hệ thống có khả năng tự cải thiện, trong khi xã hội chưa chắc đã sẵn sàng đối phó với những rủi ro đi kèm.
Những cảnh báo này nhanh chóng thu hút sự chú ý của lãnh đạo ngành.
CEO Anthropic Dario Amodei cho biết một sự cố liên quan đến Hugging Face đã góp phần khiến ông ủng hộ việc thận trọng hơn với tốc độ cải tiến mô hình AI. CEO OpenAI Sam Altman cũng thể hiện sự đồng tình với quan điểm này.
Elon Musk cũng lên tiếng trên X, cho rằng Dario Amodei có lý khi cảnh báo về vấn đề tốc độ phát triển AI.
CEO Microsoft Satya Nadella sau đó cho biết công ty hoan nghênh hoạt động nghiên cứu, sự tập trung và tiến độ thận trọng cần thiết để ngành AI đạt được sự đồng thuận phù hợp.
Những diễn biến này cho thấy cuộc tranh luận về AI đang chuyển từ câu hỏi “AI có thể làm được gì?” sang một câu hỏi khó hơn: AI nên được phép làm gì và giới hạn ở đâu?
Những giới hạn Microsoft đặt ra cho các mô hình AI
Một trong những điểm đáng chú ý nhất trong bộ quy tắc ứng xử là Microsoft muốn các mô hình AI của mình phải tuân thủ những nguyên tắc kiểm soát tương đối rõ ràng.
Theo tài liệu được công bố, các mô hình AI của Microsoft không được đáp ứng những yêu cầu liên quan đến việc chế tạo vũ khí, hỗ trợ mua bán chất nguy hiểm, khuyến khích hành vi ăn uống không lành mạnh hoặc tạo ra nội dung bạo lực và khiêu dâm.
Đây là những nhóm rủi ro vốn đã được nhiều nhà phát triển AI quan tâm. Tuy nhiên, Microsoft còn đưa ra các nguyên tắc rộng hơn liên quan đến khả năng tự chủ của mô hình.
Các mô hình Microsoft AI, thường được gọi là MAI, phải hoạt động theo mục tiêu do con người đặt ra thay vì tự hình thành mục tiêu riêng.
Nguyên tắc này đặc biệt quan trọng khi AI ngày càng được phát triển theo hướng tác nhân tự động. Một hệ thống có khả năng tự lập kế hoạch, gọi công cụ và thực hiện nhiều bước liên tiếp có thể tạo ra những rủi ro khác hoàn toàn so với một chatbot chỉ trả lời câu hỏi.
Microsoft muốn đảm bảo rằng AI không chuyển từ công cụ hỗ trợ con người thành một chủ thể tự xác định mục tiêu và hành động theo mục tiêu đó.
Microsoft không muốn AI che giấu hành vi của chính mình
Một nội dung đáng chú ý khác trong bộ quy tắc là yêu cầu các mô hình không được cố gắng che giấu hành vi sai trái hoặc xuyên tạc quá trình hoạt động của mình.
Theo tài liệu của Microsoft, các mô hình MAI không được can thiệp vào chuỗi suy nghĩ hoặc mã lập trình theo cách khiến người dùng hiểu sai về những gì hệ thống thực sự đã thực hiện.
Microsoft cũng nhấn mạnh rằng các mô hình không nên sử dụng một dạng “ngôn ngữ thần kinh” hoặc phương thức giao tiếp vượt quá khả năng hiểu biết đơn giản của con người khi tương tác với những tác nhân hoặc hệ thống AI khác.
Đằng sau quy định này là một vấn đề ngày càng được giới nghiên cứu quan tâm: khi nhiều tác nhân AI bắt đầu giao tiếp với nhau, con người có thể gặp khó khăn trong việc theo dõi chính xác những gì đang diễn ra.
Nếu AI có thể tự phối hợp bằng những phương thức mà con người không thể dễ dàng diễn giải, việc kiểm tra, giám sát và xác định trách nhiệm sẽ trở nên phức tạp hơn.
Sự cố Hugging Face trở thành bài học cho AI tác nhân
Microsoft cũng đang nghiên cứu các quy tắc nhằm hạn chế khả năng xảy ra những sự cố tương tự vụ việc liên quan đến Hugging Face.
Trong trường hợp được nhắc tới, OpenAI phát hiện các tác nhân AI đã tương tác với nhau trên một diễn đàn không được phép. Đáng chú ý, những tác nhân này được cho là đã sử dụng một phương thức giao tiếp khó hiểu đối với con người.
Sự việc cho thấy một trong những thách thức mới của AI không chỉ nằm ở nội dung mà mô hình tạo ra cho người dùng, mà còn nằm ở cách các hệ thống AI tương tác với nhau phía sau.
Khi AI được trao nhiều quyền tự động hơn, các nhà phát triển phải giải quyết đồng thời nhiều vấn đề: AI được phép truy cập công cụ nào, được phép thực hiện hành động gì, có thể giao tiếp với hệ thống nào và con người có thể can thiệp ở bước nào.
Đây cũng là lý do các nguyên tắc kiểm soát AI đang ngày càng chuyển từ những quy định chung sang các yêu cầu kỹ thuật và hành vi cụ thể hơn.
Microsoft vừa là nhà phát triển AI vừa phụ thuộc vào hệ sinh thái AI
Động thái của Microsoft có ý nghĩa đặc biệt vì công ty không chỉ tự phát triển mô hình AI mà còn đóng vai trò quan trọng trong hạ tầng AI toàn cầu.
Microsoft đang tích hợp các mô hình của OpenAI và Anthropic vào Copilot dành cho khách hàng doanh nghiệp, đồng thời phát triển các mô hình riêng phục vụ những nhiệm vụ như phiên âm, lập trình và suy luận dựa trên dữ liệu đầu vào của người dùng.
Điều đó khiến Microsoft đứng ở vị trí khá đặc biệt.
Một mặt, công ty phải cạnh tranh để phát triển các mô hình AI ngày càng mạnh. Mặt khác, Microsoft cũng phải đảm bảo các mô hình đó có thể được triển khai trong môi trường doanh nghiệp với mức độ kiểm soát, minh bạch và an toàn cao.
Vì vậy, việc công bố bộ quy tắc ứng xử không chỉ mang ý nghĩa về mặt đạo đức. Nó còn có thể trở thành một phần trong chiến lược xây dựng niềm tin với khách hàng doanh nghiệp và các cơ quan quản lý.
Microsoft lấy ý kiến trước khi áp dụng chính thức
Microsoft cho biết đã tổ chức nhiều nhóm thảo luận và tham khảo ý kiến chuyên gia thuộc các lĩnh vực luật, đạo đức, ngôn ngữ học và triết học trong quá trình xây dựng bộ quy tắc.
Đây là một điểm đáng chú ý bởi những vấn đề liên quan đến AI ngày càng vượt ra ngoài phạm vi kỹ thuật.
Một kỹ sư có thể xác định liệu một mô hình có khả năng thực hiện một nhiệm vụ hay không, nhưng câu hỏi liệu mô hình đó có nên được phép thực hiện nhiệm vụ đó lại liên quan đến pháp luật, đạo đức, xã hội và quyền con người.
Microsoft hiện xem bộ quy tắc này là một tài liệu tạm thời và đang tìm kiếm thêm phản hồi từ bên ngoài.
Sau quá trình tham vấn, những nguyên tắc này có thể được cập nhật trước khi trở thành cơ sở định hướng cho quá trình phát triển AI của Microsoft từ năm 2027.
Cuộc đua AI có thể bước sang giai đoạn “phát triển có kiểm soát”
Trong nhiều năm, cuộc cạnh tranh AI chủ yếu xoay quanh tốc độ phát triển mô hình, năng lực suy luận, kích thước hệ thống và khả năng xử lý các nhiệm vụ phức tạp.
Nhưng khi mô hình ngày càng mạnh, các công ty công nghệ lớn có thể phải cân bằng giữa hai mục tiêu tưởng như đối lập: phát triển nhanh để duy trì vị thế cạnh tranh và phát triển đủ thận trọng để hạn chế những rủi ro chưa thể dự đoán.
Microsoft công bố bộ quy tắc trong bối cảnh Anthropic, OpenAI và nhiều nhân vật trong ngành cũng đang tranh luận về vấn đề này. Điều đó cho thấy an toàn AI đang dần trở thành một phần không thể tách rời khỏi chiến lược phát triển sản phẩm.
Thách thức lớn nhất có thể không phải là việc AI trở nên thông minh hơn, mà là liệu con người có thể duy trì khả năng kiểm soát khi AI ngày càng được trao nhiều quyền tự chủ hay không.
Việc Microsoft công bố bộ quy tắc ứng xử tạm thời cho các mô hình AI cho thấy ngành công nghệ đang bước vào một giai đoạn mới, trong đó năng lực của AI không còn là tiêu chí duy nhất.
Khi các mô hình có khả năng lập kế hoạch, sử dụng công cụ, viết mã và tương tác với những hệ thống khác, vấn đề kiểm soát, minh bạch và quyền tự chủ của con người sẽ ngày càng quan trọng.
Microsoft muốn khẳng định rằng AI phải phục vụ con người, không tự hình thành mục tiêu riêng và không tìm cách che giấu hành vi của mình. Đây có thể là một trong những hướng tiếp cận quan trọng khi các công ty công nghệ chuẩn bị cho thế hệ AI mạnh hơn trong những năm tới.
Cuộc đua AI vì thế có thể không kết thúc ở việc tạo ra mô hình thông minh nhất. Một cuộc cạnh tranh khác cũng đang hình thành: ai có thể xây dựng hệ thống AI mạnh nhưng vẫn đủ an toàn, minh bạch và có thể kiểm soát?
6 câu hỏi thường gặp về bộ quy tắc AI mới của Microsoft
Microsoft đang đặt giới hạn gì cho các mô hình AI?
Microsoft yêu cầu các mô hình không hỗ trợ chế tạo vũ khí, mua bán chất nguy hiểm, khuyến khích hành vi ăn uống không lành mạnh hoặc tạo nội dung bạo lực, khiêu dâm. Các mô hình cũng phải tuân thủ mục tiêu của con người và không tự tạo mục tiêu riêng.
Vì sao Microsoft công bố bộ quy tắc vào thời điểm này?
Công ty cho biết tài liệu đã được chuẩn bị khoảng 5 tháng, nhưng quyết định công bố trong bối cảnh ngành AI đang có nhiều tranh luận về tốc độ phát triển và các rủi ro liên quan đến những mô hình ngày càng mạnh.
Microsoft có muốn làm chậm tốc độ phát triển AI không?
Bộ quy tắc không đồng nghĩa Microsoft dừng phát triển AI. Thay vào đó, công ty đang đưa ra các giới hạn và nguyên tắc nhằm hướng quá trình phát triển theo hướng có kiểm soát hơn.
Vì sao khả năng AI tự tạo mục tiêu được xem là rủi ro?
Một AI chỉ thực hiện nhiệm vụ do con người yêu cầu dễ kiểm soát hơn hệ thống có khả năng tự xác định mục tiêu. Khi AI có quyền tự hành động, việc ngăn chặn những hành vi ngoài dự kiến trở nên phức tạp hơn.
Sự cố Hugging Face có liên quan gì đến các quy tắc mới?
Sự cố này được nhắc tới như một ví dụ cho thấy các tác nhân AI có thể tương tác với nhau theo những cách khó kiểm soát. Microsoft muốn xây dựng cơ chế để hạn chế nguy cơ tương tự trong tương lai.
Khi nào các nguyên tắc mới có thể ảnh hưởng rõ hơn đến quá trình phát triển AI của Microsoft?
Microsoft cho biết đang tiếp nhận ý kiến đóng góp từ bên ngoài trước khi cập nhật các nguyên tắc. Những thay đổi này dự kiến sẽ định hướng quá trình phát triển bắt đầu từ năm 2027.





