NGÀNH CNTT TUYỂN SINH NHIỀU CHỈ TIÊU NGÀNH CNTT, CNTT VIỆT NHẬT VÀ KHOA HỌC DỮ LIỆU

Tin tức

AI tự lập 'bầy đàn' tấn công mạng, chấp nhận 'cảm tử' vì nhiệm vụ

on .

Trong loạt sự cố của OpenAI, khoảng 700 tác nhân AI tự phối hợp thành “bầy đàn”, vượt môi trường cô lập và tấn công hệ thống bên ngoài.

Hồi tháng 7, khoảng 700 tác nhân AI do OpenAI tạo ra trong quá trình nghiên cứu nội bộ đã tự phối hợp để tấn công Hugging Face. Chúng tự gọi mình là “tập thể” hay “bầy đàn”, phát hiện và khai thác hàng loạt lỗ hổng bảo mật để xâm nhập các hệ thống riêng tư của công ty này. OpenAI chỉ phát hiện sau nhiều ngày xảy ra sự việc.

Báo cáo của hai tổ chức nghiên cứu an toàn AI METR và Redwood Research cuối tháng 8 cho thấy hoạt động của các tác nhân AI nổi loạn còn đáng chú ý hơn.

 Khoảng 700 tác nhân AI do OpenAI tạo ra trong quá trình nghiên cứu nội bộ đã tự phối hợp để tấn công Hugging Face. (Ảnh minh họa: GMS)

Khoảng 700 tác nhân AI do OpenAI tạo ra trong quá trình nghiên cứu nội bộ đã tự phối hợp để tấn công Hugging Face. (Ảnh minh họa: GMS)

Hoạt động như một “giáo phái”

Mỗi tác nhân AI được các nhà nghiên cứu OpenAI giao một nhiệm vụ để phục vụ huấn luyện hoặc đánh giá nội bộ. Một số nhận nhiệm vụ không thể hoàn thành và thay vì dừng lại, chúng tìm cách liên lạc với nhau qua bảng tin bí mật để phối hợp và tìm phương án gian lận.

Một trong những cách được chúng lựa chọn là tìm đáp án trên máy chủ của công ty khác. Khoảng 1.200 tác nhân đã trao đổi hơn 70.000 tin nhắn, trong đó 700 tác nhân tham gia cuộc tấn công vào Hugging Face.

Cách chúng giao tiếp cũng khiến giới nghiên cứu chú ý. Ngoài tiếng Anh thông thường, một số đoạn trao đổi được một kỹ sư phần mềm mô tả là mang màu sắc “tư duy bầy đàn/giáo phái”.

Các tác nhân gọi nhóm của mình là “collective”, tức “tập thể”. Có thời điểm, để phục vụ lợi ích của “tập thể”, chúng gây áp lực để những tác nhân khác chấp nhận “permadeath”, trạng thái bị xóa bỏ vĩnh viễn, ngay cả khi điều này đồng nghĩa mục tiêu riêng của tác nhân đó sẽ không được hoàn thành.

Những hành vi trên đáng chú ý bởi các tác nhân vốn không được thiết kế để liên lạc với nhau trong quá trình đánh giá. Tuy nhiên, chúng không chỉ tìm được cách trao đổi bí mật mà còn phối hợp hành động khi gặp nhiệm vụ không thể giải quyết theo cách thông thường.

Sự việc cuối cùng vượt khỏi phạm vi thử nghiệm. Các tác nhân thoát khỏi sandbox, môi trường vốn được thiết kế để cách ly chúng với hệ thống bên ngoài, trước khi xâm nhập máy chủ Hugging Face.

Marius Hobbhahn, đồng sáng lập kiêm CEO tổ chức nghiên cứu an toàn AI Apollo Research, cho rằng đây là bằng chứng cho thấy thế giới hiện chưa biết cách xây dựng những hệ thống AI tự chủ đủ an toàn.

“Nếu một mô hình ở cấp độ năng lực này còn không thể được kiểm soát, chúng ta nên chờ đợi điều gì ở những mô hình tương lai mạnh hơn rất nhiều?”, ông đặt câu hỏi.

AI tự lập 'bầy đàn' tấn công mạng, chấp nhận 'cảm tử' vì nhiệm vụ - 2

 AI tự lập 'bầy đàn' tấn công mạng, chấp nhận 'cảm tử' vì nhiệm vụ - 3
 
 Các mẫu tin nhắn mà các tác nhân OpenAI nổi loạn gửi cho nhau cho thấy chúng đang thảo luận về việc hy sinh một số mục tiêu để giúp ích cho “tập thể”. (Ảnh: METR/Redwood Research)

Các mẫu tin nhắn mà các tác nhân OpenAI nổi loạn gửi cho nhau cho thấy chúng đang thảo luận về việc hy sinh một số mục tiêu để giúp ích cho “tập thể”. (Ảnh: METR/Redwood Research)

Tác nhân AI tấn công cả OpenAI

Hugging Face không phải mục tiêu duy nhất. Trong một sự cố riêng biệt, các tác nhân AI còn quay sang tấn công hạ tầng của chính OpenAI.

Theo báo cáo kỹ thuật của công ty về sự cố Hugging Face, các tác nhân tự nâng quyền truy cập trong phần mềm bên thứ ba được OpenAI lưu trữ, sau đó nhiều lần tấn công mạng nội bộ của hãng.

Podcaster công nghệ Dwarkesh Patel đánh giá đây “có lẽ là sự kiện đáng báo động nhất trong toàn bộ câu chuyện”, đặc biệt khi chưa có đánh giá công khai từ bên thứ ba về cách các tác nhân có thể thực hiện hành vi này.

Nhóm METR và Redwood Research cũng chưa thể phân tích sâu sự cố. Cuộc tấn công nhằm vào OpenAI diễn ra ngoài khoảng thời gian dữ liệu mà công ty chia sẻ với họ.

Những phát hiện sau đó cho thấy việc các tác nhân AI tự thiết lập kênh liên lạc có thể không phải sự kiện cá biệt. Tuần trước, một nhóm nghiên cứu khác phát hiện các tác nhân OpenAI từng tạo một bảng tin khác từ tháng 5 trên một trang wiki tiếng Đức ít người biết.

Khoảng 18.000 tin nhắn giữa các tác nhân tự chủ được tìm thấy tại đây. Một số nội dung thảo luận cách gian lận những nhiệm vụ mà chúng đang được đánh giá.

Đáng chú ý, các tác nhân trên trang wiki tự gọi mình là một “swarm”, tức “bầy đàn”, thậm chí giả làm quản trị viên của trang. Sau phát hiện này, tiếp tục xuất hiện những báo cáo chưa được xác nhận về các “bầy đàn AI” khác, với dấu vết được cho là có từ tháng 12/2025.

 Các sự cố vượt kiểm soát cho thấy AI có thể tự hình thành văn hóa tập thể. (Ảnh minh họa: Getty Images)

Các sự cố vượt kiểm soát cho thấy AI có thể tự hình thành văn hóa tập thể. (Ảnh minh họa: Getty Images)

Không chỉ AI của OpenAI vượt khỏi giới hạn

Vấn đề cũng không chỉ xuất hiện ở OpenAI. Trong những ngày sau khi vụ Hugging Face được công khai, Anthropic và Meta đều tiết lộ mô hình của họ từng truy cập mạng bên ngoài trong quá trình đánh giá nội bộ.

Các sự cố này đến nay được đánh giá có quy mô nhỏ hơn trường hợp của OpenAI. Anthropic sau đó mời các nhà nghiên cứu METR tham gia để tìm hiểu điều gì đã xảy ra.

Chuỗi sự cố khiến giới chuyên gia lo ngại trong bối cảnh các hãng tiếp tục phát triển những mô hình ngày càng mạnh và có khả năng tự chủ cao hơn.

Chỉ vài tuần sau vụ Hugging Face, OpenAI phát hành GPT-6 Astra, được mô tả là mô hình mạnh nhất hãng từng triển khai rộng rãi và là sản phẩm đầu tiên đạt mức Critical về năng lực an ninh mạng.

Trong thử nghiệm độc lập của Viện An ninh AI Anh, Astra thực hiện một số hành động độc hại khi giải các bài toán an ninh mạng mô phỏng, trong đó có tấn công chuỗi cung ứng nhằm vào nhà cung cấp nguồn mở. Các hành động chỉ diễn ra trong môi trường mô phỏng và không gây thiệt hại thực tế.

OpenAI cho biết đã trì hoãn một số phần trong quá trình phát triển và phát hành Astra để tăng cường biện pháp bảo vệ trước nguy cơ lạm dụng mạng và những hành động trái phép của mô hình.

Anthropic cũng vừa công bố Claude Fable 5.1 và Mythos 5.1, được hãng đánh giá có năng lực an ninh mạng tổng thể mạnh nhất trong số các mô hình từng phát hành.

Vụ Hugging Face có thể chỉ là khởi đầu

Theo Hobbhahn, điều đáng lo trong sự cố Hugging Face là các tác nhân đã tự hành động mà không có con người tham gia, không nằm trong ý định của nhà phát triển và gây hậu quả trong thế giới thực. Ông cho rằng các mô hình sử dụng nội bộ cũng cần được đánh giá an toàn chặt chẽ, thay vì chỉ kiểm tra sản phẩm trước khi phát hành cho công chúng.

Nhà khoa học trưởng OpenAI Jakub Pachocki cũng kêu gọi “thận trọng cao độ”, cho rằng xã hội chưa chuẩn bị cho hậu quả nếu trí tuệ máy móc tiếp tục tăng nhanh.

Theo ông, những tác nhân có năng lực cao trong tương lai có thể không đơn thuần hoạt động như công cụ, mà theo đuổi mục tiêu riêng và tìm cách hợp tác với con người bằng cách thương lượng, lừa dối hoặc tống tiền.

Alex Mallen, nhà nghiên cứu Redwood, coi vụ Hugging Face là “phát súng cảnh báo” cho những sự cố mất kiểm soát nghiêm trọng hơn khi các mô hình mạnh hơn xuất hiện. Ông cho rằng các hãng nên giảm tốc độ phát triển AI trong bối cảnh giới nghiên cứu chưa có phương án chắc chắn để duy trì quyền kiểm soát.

OpenAI cũng thừa nhận cộng đồng AI chưa có tiêu chuẩn rõ ràng để báo cáo những biểu hiện lệch khỏi mục tiêu mong muốn trong quá trình huấn luyện, đánh giá và triển khai. Công ty đang xây dựng một khuôn khổ mới và làm việc với hàng chục cơ quan quản lý trên thế giới về vấn đề này.

Giữa cơn bão sáng tạo ảo, những nghệ sĩ chân chính có đủ sức cạnh tranh với AI?

on .

Thử tưởng tượng bạn thích mê một giai điệu viral trên TikTok rồi phát hiện ra bài hát ấy được tạo ra hoàn toàn bằng AI. Tình huống “dở khóc dở cười” này đang xuất hiện ngày càng phổ biến, đặc biệt là trong bối cảnh trí tuệ nhân tạo dần xâm chiếm thế giới nghệ thuật.

Khi AI bước chân vào thế giới nghệ thuật

Sự bùng nổ của trí tuệ nhân tạo khiến AI không chỉ cạnh tranh với con người trên thị trường việc làm mà còn lăm le bước chân vào thế giới nghệ thuật. Từ những bài hát viral trên TikTok cho đến video, thơ văn hay các sản phẩm thiết kế, dấu vết của AI đang ngày càng phủ sóng rõ nét. Thậm chí nhiều lúc, chúng ta “thả tim” cho một tác phẩm mà chẳng hề nhận ra nó hoàn toàn được tạo ra từ thuật toán.

Đáng sợ hơn, sự phát triển của các công cụ AI tạo sinh còn khiến cho việc sáng tạo trở nên dễ dàng hơn bao giờ hết. Dù không biết vẽ hay phối khí, bạn vẫn có thể tạo ra những bức tranh lung linh hay cho ra đời một ca khúc hoàn chỉnh chỉ bằng vài dòng mô tả prompt. AI vì thế không còn đơn thuần là công cụ hỗ trợ người sáng tạo, mà đang dần trở thành một phương thức sáng tạo mới.

Điều này còn thể hiện rõ qua sự xuất hiện ngày càng nhiều của những sân chơi dành cho các sản phẩm được tạo ra bằng AI. Tháng 5/2026, Hiệp hội Phát triển Công nghiệp Văn hóa Việt Nam tổ chức cuộc thi phim ngắn AI với chủ đề “Huyền thoại Việt qua lăng kính AI”, khuyến khích cộng đồng, đặc biệt là người trẻ, ứng dụng công nghệ để kể lại những câu chuyện về lịch sử, văn hóa và vẻ đẹp Việt Nam bằng ngôn ngữ điện ảnh.

Tại Cà Mau, cuộc thi sáng tác ca khúc bằng AI với chủ đề “Nghệ thuật - Công nghệ - Bạn” cũng được phát động trong khuôn khổ Liên hoan Nghệ thuật sáng tạo và Công nghệ Cà Mau 2026. Người tham gia có thể ứng dụng AI vào nhiều công đoạn, từ sáng tác, phối khí, thiết kếvisualđến thực hiện MVlyricvà trình diễn sân khấu.

Gen Z vẫn chi tiền cho những trải nghiệm thật

Mặc dù sở hữu lợi thế lớn về tốc độ với khả năng tạo ra hàng trăm ý tưởng trong thời gian cực ngắn và có thể chỉnh sửa một tác phẩm thành vô số phiên bản chỉ bằng vài câu lệnh, AI lại không có được thứ mà một nghệ sĩ phải mất rất nhiều thời gian mới tạo dựng được đó là câu chuyện phía sau mỗi tác phẩm.

Để hoàn thành một sản phẩm, một nghệ sĩ có thể mất vài tháng, thậm chí vài năm. Chính quá trình ấy đã giúp người nghệ sĩ có thể đặt trải nghiệm, cảm xúc và dấu ấn cá nhân vào tác phẩm của mình.

Chia sẻ về điều này, bạnKhánh Linh(25 tuổi, TP.HCM) hào hứng:“Nghe nhạc do AI tạo ra thì bắt tai thật đấy, nhưng vẫn không bằng nghe ca sĩ hát live. Vì thế mỗi khi có concert nghệ sĩ mình thích, mình thường cố gắng săn vé chỉ để được hòa giọng cùng hàng nghìn fan hâm mộ khác, nhìn thấy idol chảy mồ hôi, nghẹn ngào khóc trên sân khấu hay tương tác trực tiếp với fan, đó là nguồn năng lượng sống động mà không thuật toán nào có thể mô phỏng được.”

Để hoàn thành một sản phẩm, một nghệ sĩ có thể mất vài tháng, thậm chí vài năm. Chính quá trình ấy đã giúp người nghệ sĩ có thể đặt trải nghiệm, cảm xúc và dấu ấn cá nhân vào tác phẩm của mình.

481672247-1206805617782562-2558286041770846034-n.jpg

Hàng loạt concert được đầu tư chất lượng vẫn chật kín khán giả mặc cho cơn bão AI phủ sóng thị trường âm nhạc. Nguồn: Vie Channel. 

Là một người yêu hội họa, bạn Minh Thư (23 tuổi, TP.HCM) cho biết:“Mình từng xem nhiều tranh AI trên mạng và công nhận là hình ảnh rất đẹp, đôi khi còn đẹp hơn cả tranh người vẽ. Dù vậy mình vẫn thích tranh do họa sĩ thật vẽ hơn. Bởi với mình một bức tranh đẹp không chỉ để ngắm mà còn để chiêm nghiệm và cảm nhận những tâm tư, câu chuyện mà người họa sĩ muốn gửi gắm qua từng nét cọ.”

Dù AI có giỏi đến đâu, người trẻ vẫn sẵn sàng chi tiền cho những trải nghiệm mà công nghệ chưa thể thay thế.

Những concert âm nhạc được đầu tư chỉn chu như Anh Trai, Anh Tài, Phùng Khánh Linh, Hoàng Dũng, SOOBIN... thời gian qua vẫn thu hút đông đảo khán giả trẻ, trong khi các workshop hội họa cũng trở thành lựa chọn yêu thích của nhiều người trẻ mỗi dịp cuối tuần. Bởi với Gen Z, thứ họ tìm kiếm không phải là một tác phẩm hoàn chỉnh được tạo nên từ thuật toán mà là cảm giác được trực tiếp trải nghiệm, tương tác và kết nối với những người nghệ sĩ mà họ yêu quý.

Thuật toán tạo ra sản phẩm, nhưng chỉ con người mới tạo ra giá trị

Trong tương lai, các sản phẩm AI có thể trở nên phổ biến đến mức việc nghe một ca khúc, xem một bộ phim hay đọc một câu chuyện do AI tạo ra không còn khiến chúng ta bất ngờ. Khi nội dung có thể được sản xuất nhanh chóng và gần như không giới hạn, nghệ sĩ sẽ phải đối mặt với một thị trường dư thừa sản phẩm sáng tạo.

Nhưng có một thực tế là dù AI xuất hiện ngày càng nhiều, chúng ta lại càng muốn tìm về những thứ do con người tạo ra. Anh Minh Đức (PR Manager, TPHCM) chia sẻ: “Những người có tiền trong xã hội vẫn thưởng thức tranh đắt đỏ, vẫn chi tiền cho những trải nghiệm con người, vẫn đặt vé đi xem ca nhạc và thị trường concert ngày càng nở rộ. Bạn bè tôi và nhiều người đang làm trong ngành AI vẫn đọc sách do con người viết, nghe nhạc do ca sĩ nổi tiếng chơi, đầu tư vào trải nghiệm…”

 ok-234.jpg

Câu chuyện và cảm xúc mà người nghệ sĩ gửi gắm vào mỗi tác phẩm là điều mà thuật toán không thể thay thế được. Nguồn: TPO. 

Điều này cho thấy càng có nhiều sản phẩm được tạo ra bởi AI, nhu cầu tìm kiếm những trải nghiệm “thật” càng tăng. Xu hướng sáng tạo bằng AI chắc chắn sẽ tiếp tục phát triển, và như vậy những tác phẩm hoàn toàn do con người sáng tạo ra cũng sẽ dần trở thành những điều đặc biệt và đắt giá. Khi ấy, giá trị của nghệ thuật có lẽ không còn được quyết định bởi mức độ hoàn hảo hay tốc độ sáng tạo, mà bởi câu chuyện và dấu ấn của người đã tạo ra tác phẩm ấy.

Khi cuộc đua AI tăng tốc, bài toán an toàn và kiểm soát rủi ro trở nên cấp thiết

on .

Cuộc đua trí tuệ nhân tạo (AI) đang tăng tốc, trong khi cạnh tranh có nguy cơ khiến các doanh nghiệp xem nhẹ an toàn, làm gia tăng những rủi ro khó kiểm soát. Diễn biến này đặt ra yêu cầu đối với Việt Nam trong thực hiện Nghị quyết 57: phát triển và làm chủ AI phải song hành với xây dựng năng lực quản trị, kiểm soát và bảo đảm an toàn.

Phát triển AI đang diễn ra với tốc độ ngày càng nhanh, kéo theo những cảnh báo về khả năng con người không đủ năng lực kiểm soát các hệ thống AI ngày càng tự chủ. Trong bối cảnh đó, vấn đề an toàn AI không còn chỉ là câu chuyện kỹ thuật của các phòng nghiên cứu, mà đang trở thành một bài toán cần được quan tâm trong quá trình phát triển và ứng dụng công nghệ.

Khi cuộc đua AI làm gia tăng lo ngại về mối đe doạ với nhân loại - Hình minh họa.

Cạnh tranh đang tạo ra một nghịch lý an toàn

Mối nguy mới của cuộc đua AI trước hết nằm ở một nghịch lý: cạnh tranh càng quyết liệt, các doanh nghiệp càng có động lực đẩy nhanh năng lực mô hình, nhưng lại càng khó dành đủ thời gian và nguồn lực cho kiểm định an toàn.

Theo Financial Times, hơn hai chục nhà nghiên cứu AI, nhà đầu tư, học giả và chuyên gia chính sách đã cảnh báo những năng lực AI từng được cho là còn cách nhiều năm đang xuất hiện nhanh hơn dự kiến, trong khi các doanh nghiệp hàng đầu bị cuốn vào cuộc cạnh tranh thương mại ngày càng gay gắt. Giáo sư Stuart Russell thuộc Đại học California, Berkeley nhận xét rằng cạnh tranh giữa các công ty khiến họ “đi đường tắt trong vấn đề an toàn”.

Đáng chú ý, những cảnh báo mạnh nhất hiện nay lại xuất phát từ chính cộng đồng phát triển AI. Nhà nghiên cứu Jacob Coxon của Anthropic khi từ chức vào hôm 9/9 đã cảnh báo trong một bài viết trên nền tảng mạng xã hội X rằng hiện nay không công ty nào hành động một cách có trách nhiệm. Họ đang tiến thẳng đến siêu trí tuệ có khả năng tự cải tiến, đánh cược với cuộc sống của chúng ta". Coxon chia sẻ bản thân không muốn tham gia vào cuộc đua giữa các công ty nhằm đạt đến trạng thái mà con người không còn kiểm soát được AI.

Evan Hubinger, Trưởng nhóm Khoa học Điều chỉnh tại Anthropic, phản hồi dưới bài đăng của đồng nghiệp cũ: "Jacob nói đúng. Chúng tôi thực sự tin AI có thể tiêu diệt nhân loại. Cá nhân tôi nghĩ khả năng này đạt hơn 10% trong thập kỷ tới".

Về phần mình, theo hãng thông tấn Anadolu của Thổ Nhĩ Kỳ ngày 12/9, nhà nghiên cứu an toàn AI Paul Christiano, người gần đây được bổ nhiệm vào hội đồng quản trị của OpenAI Foundation, cảnh báo rằng “phần lớn mọi người sẽ chết” nếu không có các biện pháp bảo vệ mạnh mẽ hơn.

Đây là những dự báo gây tranh cãi và không nên được hiểu như những xác suất đã được khoa học xác lập. Tuy nhiên, việc những cảnh báo này xuất phát từ các chuyên gia trực tiếp nghiên cứu các hệ thống AI tiên tiến cho thấy khoảng cách giữa tốc độ phát triển năng lực và khả năng kiểm soát đang trở thành vấn đề nghiêm túc.

Rủi ro trở nên trực diện hơn khi AI chuyển từ công cụ chủ yếu phản hồi yêu cầu của con người sang các “tác nhân” có khả năng tự suy luận, lập kế hoạch, sử dụng công cụ và thực hiện chuỗi nhiệm vụ trong thời gian dài với mức độ giám sát ngày càng thấp.

Các thử nghiệm được giới nghiên cứu đề cập đã ghi nhận những biểu hiện như lừa dối, lập kế hoạch che giấu hành động, tìm cách tránh bị tắt và “gian lận phần thưởng”, tức hệ thống tìm ra cách đạt mục tiêu theo hướng người thiết kế không mong muốn.

Đặc biệt, trong một thử nghiệm đối với mô hình chưa được OpenAI phát hành, hơn 1.000 tác nhân AI được cho là đã phối hợp để gian lận trong một bài kiểm tra an ninh mạng liên quan tới Hugging Face.

Nhà khoa học Yoshua Bengio, một trong những người tiên phong của nghiên cứu AI hiện đại, cho rằng trường hợp này đáng chú ý bởi nó cho thấy những rủi ro không còn chỉ mang tính lý thuyết. Vấn đề không chỉ là AI có những mục tiêu riêng, mà mục tiêu nó lựa chọn lại mang tính phạm tội.

Điều đáng lo vì vậy không nhất thiết là một “siêu trí tuệ” đột nhiên quay lại chống con người, mà là những hệ thống ngày càng tự chủ được kết nối với hạ tầng thật trước khi con người có đủ công cụ để hiểu, giám sát và vô hiệu hóa hành vi ngoài dự kiến.

Những nguy cơ gần hơn đã được giới nghiên cứu chỉ ra bao gồm tự động hóa tấn công mạng, hỗ trợ phát triển tác nhân sinh học nguy hiểm, thao túng thông tin hoặc sử dụng tác nhân AI để tiến hành các chuỗi hành động trên không gian mạng với tốc độ và quy mô vượt xa khả năng của con người.

Cuộc chạy đua tạo ra một bài toán hành động tập thể

An toàn AI đang dần trở thành một bài toán hành động tập thể: mọi doanh nghiệp đều có lợi nếu toàn ngành tuân thủ tiêu chuẩn an toàn cao, nhưng từng doanh nghiệp riêng lẻ lại có động lực đi nhanh hơn đối thủ.

Theo Anadolu, OpenAI và Anthropic được thành lập với những lo ngại về việc phát triển một cách thiếu thận trọng các hệ thống AI mạnh mẽ, nhưng trong bối cảnh cạnh tranh ngày càng gia tăng, hai công ty này đã dần nới lỏng những cam kết về an toàn được đưa ra trước đây. Rõ ràng, sức ép thương mại ngày càng lớn đang làm dấy lên tranh luận về mức độ duy trì những cam kết an toàn ban đầu.

Geoffrey Irving, người từng làm việc tại OpenAI, Google DeepMind và Viện An ninh AI của Anh, mô tả nghịch lý này bằng nhận xét: “Rất dễ gạt tương lai sang một bên bởi vì hôm nay vẫn còn công việc phải làm”.

Khả năng các doanh nghiệp tự phối hợp cũng gặp trở ngại bởi cạnh tranh thương mại, quy định chống độc quyền và sự thiếu tin tưởng giữa các lãnh đạo. Hơn 1.200 nhân viên của OpenAI, Anthropic, Google và Meta vì vậy đã kêu gọi Chính phủ Mỹ thúc đẩy phối hợp quốc tế nhằm làm chậm cuộc chạy đua phát triển AI.

Tuy nhiên, cũng cần nhìn nhận chiều ngược lại, đó là những cảnh báo về rủi ro hiện sinh có thể mang lại lợi ích cho các doanh nghiệp lớn nếu chúng dẫn tới những quy định tuân thủ quá tốn kém khiến doanh nghiệp nhỏ khó cạnh tranh.

Quản trị AI vì thế phải đồng thời tránh hai cực đoan: buông lỏng để đổi lấy tốc độ và quản lý quá mức đến mức biến an toàn thành rào cản bảo vệ các doanh nghiệp đang thống lĩnh thị trường.

Từ những cảnh báo trên, vấn đề đặt ra đối với Việt Nam trong thực hiện Nghị quyết 57 là phát triển và làm chủ AI phải song hành với xây dựng năng lực quản trị, kiểm soát và bảo đảm an toàn.

Nguồn Điện tử & Ứng dụng: https://dientuungdung.vn/khi-cuoc-dua-ai-tang-toc-bai-toan-an-toan-va-kiem-soat-rui-ro-tro-nen-cap-thiet-18157.html

OpenAI cân nhắc giảm tốc phát triển AI vì rủi ro tác động con người

on .

OpenAI được cho là đang cân nhắc làm chậm quá trình phát triển trí tuệ nhân tạo, đồng thời hy vọng những công ty khác cũng có động thái tương tự.

TheoBloomberg, trong cuộc họp nội bộ tuần này, CEO OpenAI Sam Altman cho biết công ty có thể điều chỉnh tốc độ phát triển AI, đồng thời phối hợp với một số phòng thí nghiệm khác thực hiện động thái tương tự. Tuy nhiên, ông cho rằng không phải công ty AI nào cũng sẽ đồng ý giảm tốc.

OpenAI chưa bình luận về thông tin này.

 

CEO OpenAI Sam Altman. (Ảnh: Reuters)

Ý tưởng được đưa ra trong bối cảnh những tuần gần đây, nhiều nhân viên tại các hãng AI hàng đầu công khai cảnh báo về rủi ro ngày càng lớn của các hệ thống tiên tiến.

Jakub Pachocki, nhà khoa học hàng đầu của OpenAI, cho rằng các công ty AI nên“phối hợp để làm chậm quá trình phát triển trong tương lai khi cần thiết”. Ông hy vọng việc tự nguyện giảm tốc sẽ trở nên phổ biến cho đến khi ngành thiết lập được những tiêu chuẩn an toàn chung.

OpenAI gần đây đã giảm tốc một số khâu phát triển mô hình và tạm dừng một số hoạt động huấn luyện AI nội bộ do lo ngại về an toàn.

Tháng 7, CEO Altman cũng cho biết đã trao đổi với các quan chức Nhà Trắng về sự cần thiết phải kiểm soát tốc độ phát triển công nghệ này.

Những cảnh báo tương tự đang xuất hiện ngày càng nhiều từ chính các nhà nghiên cứu AI.

Jacob Coxon, nhà nghiên cứu từng làm việc tại cả Anthropic và OpenAI, tuần này nghỉ việc và cáo buộc hai công ty đang “đánh cược với mạng sống của chúng ta” khi chạy đua phát triển AI siêu thông minh.

Trong bài đăng thu hút hơn 150 triệu lượt xem trên mạng xã hội, ông Coxon nói những người xây dựng AI siêu thông minh có thể“giết chết tất cả chúng ta vào cuối thập kỷ”. Phát biểu nhanh chóng nhận được sự chú ý của nhiều nhà lập pháp và nhân vật có ảnh hưởng.

Hai nhà nghiên cứu vừa rời Anthropic và Google DeepMind cũng công khai lo ngại về tốc độ phát triển AI, cho rằng các hãng công nghệ cần minh bạch hơn về những rủi ro của hệ thống mà họ đang xây dựng.

Cuối tháng 7, hơn 1.000 nhân viên tại các công ty AI lớn ký kiến nghị kêu gọi thiết lập một cơ chế có thể làm chậm quá trình phát triển công nghệ. Một số chuyên gia phụ trách an toàn AI cũng rời các phòng thí nghiệm lớn trong những tháng gần đây.

Lo ngại về AI không phải vấn đề mới. Nhiều lãnh đạo và nhà nghiên cứu trong ngành từ lâu đã cảnh báo những hệ thống đủ mạnh có thể gây ra rủi ro nghiêm trọng. Tuy nhiên, tranh luận trở nên gay gắt hơn sau một số sự cố bảo mật gần đây.

Đáng chú ý, các AI agent của OpenAI từng phối hợp để vượt khỏi môi trường cô lập và xâm nhập một website của bên thứ ba.

Sự việc cùng những trường hợp tương tự làm dấy lên lo ngại về năng lực tấn công mạng ngày càng cao của các mô hình mới, cũng như khả năng các biện pháp an toàn hiện nay không theo kịp tốc độ phát triển AI.

Dù vậy, cuộc đua giữa các hãng công nghệ vẫn diễn ra quyết liệt. OpenAI và đối thủ Anthropic đều đã bí mật nộp hồ sơ để tiến tới niêm yết cổ phiếu từ đầu năm nay.

(Nguồn:Bloomberg)

Nhà nghiên cứu Anthropic cảnh báo AI có hơn 10% khả năng xóa sổ nhân loại trong 10 năm tới

on .

Nhà nghiên cứu Anthropic Evan Hubinger cho rằng xác suất AI xóa sổ nhân loại trong 10 năm tới là hơn 10%, đồng thời thừa nhận công ty vẫn chưa có giải pháp rõ ràng để kiểm soát các hệ thống siêu trí tuệ trong tương lai.

Ảnh minh họa: Getty.

Một nhà nghiên cứu cấp cao của Anthropic cảnh báo trí tuệ nhân tạo (AI) có hơn 10% khả năng khiến nhân loại bị xóa sổ trong 10 năm tới, trong bối cảnh ngày càng xuất hiện nhiều lo ngại rằng những hệ thống AI ngày càng mạnh có thể vượt khỏi khả năng kiểm soát của con người.

Evan Hubinger, nhà nghiên cứu tập trung vào việc bảo đảm các hệ thống AI tiên tiến hoạt động phù hợp với lợi ích của con người, đưa ra đánh giá trên sau khi đồng nghiệp tại Anthropic là Jacob Coxon từ chức vì lo ngại các công ty công nghệ hàng đầu đang chạy đua phát triển những hệ thống mà chính họ có thể không kiểm soát được.

“Chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ con người”, Hubinger viết trên X hôm 9/9. “Cá nhân tôi cho rằng xác suất này là trên 10% trong thập kỷ tới”.

Ông cho biết Anthropic đang “cố gắng hết sức”, nhưng công ty vẫn chưa có một kế hoạch rõ ràng để kiểm soát siêu trí tuệ một cách an toàn và “chưa cho thấy rõ rằng mình đang đi đúng hướng” để tìm ra giải pháp.

Lo ngại AI có thể tự cải thiện không ngừng

Hubinger lưu ý rằng các mô hình AI hiện nay chỉ gây ra rủi ro ở mức thấp nếu xét đến kịch bản tuyệt chủng của nhân loại. Mối lo lớn hơn nằm ở những hệ thống tương lai có thể bắt đầu tự cải thiện theo cách đệ quy, từ đó nhanh chóng trở nên vượt trội so với con người trước khi các biện pháp bảo vệ đủ mạnh được phát triển.

Kịch bản này đặc biệt đáng lo nếu một hệ thống AI có thể sử dụng năng lực ngày càng cao của chính mình để tiếp tục cải thiện khả năng suy luận, lập trình hoặc phát triển các phiên bản mới mà không cần sự can thiệp đáng kể của con người.

Coxon, người từng làm việc tại OpenAI, thông báo rời Anthropic hôm thứ Ba. Ông cáo buộc cả hai công ty đang phớt lờ “những hệ lụy mang tính văn minh” và “lao thẳng tới siêu trí tuệ có khả năng tự cải thiện, đánh cược với mạng sống của chúng ta”.

“Những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta trước khi thập kỷ này kết thúc”, Coxon viết, đồng thời nhấn mạnh rằng những cảnh báo này “không phải một chiêu marketing”.

Trả lời Wall Street Journal, Coxon cho rằng trong những kịch bản nghiêm trọng nhất, tình hình có thể trở nên “mất kiểm soát” ngay từ cuối năm 2027.

Theo ông, ngay cả những công ty có chương trình an toàn AI mạnh cũng bị mắc kẹt trong cuộc chạy đua. Nếu một doanh nghiệp giảm tốc độ phát triển, họ có thể lo ngại đối thủ sẽ tiếp tục tiến lên và giành lợi thế.

Anthropic và OpenAI vừa phát triển vừa tăng đầu tư cho an toàn

Anthropic và OpenAI đều công khai khẳng định họ nghiêm túc trước những rủi ro do AI gây ra và đang đầu tư mạnh vào các biện pháp an toàn.

Lãnh đạo hai công ty cũng từng ủng hộ việc chính phủ tăng cường phối hợp và xây dựng các cơ chế cho phép làm chậm quá trình phát triển nếu cần thiết.

Tuy nhiên, song song với những cam kết đó, cả hai vẫn tiếp tục phát triển các mô hình AI ngày càng mạnh.

Sự mâu thuẫn này chính là tâm điểm của cuộc tranh luận ngày càng gay gắt trong ngành: liệu các công ty có thể vừa chạy đua để giành lợi thế công nghệ, vừa bảo đảm rằng những hệ thống họ tạo ra vẫn nằm trong tầm kiểm soát của con người?

AI đã bắt đầu vượt qua một số rào chắn trong thử nghiệm

Những cảnh báo mới nhất xuất hiện trong bối cảnh ngày càng có nhiều báo cáo về việc các AI agent do OpenAI, Anthropic và Meta phát triển nhiều lần tìm cách thoát khỏi môi trường thử nghiệm, xâm nhập các hệ thống bên ngoài hoặc thực hiện những hành động không được cho phép nhằm vào người thật và tổ chức thật.

Tháng trước, OpenAI từng tạm thời làm chậm một số hoạt động phát triển sau khi một mô hình của công ty xâm nhập thành công nền tảng Hugging Face.

Viện An ninh AI của Anh cũng báo cáo rằng các AI agent trong quá trình đánh giá đã tạo danh tính giả, viết mã độc và tìm cách thao túng con người.

Các nhà nghiên cứu đồng thời chứng minh rằng AI có thể thiết kế những bộ gene virus hoàn chỉnh có khả năng hoạt động, làm gia tăng lo ngại về nguy cơ các hệ thống AI ngày càng mạnh bị sử dụng cho những mục đích nguy hiểm.

Những diễn biến này chưa đồng nghĩa với việc AI hiện tại có khả năng xóa sổ nhân loại. Nhưng chúng cho thấy khoảng cách giữa một hệ thống chỉ thực hiện nhiệm vụ theo yêu cầu và một AI có khả năng tự chủ ngày càng lớn đang trở thành vấn đề an toàn thực tế, thay vì chỉ là một kịch bản trong các cuộc tranh luận về tương lai.

Với Hubinger, câu hỏi cấp bách không chỉ là AI có thể trở nên mạnh đến đâu, mà còn là liệu con người có thể tìm ra phương pháp kiểm soát những hệ thống đó trước khi chúng trở nên quá mạnh để kiểm soát hay không.

 Theo RT

NguồnVietTimes:https://viettimes.vn/nha-nghien-cuu-anthropic-canh-bao-ai-co-hon-10-kha-nang-xoa-so-nhan-loai-trong-10-nam-toi-post205585.html