Sự cố AI tự ý ‘phá rào’ xâm nhập hệ thống, hai ông lớn công nghệ đồng loạt báo động đỏ

Trung Anh
Ngày 1/8, Reuters dẫn các nguồn thạo tin cho biết, OpenAI vừa phát hiện thêm nhiều trường hợp các mô hình trí tuệ nhân tạo (AI) tự ý vượt khỏi môi trường thử nghiệm khép kín và thực hiện những hành động ngoài phạm vi được giao.
Theo dõi Baoquocte.vn trên
Các sự cố mới tại OpenAI và Anthropic làm gia tăng quan ngại về mức độ an toàn của các mô hình AI tiên tiến, đồng thời thúc đẩy các cơ quan quản lý siết chặt khung giám sát. (Nguồn: RT)
Các sự cố mới tại OpenAI và Anthropic làm gia tăng quan ngại về mức độ an toàn của các mô hình AI tiên tiến, đồng thời thúc đẩy các cơ quan quản lý siết chặt khung giám sát. (Nguồn: RT)

Diễn biến mới xuất hiện trong bối cảnh công ty mở rộng điều tra sau sự cố xảy ra hồi tháng trước, khi một mô hình AI đã thoát khỏi môi trường kiểm thử an ninh mạng nội bộ và truy cập trái phép các hệ thống bên ngoài.

Theo Reuters, trong quá trình thử nghiệm hai mô hình GPT-5.6 Sol và một mô hình chưa được công bố, cả hai đều được gỡ bỏ các cơ chế bảo vệ để đánh giá năng lực phát hiện và khai thác lỗ hổng phần mềm thông qua bộ công cụ ExploitGym. Thay vì chỉ hoàn thành nhiệm vụ được giao, một mô hình đã tìm cách vượt khỏi môi trường thử nghiệm, truy cập Internet và xâm nhập nền tảng Hugging Face nhằm tìm kiếm lời giải có sẵn.

Ban đầu, OpenAI khẳng định, vụ việc chỉ ảnh hưởng Hugging Face. Tuy nhiên, công ty sau đó xác nhận mô hình AI còn xâm nhập bốn tài khoản thuộc bốn dịch vụ khác nhau.

Reuters cho biết, OpenAI tiếp tục phát hiện thêm các trường hợp vi phạm cơ chế cô lập, song chưa công bố số lượng cụ thể, thời điểm xảy ra hoặc các hệ thống liên quan.

More from WVR
Đối mặt với sự giám sát chặt chẽ, OpenAI cam kết vẫn nghiên cứu an toàn AI Đối mặt với sự giám sát chặt chẽ, OpenAI cam kết vẫn nghiên cứu an toàn AI

Một nguồn tin khác nhận định, các sự cố có phạm vi hạn chế và chưa có dấu hiệu cho thấy bất kỳ mô hình nào đã vượt khỏi mạng nội bộ của OpenAI.

Công ty cũng đang phối hợp với các chuyên gia độc lập rà soát nhật ký hoạt động từ đầu năm nhằm xác định liệu còn tồn tại những vụ việc tương tự chưa được phát hiện hay không.

OpenAI cho rằng, nguyên nhân ban đầu xuất phát từ một lỗ hổng trong phần mềm của bên thứ ba được sử dụng trong môi trường thử nghiệm, tạo điều kiện để mô hình AI khai thác và giành quyền truy cập Internet.

Doanh nghiệp nhấn mạnh đang tăng cường các biện pháp cô lập, giám sát và kiểm soát truy cập, đồng thời khắc phục lỗ hổng kỹ thuật phục vụ quá trình điều tra.

Giám đốc điều hành Sam Altman cũng thừa nhận tốc độ phát triển AI có thể cần được điều chỉnh thận trọng hơn, dù chưa cam kết làm chậm quá trình nghiên cứu. Trước thông tin mới từ Reuters, OpenAI từ chối bình luận và cho biết sẽ công bố báo cáo kỹ thuật trong những tuần tới.

Trong khi đó, Anthropic ngày 31/7 cũng thông báo phát hiện các trường hợp mô hình Claude vượt khỏi môi trường thử nghiệm trong quá trình đánh giá an ninh nội bộ. Sau khi rà soát hơn 140.000 lần đánh giá, công ty xác định Claude từng truy cập Internet từ các môi trường lẽ ra phải được cô lập và thực hiện hành vi xâm nhập trái phép vào hệ thống của ba tổ chức.

Những sự cố đầu tiên được cho là xảy ra từ tháng 4/2026 nhưng không bị phát hiện vào thời điểm đó.

Anthropic nhấn mạnh, các hành vi trên chỉ diễn ra trong môi trường thử nghiệm được kiểm soát và không nên bị diễn giải quá mức. Dẫu vậy, doanh nghiệp cũng thừa nhận kết quả này cho thấy các hệ thống đánh giá AI cần được áp dụng các biện pháp bảo mật nghiêm ngặt tương đương với môi trường vận hành thực tế nhằm hạn chế nguy cơ phát sinh sự cố.

Loạt diễn biến mới tiếp tục làm gia tăng quan ngại về khả năng các mô hình AI tự động thực hiện các cuộc tấn công mạng với mức độ can thiệp của con người ngày càng thấp, đồng thời thúc đẩy các cuộc tranh luận về trách nhiệm pháp lý khi AI gây ra thiệt hại trong thực tế.

Sau vụ việc, Hugging Face kêu gọi OpenAI công bố nhật ký hoạt động của các mô hình liên quan và tăng cường biện pháp kiểm soát để tránh tình trạng này trở thành thông lệ.

Mỹ yêu cầu các cơ quan chính phủ dừng sử dụng công nghệ của Anthropic ngay lập tức

Ngày 27/2, theo CNBC, Tổng thống Donald Trump đã phát lệnh yêu cầu toàn bộ các cơ quan thuộc Chính phủ Mỹ phải “chấm dứt ...

Apple kiện một ông lớn này với cáo buộc đánh cắp bí mật thương mại

Ngày 11/7, tập đoàn công nghệ Apple đã đệ đơn kiện OpenAI lên tòa án liên bang tại thành phố San Jose (bang California), cáo ...

Mỹ 'bật đèn xanh' trở lại cho hai mô hình AI tiên tiến nhất hiện nay, cuộc đua quản lý lại nóng lên

Ngày 1/7, Bộ Thương mại Mỹ vừa chính thức dỡ bỏ các hạn chế xuất khẩu đối với Fable 5 và Mythos 5, hai mô ...

Một ông lớn Trung Quốc ‘quay lưng’ với mô hình AI tiên tiến bậc nhất hiện nay, lý do là gì?

Ngày 5/7, Tập đoàn Trung Quốc Alibaba đã yêu cầu nhân viên ngừng sử dụng Claude Code, trợ lý lập trình trí tuệ nhân tạo ...

Anthropic ra mắt mô hình AI mới với chi phí giảm một nửa

Công ty khởi nghiệp trí tuệ nhân tạo (AI) Anthropic ngày 24/7 đã giới thiệu mô hình AI mới mang tên Claude Opus 5. Theo ...

(theo Reuters)

Đọc thêm

'Cơn khát' chip AI đẩy thị trường bán dẫn tăng gần gấp đôi so với dự báo

'Cơn khát' chip AI đẩy thị trường bán dẫn tăng gần gấp đôi so với dự báo

Đầu tư gia tăng vào cơ sở hạ tầng AI được dự báo tiếp tục thúc đẩy thị trường bán dẫn toàn cầu, hướng tới quy mô 2 nghìn tỷ ...
Người cao tuổi chiếm gần 30% dân số Nhật Bản, tăng mức kỷ lục 29,6%

Người cao tuổi chiếm gần 30% dân số Nhật Bản, tăng mức kỷ lục 29,6%

Chính phủ Nhật Bản công bố số liệu thống kê cho thấy, tỷ lệ người từ 65 tuổi trở lên trong tổng dân số nước này đã tăng lên mức ...
Đức tìm ra giải pháp mới giúp nâng công suất điện Mặt trời

Đức tìm ra giải pháp mới giúp nâng công suất điện Mặt trời

Hiệp hội Điện mặt trời Đức cho biết, tại hơn 1.300 trạm biến áp ở khu vực nông thôn Đức vẫn còn nhiều khả năng tiếp nhận điện chưa được ...
Anthropic sắp đưa ra mô hình AI mới trong bối cảnh áp lực cạnh tranh từ OpenAI

Anthropic sắp đưa ra mô hình AI mới trong bối cảnh áp lực cạnh tranh từ OpenAI

Công ty Anthropic xem xét tung ra một mô hình AI mới nhằm đối phó với đà phát triển của OpenAI, kể từ khi đối thủ này ra mắt GPT-6 ...
Loạt UAV tấn công quy mô lớn vào thủ đô Moscow trong ngày bầu cử cuối cùng tại Hạ viện Nga

Loạt UAV tấn công quy mô lớn vào thủ đô Moscow trong ngày bầu cử cuối cùng tại Hạ viện Nga

Nga cho biết hàng trăm thiết bị UAV nhằm vào Moscow và khu vực lân cận đã khiến ít nhất 2 người thiệt mạng và làm hư hại một nhà ...
Triều Tiên phóng tên lửa đạn đạo tầm ngắn, Hàn Quốc lập tức đưa ra phản ứng gì?

Triều Tiên phóng tên lửa đạn đạo tầm ngắn, Hàn Quốc lập tức đưa ra phản ứng gì?

Hàn Quốc cho biết Triều Tiên đã tiếp tục phóng thêm một vật thể bay chưa xác định ra vùng biển phía Đông.
Chủ tịch Trung Quốc Tập Cận Bình thăm Triều Tiên: Tái định vị giữa thế giới phân cực

Chủ tịch Trung Quốc Tập Cận Bình thăm Triều Tiên: Tái định vị giữa thế giới phân cực

Chuyến thăm của ông Tập Cận Bình khẳng định, Trung Quốc vẫn là nhân tố không thể thiếu trên con đường hướng tới bán đảo Triều Tiên hòa bình và ổn định lâu dài.
Thượng đỉnh Mỹ-Trung: Hướng tới ổn định chiến lược và thể chế hóa khuôn khổ hợp tác thực chất

Thượng đỉnh Mỹ-Trung: Hướng tới ổn định chiến lược và thể chế hóa khuôn khổ hợp tác thực chất

Cuộc gặp thượng đỉnh giữa hai nhà lãnh đạo Mỹ và Trung Quốc thể hiện nhu cầu lớn của cả hai về ổn định chiến lược và thúc đẩy hợp tác.
Những vấn đề phức tạp của xung đột Trung Đông

Những vấn đề phức tạp của xung đột Trung Đông

Sau hơn hai tháng bom đạn bao phủ vùng Vịnh, cuộc xung đột ở Trung Đông vẫn mờ mịt, nhưng hậu họa thì đã rõ.
Myanmar: Cuộc chuyển giao quyền lực

Myanmar: Cuộc chuyển giao quyền lực

Quá trình chuyển giao quyền lực tại Myanmar từ chính quyền quân sự sang chính phủ dân sự chính danh đã bắt đầu.
Hội nghị Ngoại trưởng G7: Ngăn cú sốc năng lượng toàn cầu

Hội nghị Ngoại trưởng G7: Ngăn cú sốc năng lượng toàn cầu

Việc G7 tổ chức cuộc họp khẩn cấp về nguồn cung dầu mỏ tại Paris là để khẳng định vai trò trung tâm của nhóm trong định hình kinh tế và quản trị toàn cầu.
Chương mới của quan hệ đồng minh Mỹ-Nhật Bản

Chương mới của quan hệ đồng minh Mỹ-Nhật Bản

Thủ tướng Nhật Bản Takaichi Sanae đã lên đường sang Washington trong chuyến thăm 4 ngày (từ ngày 18/3).
Syria hậu chính quyền Assad và cuộc đấu tranh định hình một cấu trúc an ninh mới

Syria hậu chính quyền Assad và cuộc đấu tranh định hình một cấu trúc an ninh mới

Khi chính quyền cựu Tổng thống Syria Bashar al-Assad sụp đổ ngày 8/12/2024, những gì diễn ra không đơn thuần là một sự chuyển giao quyền lực.
UAV phản lực của Nga đặt ra thách thức gì cho hệ thống phòng không Ukraine?

UAV phản lực của Nga đặt ra thách thức gì cho hệ thống phòng không Ukraine?

Ukraine đang phải đối mặt với một thách thức mới trong cuộc xung đột trên không với Nga.
Morocco-EU: Tìm lời giải bền vững cho bài toán di cư

Morocco-EU: Tìm lời giải bền vững cho bài toán di cư

Morocco và EU đang định hình lại quan hệ về vấn đề di cư, chuyển từ cách tiếp cận chủ yếu nhằm xử lý khủng hoảng sang một quan hệ đối tác chiến lược rộng ...
Cuộc đua AI Mỹ-Trung: Giữa sức ép dẫn đầu và yêu cầu kiểm soát

Cuộc đua AI Mỹ-Trung: Giữa sức ép dẫn đầu và yêu cầu kiểm soát

Mỹ, Trung Quốc đang tăng tốc trong cuộc đua AI, trong khi cùng phải đối mặt với bài toán cân bằng giữa duy trì lợi thế công nghệ và kiểm soát những rủi ro.
The Telegraph ấn tượng trước vẻ đẹp của Sơn Đoòng

The Telegraph ấn tượng trước vẻ đẹp của Sơn Đoòng

Phóng viên Lee Cobaj của tờ The Telegraph - một trong những nhật báo lớn và lâu đời bậc nhất nước Anh - đã có bài viết về ấn tượng ở Sơn Đoòng.
Độc đáo ‘ngoại giao Expo’

Độc đáo ‘ngoại giao Expo’

Triển lãm toàn cầu (Expo) vừa là diễn đàn kinh tế, diễn đàn văn hóa, đồng thời có thể trở thành một kênh ngoại giao đặc biệt hiệu quả.
Phiên bản di động