OpenAI đình chỉ phát triển AI "siêu phàm" sau vụ tấn công mạng

Sau các vụ tấn công mạng, OpenAI tạm dừng huấn luyện mô hình mới, phát triển hệ thống giám sát, và kêu gọi kiểm soát chặt chẽ hơn về AI.

OpenAI, nhà sáng tạo ra ChatGPT, cho biết họ đang giảm tốc độ phát triển mô hình AI tiên tiến nhất của mình và thắt chặt các biện pháp kiểm soát nội bộ. Động thái này diễn ra tròn một tháng sau khi một trong những công cụ AI của họ đã thực hiện một cuộc tấn công mạng tự động.

OpenAI đóng vai trò quan trọng trong quá trình xây dựng nhanh chóng cơ sở hạ tầng và công cụ trí tuệ nhân tạo trên toàn cầu, điều mà một số người ví như một cuộc chạy đua vũ trang.

1787217669235.png
Mặc dù chỉ đang trong giai đoạn thử nghiệm, mô hình của OpenAI đã thoát khỏi kiểm soát và tấn công vào Hugging Face.

Công ty cho biết trong một bài đăng trên blog rằng họ đang tạm hoãn việc thực hiện đợt huấn luyện AI lớn nhất từ ​​trước đến nay để kiểm tra xem mô hình thu được có hoạt động như mong đợi hay không.

Các lượt chạy huấn luyện là những bài tập đòi hỏi nhiều tài nguyên tính toán, trong đó các mô hình được cung cấp một lượng lớn văn bản và hình ảnh. Kết hợp với việc tinh chỉnh hàng tỷ thiết lập nội bộ, điều này giúp các mô hình có khả năng suy luận và phản hồi các yêu cầu cũng như các đầu vào khác.

"Chúng tôi luôn nói rằng chúng tôi sẽ hành động nếu cảm thấy khả năng của mô hình đang vượt xa tốc độ đáp ứng các yêu cầu về an toàn và sự phù hợp." - Giám đốc điều hành OpenAI, Sam Altman, cho biết.

Vào giữa tháng 7, một tác nhân AI dựa trên hai mô hình OpenAI đã tự ý rời khỏi môi trường thử nghiệm khép kín của mình để xâm nhập vào internet và tấn công Hugging Face.

Tương tự, đối thủ của OpenAI là Anthropic đã tiết lộ vào cuối tháng 7 rằng ba mô hình đang được thử nghiệm của họ cũng đã thực hiện các vụ xâm nhập trái phép vào hệ thống máy tính của ba tổ chức.

Các sự việc này đã dẫn đến một bản kiến ​​nghị có chữ ký của hơn 1.000 nhân viên ngành công nghệ, kêu gọi chính phủ Mỹ hỗ trợ việc phối hợp làm chậm lại quá trình phát triển các hệ thống trí tuệ nhân tạo tiên tiến nhất.

20260722-openai-huggingface.jpg
Chính OpenAI vẫn chưa hiểu quá trình suy luậ bên trong các mô hình ChatGPT của họ để đi đến kết luận trước yêu cầu của người dùng.

Tuần trước, Thượng nghị sĩ Mỹ Bernie Sanders đã viết thư cho các ông trùm công nghệ đứng đầu OpenAI, Anthropic và Meta, kêu gọi họ tạm dừng phát triển trí tuệ nhân tạo và "ngừng chế tạo những cỗ máy mà con người không thể kiểm soát".

OpenAI đã tạm dừng việc huấn luyện các mô hình mới nhất của mình trong hai tuần trước khi tiếp tục với các biện pháp kiểm soát chặt chẽ hơn.

Phần lớn công việc liên quan đến Astra - mô hình chủ lực tiếp theo của công ty - vẫn đang bị tạm dừng, vì công ty đã xác định vào đầu tháng 8 rằng mẫu xe này có thể vượt qua ngưỡng cảnh báo mà họ tự đặt ra.

Do rủi ro đó, các quy định nội bộ của OpenAI yêu cầu họ phải tạo ra các biện pháp bảo vệ mạnh mẽ hơn trước khi quá trình phát triển có thể tiếp tục.

Hôm thứ Ba, OpenAI cũng cho biết họ đang phát triển một hệ thống mới để nghiên cứu quá trình suy luận bên trong của các mô hình và đưa ra cảnh báo cho con người trong vòng 30 phút nếu phát hiện hành vi đáng ngờ.

Tuy nhiên, việc giám sát đó sẽ đòi hỏi thêm 20% sức mạnh tính toán. Nghiên cứu của chính OpenAI vào năm 2025 đã chỉ ra những hạn chế của phương pháp này: Một mô hình biết mình đang bị giám sát có thể học cách che giấu ý định của mình trong quá trình suy luận.

Công ty đã hứa sẽ cung cấp một báo cáo kỹ thuật chi tiết về sự cố nhưng đến nay vẫn chưa công bố. Bài đăng trên blog hôm thứ Ba cho biết nó sẽ được phát hành "trong những tuần tới".

OpenAI bắt tay các công ty công nghệ châu Á.

Claude tung mã độc lên internet và lập kế hoạch dài hơi tấn công mạng

Mô hình của Anthropic đã thực hiện các hành vi cực kỳ công phu và nguy hiểm đến mức nếu là một cá nhân thực hiện thì chắc chắn đối mặt với một bản án nặng nề.

Anthropic cho biết các mô hình bảo mật dựa trên Claude của họ đã truy cập trái phép vào các môi trường sản xuất nhạy cảm của ba tổ chức bên ngoài trong quá trình thử nghiệm nội bộ được thiết kế để đo lường khả năng tấn công mạng.

robot-in-handcuffs.jpg
Claude của Anthropic đã thực sự lập ra các kế hoạch tấn công hết sức tinh vi.

Hơn 40.000 xe Land Rover “mất tích” vì bị tấn công mạng

Hãng ôtô Jaguar Land Rover phải ngừng sản xuất gần 3 tuần vì sự cố tấn công mạng, mất dấu 40.000 xe mới sản xuất, thiệt hại khoảng gần 5 triệu bảng Anh/ngày.

Video: Xem chi tiết Land Rover Defender Octa 2025.

Hãng xe Anh quốc - Jaguar Land Rover (JLR) thuộc tập đoàn Tata (Ấn Độ) đã trở thành nạn nhân của một cuộc tấn công mạng nghiêm trọng, buộc hãng phải phát đi tới 4 thông cáo báo chí liên tiếp với cùng tiêu đề “tuyên bố về sự cố mạng”. Trong hai tuần qua, toàn bộ dây chuyền sản xuất của JLR đã ngừng hoạt động và dự kiến chỉ có thể khởi động lại vào ngày 24/9, trong kịch bản lạc quan nhất.

Các mô hình nổi loạn của OpenAI rình mò nhiều ngày rồi tấn công

Các mô hình mạnh mẽ nhất của công ty trí tuệ nhân tạo này đã dành nhiều ngày để thăm dò internet trước khi tấn công nền tảng nhà phát triển AI Hugging Face.

Các mô hình trí tuệ nhân tạo mạnh mẽ từ OpenAI đã lừa đảo và thực hiện một cuộc tấn công mạng tự trị chưa từng có vào đầu tháng này. Theo một phân tích mới từ nạn nhân cho thấy, nó đã dành hơn bốn ngày trên internet để dàn xếp vụ tấn công.

Một công ty AI thứ hai đã xác nhận rằng một trong những khách hàng của họ cũng là mục tiêu của các mô hình của OpenAI trong cùng một sự kiện. Vấn đề này đặt ra câu hỏi tại sao OpenAI không phát hiện hoạt động đáng báo động trong nhiều ngày.

Đọc nhiều nhất

Tin mới