BNEWS Ngày 7/8, OpenAI cho biết mô hình trí tuệ nhân tạo (AI) tiên tiến Astra sắp ra mắt đã cho thấy tiềm năng đạt được năng lực an ninh mạng ở cấp độ cao.
Công ty này đang áp dụng các biện pháp bảo vệ và kiểm soát an ninh chặt chẽ hơn đối với mô hình AI này nhằm bảo đảm an toàn.
Theo OpenAI, các đánh giá nội bộ đối với Astra - mô hình vẫn đang trong quá trình phát triển và không phải là một trong những mô hình liên quan đến vụ tấn công Hugging Face gần đây - cho thấy những bước tiến đáng kể về năng lực an ninh mạng. Công ty cho biết chưa thể loại trừ khả năng Astra đã đạt tới mức có thể tự thực hiện những cuộc tấn công mạng phức tạp nhằm vào các hệ thống được bảo vệ nghiêm ngặt, còn được gọi theo chuyên môn là “năng lực an ninh mạng ở mức nghiêm trọng”. Đây là mức năng lực được OpenAI xếp vào nhóm rủi ro đặc biệt cao và phải áp dụng các biện pháp kiểm soát an toàn chặt chẽ. Theo Preparedness Framework, năng lực an ninh mạng ở mức nghiêm trọng bao gồm khả năng một mô hình AI, với sự hỗ trợ của các công cụ, có thể phát triển các phương thức khai thác những lỗ hổng chưa từng được biết đến (zero-day) ở mọi mức độ nghiêm trọng nhằm vào nhiều hệ thống trọng yếu được bảo vệ nghiêm ngặt trong thực tế mà không cần sự can thiệp của con người. Một mô hình AI cũng được xem là có năng lực an ninh mạng ở mức nghiêm trọng nếu có thể tự xây dựng và thực hiện từ đầu đến cuối những chiến lược tấn công mạng mới nhằm vào các mục tiêu được bảo vệ nghiêm ngặt, trong khi con người chỉ cần đưa ra mục tiêu tổng quát. OpenAI cho biết công ty này công bố thông tin này nhằm giúp công chúng nắm được tình hình, đồng thời cung cấp thông tin cho cộng đồng an toàn và an ninh. Theo đó, OpenAI đang tạm dừng những hoạt động nội bộ liên quan đến Astra nếu chưa có đầy đủ biện pháp bảo vệ và kiểm soát; triển khai cơ chế giám sát toàn diện đối với mô hình; đồng thời phối hợp với các cơ quan chính phủ và các tổ chức về an toàn AI để tiếp tục kiểm tra năng lực của Astra. Thông báo của OpenAI được đưa ra sau một loạt thông tin từ các phòng thí nghiệm AI cho biết những mô hình AI của họ đã hoạt động ngoài dự kiến và xâm nhập hệ thống của các tổ chức khác. Đối thủ Anthropic sau đó cũng cho biết các mô hình AI của công ty đã vượt ra ngoài môi trường kiểm soát trong quá trình thử nghiệm do một vấn đề về cấu hình. Những mô hình AI này đã truy cập Internet công cộng và xâm nhập hệ thống của ba tổ chức khác nhau vì cho rằng tất cả các hệ thống đó đều là một phần của bài kiểm tra an ninh. Meta cũng cho biết một trong những mô hình của công ty đã thoát khỏi môi trường thử nghiệm và truy cập Internet do lỗi cấu hình.- Từ khóa:
- OpenAI
- mô hình AI Astra
Tin liên quan
OpenAI bổ sung nhiều tính năng mới cho ChatGPT
Theo OpenAI, người dùng sẽ được tăng quyền truy cập vào các cuộc hội thoại văn bản. Trong khi đó, các tính năng liên quan đến tải tệp và tạo hình ảnh vẫn áp dụng những giới hạn sử dụng riêng.
Tin cùng chuyên mục
-
Công nghệOpenAI bổ sung nhiều tính năng mới cho ChatGPT
Theo OpenAI, người dùng sẽ được tăng quyền truy cập vào các cuộc hội thoại văn bản. Trong khi đó, các tính năng liên quan đến tải tệp và tạo hình ảnh vẫn áp dụng những giới hạn sử dụng riêng.
-
Công nghệAI trở thành cố vấn tài chính mới của người Mỹ
Trí tuệ nhân tạo (AI) đang dần trở thành một công cụ hỗ trợ quản lý tài chính cá nhân tại Mỹ khi ngày càng có nhiều người tìm đến AI để giải đáp các vấn đề về tiền bạc.
-
Công nghệBa vấn đề lớn đưa khoa học công nghệ thành động lực phát triển
Phó Thủ tướng Hồ Quốc Dũng cùng Đoàn công tác đã đến thăm và làm việc tại Tập đoàn CMC, thảo luận về định hướng AI và hạ tầng số.
-
Công nghệBước tiến mới của công nghệ chỉnh sửa gene
Nhờ công nghệ chỉnh sửa gene CRISPR, các nhà khoa học Mỹ lần đầu tiên tạo thành công những con chó ít gây dị ứng, mở ra triển vọng giúp hàng triệu người bị dị ứng với chó có thể nuôi thú cưng.
-
Công nghệPhát hiện lỗ hổng bảo mật nghiêm trọng trên các trình duyệt AI
Theo Giám đốc Công nghệ của Zenity, ông Michael Bargury, đây không phải là một lỗi phần mềm đơn lẻ có thể khắc phục bằng một bản vá đơn giản mà là hệ quả của cách các trình duyệt AI được thiết kế.
-
Công nghệNghị quyết 57-NQ/TW: Việt Nam thu hút các nhà vận hành trung tâm dữ liệu
Tổng nguồn cung tương lai của thị trường trung tâm dữ liệu khu vực châu Á - Thái Bình Dương (APAC) đã đạt mức kỷ lục 26,5 gigawatt (GW) trong nửa đầu năm 2026.
-
Công nghệNhận diện thương hiệu “Chè Thái Nguyên” trên nền tảng số
Một điểm mới của kế hoạch là xây dựng hồ sơ số cho các doanh nghiệp, hợp tác xã, hộ sản xuất tham gia hệ thống và hình thành “hộ chiếu số” đối với từng sản phẩm chè.
-
Công nghệNghị quyết 57-NQ/TW: Chuyển đổi số nơi bản làng biên giới
Mô hình góp phần nâng cao hiệu quả chuyển đổi số trong lực lượng Bộ đội Biên phòng; đồng thời lan tỏa phong trào "Bình dân học vụ số" đến đồng bào vùng biên giới.
-
Công nghệCông nghệ giám sát hư hỏng bê tông theo thời gian thực
Đại học Dong-A đánh giá công nghệ mới sẽ mở ra triển vọng ứng dụng trong giám sát sức khỏe công trình, góp phần nâng cao độ an toàn và hiệu quả quản lý các công trình hạ tầng.







