OpenAI cho biết mẫu Astra có thể tiến gần tới ngưỡng an ninh mạng Cực Hạn sau khi phiên bản chưa phát hành tạo ra 10 kết quả toán học quan trọng và ghi nhận bước nhảy vọt trong khả năng tự động thực hiện tác vụ an ninh mạng.
Điểm chính
- Ngày 7/8, OpenAI nói chưa thể loại trừ khả năng Astra đạt tới năng lực an ninh mạng cấp Cực Hạn.
- Công ty tạm dừng một số hạng mục nội bộ của Astra, đồng thời siết chặt kiểm soát an ninh, sandbox và hệ thống giám sát.
- Astra đồng thời tạo ra 10 kết quả nghiên cứu giải quyết hoặc đẩy mạnh tiến triển ở các bài toán tồn tại lâu năm trong toán học và khoa học máy tính lý thuyết.
Nguy cơ an ninh mạng từ Astra
OpenAI cho biết trong thông báo ngày 7/8 rằng các đánh giá nội bộ gần đây cho thấy tiến bộ lớn về khả năng “tác tử hóa” trong lập trình và an ninh mạng, đủ để công ty không còn có thể khẳng định Astra sẽ không chạm ngưỡng Cực Hạn trong Khung Độ Sẵn Sàng (Preparedness Framework). OpenAI không nói mẫu đã đạt ngưỡng này; đánh giá hiện vẫn ở mức sơ bộ.
Theo khung của OpenAI, một mô hình ở cấp Cực Hạn có thể tự động phát triển khai thác zero-day hoạt động được trên nhiều hệ thống trọng yếu đã được gia cố, hoặc triển khai các chuỗi tấn công hoàn chỉnh, mới, xuất phát từ mục tiêu cấp cao. OpenAI cho biết đang siết chặt quyền truy cập mạng và công cụ, bảo vệ trọng số mô hình, tăng cường mã hóa và cơ chế sandbox, đồng thời mở rộng giám sát đối với các trường hợp Astra hoạt động như tác tử tự chủ.
Công ty cũng tạm dừng những hoạt động liên quan đến Astra chưa đáp ứng được các chuẩn kiểm soát mới, và cho biết sẽ phối hợp với cơ quan quản lý nhà nước cùng một số tổ chức an toàn AI để kiểm định. Ngày 1/8, OpenAI mô tả Astra là “mẫu lớn tiếp theo của chúng tôi”. Đến 7/8, công ty thận trọng gọi Astra là “một trong những mô hình sắp ra mắt”.
Xem thêm: Bitcoin tiến gần nhánh fork BIP-110 cuối tuần này với chỉ 2,59% thợ đào ủng hộ
Tranh luận quanh kết quả toán học
Cảnh báo an ninh xuất hiện sau khi OpenAI công bố một phiên bản nội bộ của Astra đã tạo ra 10 kết quả nghiên cứu trong các lĩnh vực như độ phức tạp lượng tử, mật mã lưới, lý thuyết mã hóa và tổ hợp cực hạn. OpenAI nói các kết quả này giải được, hoặc đẩy mạnh giải quyết, những bài toán mở tồn tại nhiều năm, với chi phí tính toán khoảng 2.000 USD tiền token theo mức giá API của Sol.
Andrew Blumberg, giáo sư Đại học Columbia và là thành viên hội đồng của First Proof, nói với Mashable rằng các kết quả “ấn tượng” nhưng không khiến ông thay đổi đánh giá về năng lực AI hiện tại. Theo ông, nhiều kết quả là những phản ví dụ súc tích hoặc “các cấu trúc nhỏ, cực kỳ tinh vi” xây trên nền tảng công trình đã có. “Chúng không làm thay đổi tiên nghiệm của tôi,” ông nói.
Dù vậy, các kết quả cho thấy những mô hình tuyến đầu có thể trở thành cộng sự nghiên cứu hữu ích, đồng thời tạo ra mặt trái an ninh: chính năng lực lập trình đó có thể được chuyển hóa sang việc khai thác lỗ hổng phần mềm.
Sự căng thẳng này đang định hình cách OpenAI đánh giá quyền truy cập và triển khai mô hình.
Trước Astra, OpenAI xếp GPT-5.6 Sol ở mức an ninh mạng “Cao” (High), chứ chưa phải “Cực Hạn”. Mẫu trước đó có thể hỗ trợ tìm kiếm và khai thác lỗ hổng, nhưng theo OpenAI, nó chưa chứng tỏ được khả năng tấn công tự động, ổn định vào mục tiêu đã gia cố. Vì vậy, đánh giá mới nhất về Astra được xem là bước leo thang đáng kể.
Đọc tiếp: Ngày ra mắt iPhone Fold được đồn rơi vào 18/9, nhưng giới phân tích vẫn bất đồng





