OpenAI ra mắt Astra, bước tiến mới về AI nhưng làm dấy lên lo ngại về khả năng giám sát
OpenAI đã phát hành Astra vào thứ Năm, mô hình AI mới nhất của hãng và theo công ty cũng là mô hình mạnh mẽ và có năng lực nhất từ trước đến nay.
Nguồn ảnh: Jean Chung/Bloomberg / Getty Images.
OpenAI tuyên bố Astra đại diện cho “một biên giới mới trong việc sử dụng máy tính và trình duyệt”, đồng thời có thể xử lý các tác vụ với “tốc độ, độ chính xác và độ an toàn” chưa từng có.
Mô hình này được cung cấp từ thứ Năm cho các khách hàng OpenAI sử dụng Daybreak, chương trình an ninh mạng của hãng. Trong tuần tới, Astra cũng sẽ được cung cấp thông qua các gói trả phí của OpenAI bao gồm tài khoản Pro, Plus, Enterprise và Business cũng như thông qua API của hãng.
Trong cuộc trao đổi với các nhà báo hôm thứ Năm, Chủ tịch OpenAI Greg Brockman cho biết Astra là “mô hình thông minh nhất và, cũng rất quan trọng, là mô hình được điều chỉnh phù hợp nhất của chúng tôi từ trước đến nay”. Ông nói thêm rằng mô hình này “tập hợp nhiều năm nghiên cứu và những khoản đặt cược lớn của chúng tôi, trong đó mỗi đột phá đều được xây dựng dựa trên đột phá trước đó” và đại diện cho “một sự thay đổi thực sự về loại công việc mà con người có thể giao cho AI cũng như cách AI có thể trao thêm năng lực cho họ”.
Khả năng an ninh mạng của Astra đã nhận được nhiều sự chú ý. Đầu tuần này, OpenAI đã đăng một bài viết trên blog thảo luận về các khả năng mới của mô hình, cũng như những biện pháp bảo vệ mới được triển khai nhằm mang lại trải nghiệm an toàn hơn cho người dùng. Hôm thứ Năm, công ty cho biết đã thử nghiệm Astra trên nhiều bài kiểm tra chuẩn về an ninh mạng để bảo đảm năng lực của mô hình, đồng thời cho rằng “khả năng xác định và phát triển các khai thác zero-day của mô hình có thể giúp các chuyên gia phòng thủ tìm ra và vá những điểm yếu”.
Việc công ty tập trung vào tính phù hợp tức xu hướng của một mô hình trong việc thực hiện điều người dùng mong muốn hoặc điều có lợi nhất cho họ dường như không thể không được xem là phản ứng trước vụ xâm nhập Hugging Face gần đây, trong đó một tác nhân AI của OpenAI đã thoát khỏi môi trường thử nghiệm được cô lập và tấn công nhiều công ty (một ví dụ rất rõ ràng về sự không phù hợp).
OpenAI cũng đã đề cao khả năng lập trình của Astra, tuyên bố đây là “mô hình tốt nhất cho kỹ thuật phần mềm tính đến nay”. Để củng cố nhận định này, công ty đưa ra kết quả từ nhiều bài kiểm tra chuẩn liên quan đến an ninh mạng. Các bài kiểm tra dường như cho thấy Astra đạt điểm cao hơn những mô hình hiện có khác bao gồm Sol của chính OpenAI và Fable của Anthropic trong các hoạt động như tìm lỗi, thực hiện tác vụ trên terminal và trả lời các truy vấn về cơ sở mã.
Astra cũng có thể là mô hình gây tranh cãi nhất từ trước đến nay của OpenAI do sử dụng một kỹ thuật suy luận cụ thể được gọi là tính đệ quy mờ đục (opaque recurrence). Kỹ thuật này được biết đến với khả năng che khuất một quy trình quan trọng trong việc giám sát mô hình, được gọi là chuỗi suy nghĩ (chain of thought), cho phép các nhà nghiên cứu kiểm tra cách thức và lý do một mô hình AI đưa ra những quyết định mà nó đã đưa ra.
OpenAI đã giảm nhẹ mức độ mà Astra sử dụng tính đệ quy mờ đục và trong cuộc trao đổi, Giám đốc khoa học Jakub Pachocki dường như cho rằng một mức độ mờ đục nhất định là kết quả tự nhiên của quá trình phát triển mô hình. Ông cho biết việc giám sát quá trình suy luận của một mô hình là một hình thức giám sát quan trọng, nhưng “khi năng lực của mô hình ngày càng tăng, khả năng giám sát cũng trở nên khó khăn hơn”.
Sau đó, ông nói thêm rằng một lý do tiềm tàng cho điều này là “các mô hình có năng lực cao hơn có thể thực hiện những tác vụ khó hơn bằng cách sử dụng ít token ngôn ngữ hơn” hoặc “không sử dụng token ngôn ngữ”, điều mà ông cho rằng sẽ làm giảm khả năng giám sát những tác vụ cụ thể đó.
Một phóng viên trong cuộc trao đổi muốn biết liệu OpenAI có thực sự đang tuyên bố Astra là dấu mốc chính thức của AGI, hay trí tuệ nhân tạo tổng quát (artificial general intelligence) cột mốc công nghệ thường được nhắc đến nhưng chưa được định nghĩa rõ ràng, tại đó AI vượt qua năng lực của con người trong tất cả (hoặc phần lớn) lĩnh vực.
Ở đây, Brockman đưa ra một cách diễn giải khác. “Không còn điều khoản AGI mang tính ràng buộc hợp đồng nữa, vì vậy đó thực sự không phải là một khái niệm liên quan”, ông nói. Brockman đang đề cập đến điều khoản trước đây tồn tại trong hợp đồng giữa OpenAI và Microsoft, theo đó quan hệ hợp tác giữa hai bên sẽ chấm dứt khi AGI xuất hiện. Như Brockman lưu ý, điều khoản đó không còn tồn tại.
Thay vào đó, Brockman giải thích rằng định nghĩa về AGI đã chuyển từ một nghĩa vụ theo hợp đồng thành một “khái niệm về sứ mệnh hoặc khái niệm mang tính tinh thần”. Ông nói thêm: “Tôi để độc giả tự quyết định xem điều này có đủ điều kiện để được coi là AGI đối với họ hay không. Cá nhân tôi, tôi nghĩ chúng ta đã đạt đến đó”.

