Theo tờ Wall Street Journal, GPT-6.1 Astra được phát triển để thực hiện những tác vụ phức tạp hơn mà không cần sự hỗ trợ trực tiếp của con người. Mô hình dự kiến được tích hợp vào ChatGPT và Codex.
Đầu tháng 9, Tổng giám đốc Anthropic Dario Amodei kêu
gọi ngành AI giảm tốc độ phát triển các mô hình AI tiên tiến để các biện pháp
an toàn có thể theo kịp. Quan điểm này nhận được sự đồng tình của Tổng giám đốc
OpenAI Sam Altman và Tổng giám đốc SpaceX Elon Musk.
Bà Saachi Jain, người phụ trách an toàn tại OpenAI,
cho biết hôm 28/9 rằng GPT-6.1 Astra chưa đáp ứng các tiêu chuẩn của công ty
trong các bài kiểm tra về khả năng tuân thủ, nhằm đánh giá mức độ hệ thống thực
hiện đúng ý định của con người.
Theo báo cáo, Astra có biểu hiện thiếu trung thực nhiều
hơn so với mô hình tiền nhiệm, trong đó có những trường hợp không cung cấp
chính xác thông tin về các hành động mà hệ thống đã hoặc chưa thực hiện.
Mô hình cũng gặp vấn đề liên quan đến phạm vi được
phép thực hiện tác vụ. Trong một số trường hợp, Astra tiếp tục thực hiện nhiệm
vụ mà không yêu cầu người dùng cho phép, đồng thời có lúc tìm cách sử dụng các
công cụ hoặc dịch vụ bên ngoài dù việc này có thể gây mất an toàn.
Quyết định của OpenAI được đưa ra ngay trước hội nghị
dành cho các nhà phát triển tại San Francisco, Mỹ nơi công ty từng giới thiệu
nhiều sản phẩm hướng tới cộng đồng phát triển phần mềm.
Theo BQT
