Công ty khởi nghiệp AI DeepSeek của Trung Quốc đã phát hành
DeepSeek-V4-Pro-0813 vào ngày 12 tháng 8.
Một ghi chú ngắn trên trang web của họ cho biết mô hình này cung cấp “khả
năng của người đại diện được cải thiện đáng kể”, nhưng tuyên bố đó đã bị xóa
vào chiều ngày 13 tháng 8 do phản hồi ban đầu từ các nhà phát triển có vẻ trái
chiều.
Các nghiên cứu so sánh độc lập cũng cho ra kết quả trái ngược nhau.
Trên bảng xếp hạng Trí tuệ Phân tích Nhân tạo (AI) , mô hình này đạt 53 điểm,
tương đương với GLM-5.2 của công ty AI Zhipu có trụ sở tại Bắc Kinh , trong khi
xếp sau mô hình Terra trong loạt GPT-5.6 mới nhất của OpenAI 4 điểm và Kimi K3
của Moonshot AI 7 điểm.
Công ty Vals AI có trụ sở tại San Francisco đã xếp mô hình này ở vị trí thứ
12 trong bảng xếp hạng của họ.
Công ty cho biết DeepSeek-V4-Pro-0813 gặp khó khăn với các tác vụ thiết bị
đầu cuối trong môi trường biệt lập và việc tạo ra các mô hình tài chính phức tạp
trong Microsoft Excel, mặc dù một số nhà nghiên cứu cho rằng nó hoạt động tốt
trong các bài kiểm tra an ninh mạng.
Tttcnca
