Ối giồi ôi! AI V4 Pro mới của DeepSeek vừa drop mà đã gây tranh cãi ầm ầm rồi nè Mô hình AI này của startup Trung Quốc tuy xịn sò ở mảng an ninh mạng nhưng lại làm team dev thất vọng toàn tập về năng lực tổng thể đấy!
Lén lút ra mắt rồi... gỡ thông báo luôn?!
DeepSeek vừa âm thầm thả DeepSeek-V4-Pro-0813, bản update cho mô hình chủ lực mới nhất của hãng. Trên web chính thức có thông báo ngắn nói rằng mô hình có "năng lực tác nhân được tăng cường đáng kể". Nhưng plot twist là chỉ sau 1 ngày, thông báo này biến mất luôn á
Động thái này diễn ra sau khi hãng tung ra mô hình V4 Flash nhỏ gọn hơn vào tháng trước - sản phẩm từng làm chấn động cả Thung lũng Silicon vì hiệu quả chi phí quá trời luôn!
Năng lực tác nhân là gì vậy?
Năng lực tác nhân (agent capability) trong AI chính là khả năng tự chủ nhận thức môi trường, lập kế hoạch, sử dụng công cụ và thực hiện chuỗi hành động nhiều bước để đạt mục tiêu mà không cần con người phải ngồi giám sát liên tục đâu nha!
Kết quả benchmark: Ơ hay hay?
Nhưng mà các kết quả đánh giá ban đầu cho thấy mô hình này đang struggle khá nặng so với các ông lớn khác:
• Trên chỉ số Artificial Analysis Intelligence Index: chỉ đạt 53 điểm, ngang với GLM-5.2 của Zhipu AI (ra mắt tháng Sáu), nhưng kém 4 điểm so với mô hình tầm trung Terra thuộc dòng GPT-5.6 mới của OpenAI và kém tận 7 điểm so với Kimi K3 của Moonshot AI
• Trên chỉ số Vals Index (do Vals AI ở San Francisco tổng hợp): xếp thứ 12 thôi nha! Đứng sau cả thế hệ GPT-5.5 cũ hơn của OpenAI và thua xa những hệ thống đỉnh cao như Kimi K3 hay Claude Opus 5 của Anthropic
Theo Vals AI, mô hình này gặp khó khăn ở hai mảng cụ thể: Hoàn thành tác vụ trong môi trường dòng lệnh (terminal) biệt lập (sandbox) và tạo các mô hình tài chính phức tạp trong Excel.
Cộng đồng dev nói gì?
Trên mạng xã hội, những kết quả này khiến khá nhiều dev và người trong ngành phải nhận xét mô hình của công ty có trụ sở tại Hàng Châu này là "gây thất vọng" Nhiều người dùng còn report các vấn đề như việc mô hình dừng hoạt động giữa chừng khi thực hiện các tác vụ lập trình dài nữa.
Plot twist: Xịn sò ở mảng an ninh mạng!
Nhưng mà đừng vội chê nhé! Bất chấp những phản hồi trái chiều, hiệu suất của mô hình trong lĩnh vực an ninh mạng lại rất nổi bật đấy! Theo công ty an ninh mạng Aikido Security của Bỉ, DeepSeek-V4-Pro-0813 đã vượt qua tất cả các mô hình khác được test trong việc phát hiện các lỗ hổng hệ thống luôn!
Ông Philippe Dourassov, nhà nghiên cứu tại Aikido, cho biết mặc dù mô hình này gặp vấn đề về "độ chính xác kém", nó lại phát hiện được nhiều lỗ hổng bảo mật hơn hẳn so với Opus 5 của Anthropic và Qwen 3.8 của Alibaba Group Holding.
Giá cả: Hơi mặn mà không phải chuẩn ngon?
Khác với quy trình phát hành thường thấy của các phòng thí nghiệm AI, DeepSeek vẫn chưa công bố bài viết kỹ thuật nào về mô hình mới này cả. Còn về giá thì cũng gây tranh cãi phết, đặc biệt là sau khi mô hình V4 Flash (vốn có giá cực rẻ) được ra mắt vào ngày 31/7 và nhận được nhiều lời khen.
DeepSeek-V4-Pro-0813 có giá khoảng 44 cent Mỹ cho mỗi triệu token đầu vào (tức là có thể nạp 750.000 từ tiếng Anh vào AI với giá khoảng 11 nghìn đồng) - mức giá mà Artificial Analysis đánh giá là "hơi cao" so với mức trung vị thị trường là 33 cent (khoảng 8.600 đồng). Còn 87 cent cho mỗi triệu token đầu ra (nghĩa là phải trả khoảng 21.500 đồng cho mỗi 750.000 từ mà mô hình AI tạo ra) thì được coi là "hợp lý".
Theo Chỉ số Trí tuệ của Artificial Analysis, với chi phí 6 cent cho mỗi tác vụ, mô hình này đắt hơn một chút so với GPT-5.6 Luna (phiên bản gọn nhẹ của OpenAI) có giá 5 cent, nhưng vẫn rẻ hơn tới gần 93% so với Kimi K3 của Moonshot AI (có giá 84 cent).
Tăng giá và kế hoạch tương lai
Tuần trước, DeepSeek thông báo sẽ tăng giá "đáng kể" do nhu cầu tăng vọt, đồng thời khuyến nghị người dùng nên lên kế hoạch sử dụng cho hợp lý nha! Trong khi đó, DeepSeek dự kiến sẽ sớm ra mắt một sản phẩm có tên "Harness" - một khung phần mềm tương tự như Claude Code, cho phép các mô hình ngôn ngữ lớn hoạt động như những tác nhân AI tự hành.
Vậy là tạm thời DeepSeek V4 Pro đang trong tình trạng "móa đỉnh nhưng chỉ ở một số mảng thôi" Liệu hãng có cải thiện được trong thời gian tới không nhỉ? Hẹn gặp lại ở các bản update tiếp theo nhaaa!
Nguồn: svvn.tienphong.vn