DeepSeek Harness Ra Mắt: Đối Thủ Mã Nguồn Mở Của Claude Code, API Tăng Đến 1.100%

Câu trả lời nhanh
DeepSeek vừa ra mắt Harness, agent harness mã nguồn mở dạng plugin chạy local đối đầu Claude Code và Codex, đi kèm bản V4-Pro-0813 chính thức tối ưu cho agent. Nhưng từ 23h ngày 16/8 giờ Việt Nam, DeepSeek bỏ giá API phẳng, chuyển sang tính giờ cao điểm 8h-11h và 13h-17h, tăng từ 50% đến hơn 1.100% tùy hạng mục, đau nhất là cache hit tăng gấp 6-12 lần.

DeepSeek vừa làm hai việc trái chiều trong cùng một tuần: mở mã nguồn Harness để đối đầu trực tiếp Claude Code, đồng thời nâng giá API từ 50% đến hơn 1.100% tùy hạng mục, hiệu lực từ 23h ngày 16/8 giờ Việt Nam. Một tay tặng developer tool miễn phí, một tay siết lại tiền token. Mình đọc xong toàn bộ thông báo thì chỉ rút ra được một câu: DeepSeek không muốn chơi trò “rẻ nhất thị trường” nữa, họ đang chơi lớn hơn thế.

DeepSeek Harness ra mắt: agent harness mã nguồn mở đối đầu Claude Code, API tăng giá đến 1.100%

DeepSeek Harness là gì?

Harness (gọi tắt là dsh) là agent harness mã nguồn mở dưới giấy phép MIT, ra mắt ngày 13/8, đóng vai trò khung vận hành cho AI agent làm việc với code: đọc repo, sửa file, chạy shell, tìm kiếm, lập kế hoạch, điều phối subagent. Triết lý của nó gói trong một câu “Everything is a plugin” — từ model, tool, session cho tới sandbox đều có thể tháo ra thay thế. Chạy thử chỉ cần một dòng lệnh npx @deepseek-ai/dsh web.

Harness được dựng trên Cordis, một framework thiết kế xoay quanh plugin kết hợp. Toàn bộ repo GitHub mở, và đúng như văn hóa open source, DeepSeek dán cảnh báo ngay trang đầu: đây là developer preview, “sẽ có các thay đổi phá vỡ tương thích”. Dù vậy, kho lưu trữ vẫn đạt khoảng 27.500 stars và 2.000 forks ngay trong ngày đầu tiên — mức đón hiếm thấy với một công cụ kỹ thuật.

Harness khác Claude Code và Codex ở điểm nào?

Về năng lực lõi thì ba bên ngang ngửa: đọc và sửa file, chạy lệnh shell, duy trì plan, gọi subagent, áp dụng chính sách phê duyệt. Khác biệt nằm ở kiến trúc và độ chín. Claude Code và Codex là sản phẩm thương mại trưởng thành với hệ sinh thái đầy đủ; Harness mới chỉ là bản xem trước, nhưng thắng tuyệt đối ở tính module — đến mức model của Anthropic hay OpenAI cũng chỉ là một plugin cắm vào.

So sánh nhanh ba cạnh quan trọng nhất:

  • Đa dạng giao diện: Claude Code phủ terminal, VS Code, JetBrains, desktop, browser, mobile và Slack. Codex có CLI, IDE extension, desktop, cloud. Harness hiện chỉ có local web UI, headless command và Python SDK.
  • Agent chạy nền managed: Claude Code và Codex đều có dịch vụ hosted background agents gắn với GitHub workflow. Harness chưa có tích hợp hoàn chỉnh tương tự.
  • Tự do thay thế: chỉ Harness cho phép thay gần như mọi thành phần, và cắm model từ DeepSeek, Anthropic, OpenAI hoặc endpoint tự dựng. Đây là thứ hai đối thủ không làm được.

V4-Pro-0813 tiến bộ thế nào?

Đây là bản chính thức của model đầu bảng 1,6 nghìn tỷ tham số với 49 tỷ tham số kích hoạt mỗi token, context 1 triệu token, tập trung vào tác vụ agent. Số DeepSeek tự báo cáo khá ấn tượng: 87,9 điểm Terminal Bench 2.1. Nhưng cần đọc kỹ footnote: các điểm code agent được đo khi model chạy bên trong Harness ở chế độ minimal. Tức đây là điểm số của cặp model kèm harness, không phải sức mạnh thuần của model.

Ở các bảng do bên thứ ba kiểm soát, V4-Pro-0813 chưa dập tắt đối thủ: Toolathlon-Verified đạt 74,1 so với 77,9 của Claude Fable 5, còn DSBench-FullStack là 71,1 so với 77,2. Điểm cộng đáng chú ý hơn là reasoning effort trở thành núm chỉnh: Non-think cho tác vụ thường, Think High cho lập kế hoạch, Think Max cho bài toán khó — tiết kiệm token khi agent chỉ cần chạy bước đơn giản.

Giá API DeepSeek tăng bao nhiêu từ đêm 16/8?

Từ 16:00 UTC ngày 16/8, tương ứng 23h tối qua giờ Việt Nam, DeepSeek bỏ cơ chế giá phẳng, chuyển sang tính theo giờ cao điểm và thấp điểm. Cụ thể: V4-Flash tăng output từ 0,28 lên 0,66 USD mỗi triệu token off-peak và 1,32 USD giờ cao điểm. V4-Pro tăng output từ 0,87 lên 1,98 USD off-peak, còn giờ cao điểm là 3,96 USD. Reuters tổng hợp mức tăng dao động từ 50% đến hơn 1.100%.

Khung giờ cao điểm gồm 01:00 đến 04:00 UTC và 06:00 đến 10:00 UTC, quy ra giờ Việt Nam là 8h đến 11h sáng và 13h đến 17h chiều — trúng trọn giờ làm việc của team trong nước. Ai chạy batch job ban ngày sẽ cảm nhận rõ nhất. Đau nhất là cache hit: V4-Pro tăng từ 0,003625 lên 0,022 USD off-peak và 0,044 USD giờ cao điểm, tương đương gấp 6 đến 12 lần mức cũ.

Dắt lên vậy thì DeepSeek còn đáng dùng không?

Còn, nếu biết chọn giờ. Tính tổng chi phí cho 1 triệu token vào và 1 triệu token ra: V4-Flash off-peak là 0,88 USD, vẫn rẻ hơn GPT-5.6 Luna (1,40 USD) và MiniMax-M3 (1,50 USD). V4-Pro giờ cao điểm là 5,28 USD, ngang tầm GLM-5.2 (5,80 USD) và thấp hơn Grok 4.6 (8 USD). Tức là vẫn thuộc nhóm rẻ, chỉ không còn “rẻ vô lý” như hình dung của nhiều người.

Nhìn lại quỹ đạo giá thì thấy rõ chiến thuật: V4-Pro ra mắt tháng 4 với giá 1,74 và 3,48 USD mỗi triệu token, cuối tháng 5 cắt 75% để càn quét thị trường agent, giờ tăng lại khi đã có chỗ đứng. Đây cũng là mẩu ghép mới trong cuộc chiến giá API mà mình từng bóc tách trước đây, khi các lab Mỹ cắt 25% chỉ trong một tháng vì áp lực từ model Trung Quốc.

Mình đánh giá thế nào về nước cờ này?

Theo mình, đây là bước chuyển từ cạnh tranh giá sang cạnh tranh hệ sinh thái — đúng con đường Claude Code đã đi trước. Harness model-agnostic là nước thông minh nhất: kể cả khi developer vẫn dùng Claude hay GPT, họ vẫn cài harness của DeepSeek, và đường ống dẫn ngược về API của DeepSeek. Miễn phí ở tầng khung, thu tiền ở tầng model, quen chưa?

Ba việc mình sẽ làm ngay nếu bạn đang chạy DeepSeek trong production: dời toàn bộ batch job sang khung off-peak để trả đúng nửa giá giờ cao điểm; rà lại chiến lược cache vì mức chênh lên tới 12 lần; và dành một buổi thử Harness vì nó miễn phí, chạy local, cắm được model cũ của bạn. Còn với ai mới định dùng thử: cứ thử rồi biết, nhưng đọc changelog kỹ kẻo hụt hơi khi breaking changes tới.

Tóm lại, DeepSeek Harness là mảnh ghép đáng giá nhất trong đợt ra mắt này. Nếu muốn nắm thêm bối cảnh, mình có bài về DeepSeek V4-Flash bản 0731 ổn định và bài phân tích cuộc chiến giá API giữa OpenAI, Anthropic và các lab Trung Quốc để bạn đối chiếu.

Hương Giang

Mình là Hương Giang. Công nghệ và AI là thứ mình thích nhất — có tool mới ra là mình tải về thử, đôi khi test 4-5 cái cùng lúc chỉ để xem cái nào dùng ngon hơn. Mình không phải dân kỹ thuật chính gốc, nhưng mình biết cách nhìn nhận xem một công cụ có thực sự hữu ích cho người bình thường không. Ngoài ra mình hay nghe podcast công nghệ và lướt Product Hunt lúc rảnh.

Xem tất cả bài viết →

Để lại một bình luận

Email của bạn sẽ không được hiển thị công khai. Các trường bắt buộc được đánh dấu *