Financial Times vừa đăng một bản phân tích gây tranh luận lớn: model tốt nhất của Anthropic đang khó kéo người dùng mới, trong khi các công cụ rẻ hơn như GPT-5.5, GPT-5.6 Sol hay các model open-weight bùng nổ về lượng dùng. Bài báo thu hút gần 200 điểm trên Hacker News chỉ sau vài giờ, và phần thảo luận bên dưới còn thẳng thắn hơn cả bài viết. Mình đọc kỹ cả hai và xin tóm lại câu chuyện này cho bạn.
Model giỏi nhất lại không phải model được dùng nhiều nhất?
Có. Đây là nghịch lý mà FT chỉ ra rất rõ: Fable của Anthropic liên tục dẫn đầu các benchmark về coding và reasoning, nhưng lượng người dùng consumer thực tế lại nghiêng hẳn về ChatGPT. Lý do không nằm ở chất lượng model, mà nằm ở trải nghiệm và giá. Người dùng không chọn “model hay nhất”, họ chọn “model đủ tốt, rẻ và không làm họ phát điên”.
Mình thấy đây là điểm chết của Anthropic lúc này. Trên giấy, Fable thắng gần như mọi benchmark. Nhưng ngoài đời, người ta mở ChatGPT để hỏi đủ thứ chuyện hàng ngày, còn Claude chỉ được bật ra khi gặp vấn đề kỹ thuật siêu khó. Tần suất đó quyết định thói quen, và thói quen quyết định chiếc ví.
Anthropic làm gì khiến người dùng khó chịu?
Câu trả lời ngắn: chính sách giá và giới hạn dùng quá lắt nhắt. Chỉ trong vài tháng, Anthropic đổi liên tục các gói dùng thử Fable, giới hạn usage, đưa model lên gói 200 USD rồi lại đẻ ra Opus 5. Một commenter trên Hacker News mô tả đúng cảm giác chung: luôn trong trạng thái “liệu thảm có bị rút khỏi chân không”. Người dùng không xây được workflow ổn định quanh một sản phẩm thay đổi chính sách mỗi vài tuần.
Vài vấn đề được nêu nhiều nhất trong thảo luận:
- Giới hạn usage mập mờ: Fable bị chặn ngang vì các cybersecurity lockout kể cả với tác vụ vô hại, forcing người dùng đổi từ khóa project để chạy tiếp.
- Opus 5 ăn token như ăn rau: nhiều người nghi ngờ model chủ động quay lên agent để đốt token nhanh hơn Opus 4.8.
- Billing bugs: có giai đoạn credit của người dùng bị trừ cho phần Fable lẽ ra miễn phí, dù Anthropic có hoàn lại.
- Gỡ ZDR: Fable không còn zero-data retention cho business, giết chết một mảng demand doanh nghiệp.
ChatGPT đang thắng ở đâu?
Theo dữ liệu FT và cảm nhận từ cộng đồng developer, ChatGPT thắng ở đúng chỗ Anthropic yếu: sự ổn định. Gói 20 USD của OpenAI cho bạn dùng đều, web usage tách khỏi giới hạn Codex, và không có cảm giác “chợ đen model” như bên Claude. Mình từng so sánh tình huống này trong bài về Claude Opus 5 ra mắt: Anthropic ra model rất hay nhưng luôn kèm một dấu hỏi về giá trị đồng tiền.
Nhớ lại cuộc chiến giá API giữa OpenAI và Anthropic đầu tháng 8, hai bên đã cắt giá mạnh để giành developer. Giá API xuống nhưng trải nghiệm consumer của Anthropic lại xấu đi. Đó là nghịch lý nguy hiểm: kiếm tiền từ enterprise nhưng làm mất lòng consumer, chính nhóm người đưa sản phẩm vào công ty.
Các model rẻ và open-weight đang thay đổi cuộc chơi ra sao?
Nhanh hơn nhiều người dự đoán. Nhiều commenter nói thẳng: với open-weight giờ đạt gần mức frontier, không lab nào sống sót chỉ bằng việc “có model hay nhất”. DeepSeek, các bản Qwen nén, GLM chạy local hoặc giá rẻ đang nuốt dần các tác vụ hàng ngày. Sàn nhà đang nâng lên từ dưới, và Fable đứng trên trần nhà đó một mình.
Mình đồng ý với nhận định này. Thị trường đang chia đôi: một nhóm nhỏ trả tiền đắt cho các bài toán cực khó, và đám đông còn lại dùng model rẻ mà hiệu năng chạm ngưỡng “đủ tốt”. Anthropic đang đứng ở mép trên cùng, nhưng mép đó đang lún.
Người làm MMO và developer nên rút ra điều gì?
Ba điều mình thấy rõ từ câu chuyện này. Thứ nhất, đừng trói sản phẩm của bạn vào một lab duy nhất, kể cả lab giỏi nhất. Thứ hai, khi chọn AI cho workflow hằng ngày, hãy tính tổng chi phí sở hữu gồm cả giới hạn và rủi ro chính sách đổi liên tục, không chỉ giá niêm yết. Thứ ba, nếu bạn đang xây sản phẩm trên AI API, hãy thiết kế khả năng đổi model sau 5 phút, vì hôm nay model A rẻ nhất, mai có thể model B rẻ hơn một nửa.
Anthropic vẫn có model tuyệt vời và doanh thu API tăng mạnh. Nhưng bài học từ FT rất rõ ràng: trong thời đại model rẻ hóa nhanh, trải nghiệm ổn định và giá minh bạch đang đánh bại bảng vàng benchmark. Bạn đang dùng AI nào làm daily driver, Fable hay ChatGPT? Kể mình nghe dưới phần bình luận nhé.