Các bài đánh giá đang hướng người dùng phổ thông đến 5 đối thủ rẻ hơn của Anthropic's Claude Fable 5 cho công việc văn bản, lập trình và lập kế hoạch.
Điểm chính:
- Các bài hướng dẫn so sánh được xuất bản từ sau khi Fable 5 ra mắt tháng 6 đều chỉ ra năm lựa chọn thay thế lặp lại cho các tác vụ mã hóa, viết lách và xử lý tài liệu dài.
- Gemini 3.1 Pro của Google có giá niêm yết 2 đô mỗi triệu token đầu vào, so với 10 đô của Fable 5.
- Fable 5 dẫn đầu bài test SWE-Bench Pro với 80,3%, nhưng các nhà đánh giá cho rằng tác vụ thường ngày hiếm khi chạm tới mức dư địa đó.
Các lựa chọn thay thế Claude Fable 5 theo từng loại tác vụ
Một loạt bài hướng dẫn so sánh trên các blog công nghệ độc lập đã phân loại các mô hình hàng đầu theo trường hợp sử dụng thường ngày kể từ khi mô hình ra mắt ngày 9/6. Hầu như tất cả đều đi đến cùng một kết luận: sức mạnh cấp Mythos của Fable 5 phần lớn bị bỏ không trong các tác vụ mà đa số nhân viên sử dụng mỗi ngày.
Claude Opus 4.8, GPT-5.5 của OpenAI, Gemini 3.1 Pro của Google, Grok của xAI và Claude Sonnet 5 xuất hiện lặp đi lặp lại.
Fable 5 niêm yết giá 10 đô mỗi triệu token đầu vào và 50 đô cho mỗi triệu token đầu ra, mức giá đắt nhất trong nhóm với khoảng cách lớn. Nó đứng đầu bài test lập trình SWE-Bench Pro với 80,3%, vượt GPT-5.5 ở 58,6% và Gemini 3.1 Pro ở 54,2%. Khoảng cách này càng nới rộng khi công việc dài hơn và rối rắm hơn, chính là kiểu tác vụ mà hầu hết prompt hằng ngày tránh né.
Đọc thêm: Vì sao Tether quay lưng với bộ quy tắc stablecoin MiCA của châu Âu
Vì sao các bài đánh giá khuyến khích “chuyển tuyến” theo tác vụ
Opus 4.8 nhận được nhiều gợi ý nhất như một lựa chọn gần như thay thế trực tiếp cho lập trình thường ngày, vì nó dùng chung hệ thống công cụ và xác thực của Anthropic với mức giá chỉ bằng một nửa Fable 5. GPT-5.5 được xếp hạng là lựa chọn dễ dùng nhất cho mục đích tổng quát, được các nhà đánh giá chấm cao nhất về văn xuôi, phác thảo và nghiên cứu hằng ngày.
Gemini 3.1 Pro thắng ở mảng tài liệu dài và lập kế hoạch với mức 2 đô mỗi triệu token đầu vào, rẻ nhất nhóm, và nhỉnh hơn các đối thủ trong câu hỏi khoa học trình độ sau đại học.
Grok là lựa chọn tiết kiệm cho các tác vụ kiểu agent, dù các bài đánh giá lưu ý nó có thể đánh rơi ngữ cảnh trong các phiên chạy dài. Sonnet 5 hoàn thiện danh sách cho các công việc nhẹ hơn, nhanh hơn với chi phí chỉ bằng một phần nhỏ.
Fable 5 vẫn đặt trần hiệu năng, và Andrej Karpathy đã gọi nó là “state-of-the-art” với biên độ hiếm thấy trong một lần phát hành đơn lẻ. Các nhà đánh giá phản biện rằng một dàn ý blog hay bản tóm tắt nhanh không bao giờ chạm tới mức dư địa đó, nên trả giá cao cho nó đơn giản là đang phung phí tiền bạc.
Tháng đầu đầy sóng gió của Fable 5
Các lời khuyên này xuất hiện trong bối cảnh màn ra mắt đầy trắc trở của mô hình. Anthropic tung Fable 5 ngày 9/6 như hệ thống cấp Mythos đầu tiên dành cho công chúng, rồi tạm ngừng sau ba ngày do lệnh kiểm soát xuất khẩu của Mỹ liên quan tới một báo cáo jailbreak. Bộ Thương mại dỡ bỏ kiểm soát này ngày 30/6, và Anthropic khôi phục quyền truy cập toàn cầu ngày 1/7.
Bài tiếp theo: SpaceX lọt vào chỉ số Nasdaq và châm ngòi làn sóng mua 4,3 tỷ đô





