Hermes MoA 2.0 kết hợp GPT, Claude và DeepSeek để vượt trội mọi mô hình đơn lẻ

Hermes MoA 2.0 kết hợp GPT, Claude và DeepSeek để vượt trội mọi mô hình đơn lẻ

Nous Research đã phát hành Hermes Mixture of Agents 2.0 vào Chủ nhật, kết hợp đầu ra từ nhiều mô hình ngôn ngữ lớn, bao gồm GPT, ClaudeDeepSeek, để tạo ra các phản hồi vượt trội so với từng mô hình riêng lẻ trên các bộ chuẩn đánh giá.

Theo một báo cáo, MoA 2.0 là bản cập nhật cho framework Hermes Agent hiện có của Nous Research và vẫn giữ cấu trúc mã nguồn mở.

Hệ thống hoạt động như thế nào

Hermes MoA 2.0 vận hành như một tầng tập hợp (ensemble). Hệ thống truy vấn nhiều mô hình nền tảng song song, thu thập đầu ra của chúng và tổng hợp thành câu trả lời cuối cùng. Cách tiếp cận này, gọi là Mixture of Agents, xem các mô hình AI khác nhau như những chuyên gia đóng góp, thay vì yêu cầu một mô hình duy nhất xử lý mọi tác vụ.

Người dùng có thể cấu hình mô hình nào sẽ tham gia vào một ensemble nhất định. Cấu hình mặc định sử dụng GPT, Claude và DeepSeek, ba mô hình đại diện cho các triết lý huấn luyện và tập dữ liệu khác nhau. Bằng cách gộp đầu ra của chúng, MoA 2.0 tận dụng được các thế mạnh bổ trợ lẫn nhau.

Kết quả benchmark được công bố cùng đợt phát hành cho thấy MoA 2.0 vượt trội từng mô hình thành phần trên các tác vụ suy luận, lập trình và làm theo hướng dẫn. Biên độ chênh lệch đặc biệt đáng kể trên các bài kiểm tra suy luận dài hạn, nơi các mô hình đơn lẻ thường mất mạch.

Framework này vẫn là mã nguồn mở, nghĩa là các nhà nghiên cứu và lập trình viên có thể kiểm tra kiến trúc, thay thế các mô hình nền và điều chỉnh ensemble cho các trường hợp sử dụng cụ thể.

Đọc thêm: Anthropic vượt OpenAI với định giá 965 tỷ USD khi cuộc đua vốn AI được thiết lập lại

Các phòng thí nghiệm open-weight đẩy mạnh điều phối tác tử

Nous Research đã xây dựng được danh tiếng với các bản phát hành mô hình open-weight hướng tới cộng đồng nghiên cứu. Framework Hermes Agent gốc đã thiết lập một chuẩn cơ bản cho việc điều phối đa mô hình từ đầu năm 2026.

Bối cảnh rộng hơn là chu kỳ phát triển AI open-weight đang tăng tốc. Z.ai phát hành GLM-5.2 vào đầu tháng 7 năm 2026, định vị nó như một mô hình mã nguồn mở cho các tác vụ kỹ thuật dài hạn. Bản phát hành này tiếp nối xu hướng các phòng thí nghiệm open-weight nhắm vào những miền năng lực cụ thể, nơi các mô hình đóng đang có lợi thế về danh tiếng.

Đọc thêm: Chuyên gia nói cổ phần 5% của OpenAI sẽ đẩy AI sâu hơn vào kiểm soát của nhà nước

Cựu trưởng nhóm kỹ thuật của Qwen là Junyang Lin công khai lập luận vào cuối tháng 6 năm 2026 rằng các hệ thống mang tính tác tử là bước đi đúng đắn tiếp theo cho phát triển AI. Lập luận này phù hợp với triết lý thiết kế đằng sau MoA 2.0, vốn xem tác tử và tổ hợp mô hình là con đường gia tăng năng lực mà các lần huấn luyện đơn lẻ khó có thể tái tạo.

Bản phát hành Hermes MoA cũng xuất hiện giữa lúc cộng đồng nghiên cứu AI đang tranh luận sôi nổi về vai trò đúng đắn giữa mô hình nền tảng và các tầng tác tử.

Andrej Karpathy đã cảnh báo hồi đầu tuần rằng phát triển theo hướng “ưu tiên tác tử” có nguy cơ lặp lại những sai lầm trong các chu kỳ nghiên cứu trước đây của OpenAI. Cách tiếp cận của Nous Research cố gắng đi giữa, sử dụng các mô hình nền tảng mạnh làm đầu vào đồng thời bổ sung một tầng điều phối ở phía trên.

Đọc thêm: OpenAI nhắm IPO 1 nghìn tỷ USD trong khi Microsoft nắm phần thưởng lớn nhất

Điều cần theo dõi

Hermes MoA 2.0 vẫn chưa được kiểm nghiệm với các mô hình biên mới phát hành gần đây nhất. Claude Sonnet 5 và các biến thể GPT cập nhật ra mắt giữa năm 2026 có thể làm thay đổi bức tranh benchmark. Nous Research chưa công bố bài báo học thuật chính thức kèm theo bản phát hành.

Ý nghĩa thực tế đối với lập trình viên khá rõ ràng. Một công cụ mã nguồn mở chứng minh được khả năng cải thiện kết quả benchmark của các mô hình đóng bằng cách kết hợp chúng sẽ hạ thấp rào cản cho các nhóm nghiên cứu trong việc tiếp cận năng lực suy luận hàng đầu mà không phải trả chi phí API mô hình biên cho mọi lần suy luận.

Đối với ngành AI, MoA 2.0 củng cố lập luận rằng sự đa dạng mô hình, thay vì một mô hình thống trị duy nhất, có thể sẽ định hình giai đoạn triển khai AI tiếp theo. Hãy theo dõi phản hồi từ OpenAI và Anthropic về các cách tiếp cận dựa trên ensemble trong những tháng tới.

Đọc tiếp: Chính sách “hai mặt” của Trump về Anthropic mà Nhà Trắng không giải thích

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Bài viết học tập liên quan
Hermes MoA 2.0 kết hợp GPT, Claude và DeepSeek để vượt trội mọi mô hình đơn lẻ | Yellow