Với Hermes Agent trong tháng 9 năm 2026, Claude Sonnet 5 là lựa chọn khởi đầu hợp lý cho tự động hóa hàng ngày, Claude Opus 5 hoặc GPT-5.6 Sol phù hợp với công việc khó hơn, còn DeepSeek V4.1 Flash hoặc GLM-5.3 Flash giúp giữ chi phí vận hành thường xuyên ở mức thấp. Đây là gợi ý khởi đầu, không phải kết quả benchmark có kiểm soát trên Hermes. Một mô hình trông mạnh trên bảng xếp hạng lập trình vẫn có thể thất bại ở vòng lặp tool dài hoặc tốn kém hơn do phải thử lại nhiều lần.

Hermes cho phép thay đổi mô hình chính mà không cần thay đổi agent. Hướng dẫn cấu hình mô hình cũng tách biệt mô hình chính khỏi các mô hình phụ dùng cho công việc nhỏ hơn. Nghĩa là bạn có thể đầu tư cho vòng lặp suy luận và chọn mô hình rẻ hơn cho nén hoặc tóm tắt. Các model ID bên dưới đã được kiểm tra đối chiếu với danh mục trực tuyến của haimaker vào ngày 16 tháng 9 năm 2026; tính khả dụng và giá có thể thay đổi.

Nên bắt đầu với mô hình nào?

Hãy bắt đầu từ tác vụ mà agent của bạn thực hiện thường xuyên nhất. Theo các báo cáo gần đây từ người dùng Hermes, mọi người sử dụng các mô hình khác nhau cho công việc hàng ngày, suy luận phức tạp, và tác vụ riêng tư chạy cục bộ. Bảng dưới đây đưa ra danh sách ngắn để bạn tự kiểm tra với prompt, tool, và các trường hợp lỗi của riêng mình.

Tác vụ HermesMô hình nên thử trướchaimaker model IDĐánh đổi
Trợ lý và tự động hóa hàng ngàyClaude Sonnet 5anthropic/claude-sonnet-5Mặc định cao cấp đáng tin cậy; chi phí cao hơn mô hình tiết kiệm
Lập trình production và debug khóClaude Opus 5anthropic/claude-opus-5Trần khả năng suy luận cao hơn; chi phí mỗi lần chạy cao hơn
Lập kế hoạch phức tạp với mô hình OpenAIGPT-5.6 Solopenai/gpt-5.6-solMột tùy chọn cao cấp khác; so sánh lượng token tiêu thụ khi chạy dài
Nghiên cứu ngữ cảnh dàiGemini 3.8 Flashgoogle/gemini-3.8-flashCửa sổ ngữ cảnh lớn; cần kiểm tra chất lượng câu trả lời trên tài liệu của bạn
Mô hình open-weight qua cloud APIKimi K3moonshotai/kimi-k3Lựa chọn thay thế linh hoạt; kiểm tra độ trễ nhà cung cấp và khả năng gọi tool
Công việc nền giá rẻDeepSeek V4.1 Flash hoặc GLM-5.3 Flashdeepseek/deepseek-v4.1-flash hoặc z-ai/glm-5.3-flashChi phí token thấp hơn; nhưng các lần thử lại có thể xóa sạch khoản tiết kiệm

Các lựa chọn này phản ánh tính khả dụng hiện tại và mức độ sử dụng được báo cáo, không phải khẳng định rằng mọi mô hình đã vượt qua cùng một bộ kiểm tra Hermes. Bài tổng hợp nhà cung cấp tháng 8 của cộng đồng Hermes cũng xếp Sonnet và Opus ở nhóm chất lượng, trong khi người dùng ngân sách thấp ưu tiên DeepSeek và GLM. Giá trong bài tổng hợp đó chỉ là ảnh chụp tại một thời điểm, vì vậy hãy kiểm tra danh mục trực tuyến trước khi đặt ngân sách.

Làm sao để chuyển đổi mô hình trong Hermes Agent?

Chạy hermes model, chọn Custom endpoint, rồi cung cấp base URL, API key và model ID. Hermes lưu lựa chọn endpoint trong cấu hình. Sau đó bạn có thể so sánh các mô hình trên cùng một tác vụ thay vì suy đoán hành vi của chúng từ các benchmark không liên quan.

export HAIMAKER_API_KEY=your-haimaker-key
npx -y @haimaker/connect --hermes

@haimaker/connect ghi cấu hình endpoint Hermes và xác minh key. Để thiết lập thủ công, dùng https://api.haimaker.ai/v1 làm base URL và sao chép ID hiện tại từ danh mục mô hình. Hướng dẫn custom provider của Hermes bao gồm URL theo từng nhà cung cấp và cách sửa lỗi timeout.

Thay đổi mô hình chỉ là một biến số. Nếu một phiên chạy nghiên cứu thất bại, hãy kiểm tra tìm kiếm, trích xuất, truy cập trình duyệt, và quyền tool trước khi đổ lỗi cho mô hình. Người dùng Hermes đã báo cáo rằng các phụ thuộc đó mới là yếu tố chi phối kết quả.

Mô hình nào phù hợp với từng công việc?

Tự động hóa hàng ngày: Claude Sonnet 5 là mô hình cloud đầu tiên nên thử khi Hermes xử lý tin nhắn, tệp, và tác vụ theo lịch trình. Chạy một tác vụ đa bước đại diện rồi đếm số lần gọi tool thất bại, số lần thử lại, và tổng số token. Nếu tác vụ mang tính lặp đi lặp lại, hãy so sánh với mô hình giá rẻ trước khi cam kết dùng mặc định cao cấp.

Lập trình rủi ro cao: Claude Opus 5 và GPT-5.6 Sol là ứng viên khi agent chỉnh sửa repository production hoặc phải phục hồi từ các lỗi khó. So sánh chúng trên cùng một vấn đề với cùng bộ tool. Một lần chạy thành công là bằng chứng hữu ích, nhưng chạy lặp lại nhiều lần mới cho thấy mô hình có xử lý gián đoạn và sai sót một cách nhất quán hay không.

Tài liệu dài và nghiên cứu: Gemini 3.8 Flash có cửa sổ ngữ cảnh lớn trong danh mục haimaker hiện tại. Điều đó khiến nó đáng để thử khi Hermes cần mang theo nhiều tài liệu hoặc kết quả tool. Cửa sổ lớn không đảm bảo truy xuất chính xác; hãy xác minh câu trả lời đối chiếu với tệp nguồn.

Công việc nền luôn bật: DeepSeek V4.1 Flash và GLM-5.3 Flash là các tùy chọn chi phí thấp. MiniMax M3 (minimax/minimax-m3) vẫn khả dụng nếu bạn đang dùng nó. Giao cho mỗi ứng viên một tác vụ có phạm vi giới hạn, một giới hạn số lần thử lại, và một mức chi tiêu tối đa. Một mô hình rẻ cứ lặp lại hành động thất bại có thể tốn kém hơn một mô hình mạnh hơn hoàn thành ngay lần đầu. Hãy giữ sẵn một mô hình cao cấp để chuyển lên khi cần, thay vì gửi mọi tác vụ cho nó.

Dùng một key haimaker.ai duy nhất để so sánh các mô hình này trên cùng một tác vụ Hermes. Giữ lại mô hình hoàn thành công việc đáng tin cậy với tổng chi phí chấp nhận được.

THỬ MÔ HÌNH VỚI MỘT KEY

Có nên chạy Hermes trên mô hình cục bộ không?

Hermes có thể sử dụng endpoint cục bộ tương thích OpenAI. Hướng dẫn mô hình cục bộ khuyến nghị chọn bản build phù hợp với ngân sách bộ nhớ thực tế, bao gồm trạng thái ngữ cảnh và bộ đệm runtime. Một mô hình chỉ vừa đủ tải có thể không còn đủ dung lượng cho ngữ cảnh của một phiên chạy agent dài.

Chạy cục bộ là hợp lý khi dữ liệu riêng tư phải ở trên máy của bạn hoặc bạn đã có sẵn phần cứng. Thảo luận mô hình Hermes tháng 9 có người dùng kết hợp mô hình chính cục bộ với mô hình cloud cho các tác vụ khó hơn. Hãy kiểm tra khả năng gọi tool và xử lý ngữ cảnh trước khi để mô hình cục bộ chạy không giám sát. Hướng dẫn mô hình lập trình Ollama của chúng tôi đề cập đến các tầng phần cứng, và API rẻ nhất cho coding agent đề cập đến phía cloud.

Nên so sánh các ứng viên cuối cùng như thế nào?

Chạy cùng ba tác vụ trên mỗi ứng viên: một tự động hóa thường xuyên, một chuỗi tool dài, và một tình huống lỗi yêu cầu phục hồi. Ghi lại tỷ lệ hoàn thành, số lần gọi tool sai, số lần thử lại, thời gian thực hiện, và tổng chi phí. Giữ nguyên hướng dẫn tác vụ và quyền truy cập tool để mô hình là biến số chính. Nếu một mô hình chỉ thắng trên benchmark nhưng thất bại trong quy trình làm việc của bạn, hãy chọn mô hình hoàn thành được công việc.

Hermes thay đổi nhanh, và danh mục mô hình cũng thay đổi theo. Hãy kiểm tra lại model ID trong danh mục trực tuyến khi cấu hình agent, rồi lặp lại bài so sánh nhỏ này khi có mô hình mới đầy hứa hẹn.

Câu hỏi thường gặp

Mô hình tốt nhất cho Hermes Agent năm 2026 là gì?

Claude Sonnet 5 là lựa chọn khởi đầu vững chắc cho tự động hóa Hermes hàng ngày. Chuyển sang Claude Opus 5 hoặc GPT-5.6 Sol khi tác vụ khó xứng đáng với mức giá cao cấp, và thử mô hình tiết kiệm như DeepSeek V4.1 Flash hoặc GLM-5.3 Flash cho công việc nền thường xuyên. Các tác vụ sử dụng nhiều tool của chính bạn mới là bài kiểm tra cuối cùng.

Mô hình rẻ nhất hoạt động tốt trong Hermes Agent là gì?

DeepSeek V4.1 Flash và GLM-5.3 Flash là các tùy chọn cloud chi phí thấp hiện có trong danh mục haimaker. Mô hình cục bộ tránh phí API theo token nhưng cần phần cứng phù hợp và có thể gặp khó khăn với các vòng lặp tool dài. Hãy kiểm tra độ tin cậy và tổng chi phí tác vụ trước khi chọn mặc định.

Làm sao để thay đổi mô hình mà Hermes Agent sử dụng?

Chạy hermes model, chọn Custom endpoint, và nhập base URL, API key, cùng model ID. Với haimaker.ai, sử dụng https://api.haimaker.ai/v1 và model ID từ danh mục trực tiếp. Bạn cũng có thể chạy npx -y @haimaker/connect --hermes để cấu hình endpoint.

CHẠY HERMES TRÊN HAIMAKER


So sánh agent thay vì mô hình? Xem Hermes vs Codex. Thiết lập endpoint? Xem Hướng dẫn custom provider của Hermes.