Hermes đứng trên đỉnh: Con đường thăng tiến của một đội ngũ Web3
Tác giả: 0xjacobzhao
Mở bảng xếp hạng ứng dụng công khai của OpenRouter, Hermes Agent đứng đầu toàn nền tảng với 30.5 triệu tỷ Token được sử dụng, đồng thời xếp hạng nhất trong bốn loại là Productivity, Coding Agents, Personal Agents và CLI Agents, vượt xa các Agent nổi tiếng như OpenClaw, Claude Code.

Hình 1 · Dữ liệu lịch sử của Hermes Agent trên OpenRouter (chụp vào ngày 4 tháng 8 năm 2026, dữ liệu trên trang động sẽ thay đổi theo thời gian)
Mặc dù tiêu chí thống kê của OpenRouter không thể bao quát toàn bộ tiêu thụ Token của ngành công nghiệp kết nối trực tiếp với API chính thức (như đăng ký gốc của Claude hoặc Codex), nhưng với tư cách là nền tảng định tuyến và tổng hợp mô hình AI lớn nhất toàn cầu hiện nay, bảng xếp hạng của nó có ý nghĩa "chỉ báo" rất mạnh mẽ. Mặc dù ở cấp độ nhiệm vụ chuyên nghiệp cao cấp, nhiều quy trình công việc cốt lõi của người dùng - tạo mã phức tạp, thiết kế kiến trúc, phân tích dữ liệu có giá trị cao - vẫn chảy về Claude Code và ChatGPT, nhưng Hermes vẫn duy trì lợi thế trong các tình huống sử dụng như tự động hóa nền tảng, phản hồi cửa ngõ tin nhắn, giám sát trực tuyến lâu dài và lập lịch nhiệm vụ nhẹ. Là một sản phẩm Agent được phát triển bởi đội ngũ Web3, Hermes đã đạt được sự lan tỏa, cộng đồng và cường độ sử dụng vượt xa mong đợi, chúng ta không thể không chú ý đến:
Tại sao Hermes có thể vượt lên trong việc gọi suy diễn trên OpenRouter?
Ranh giới thực sự giữa nó và OpenClaw nằm ở đâu?
Trong mối quan hệ với Claude Code và Codex, Hermes làm thế nào để duy trì "sự đồng tồn tại khác biệt" thay vì "cạnh tranh trực tiếp"?
I. Từ khung phát triển đến hệ thống AI cá nhân - Con đường của OpenClaw
Tại sao khung Agent sớm không tạo ra sản phẩm tiêu dùng
Trước khi OpenClaw xuất hiện, lĩnh vực Agent đã có cơ sở hạ tầng trưởng thành nhưng tồn tại giới hạn cơ bản: đơn vị áp dụng là "quy trình công việc của doanh nghiệp phát triển", chứ không phải "người dùng cá nhân". Các khung sớm có đặc điểm chung là hướng đến nhà phát triển, xuất mã hoặc cấu hình - chúng đã xây dựng cơ sở hạ tầng cho Agent nhưng không giao hàng Agent bản thân. Ngưỡng kỹ thuật quá cao dẫn đến việc luôn mắc kẹt trong giai đoạn "công cụ dành cho nhà phát triển", thiếu vòng khép kín sản phẩm để chuyển đổi công nghệ thành "tài sản riêng của cá nhân", lớp sản phẩm "Agent cá nhân" trực tiếp hướng đến người dùng cuối gần như trống rỗng.

Hình 1 · Cấu trúc sáu lớp của công nghệ Agent (lớp mô hình → lớp giao thức → lớp khung phát triển SDK → lớp điều phối thời gian chạy → lớp cơ sở hạ tầng thực thi → lớp quản trị triển khai)

OpenClaw thực sự đã thay đổi điều gì
OpenClaw không tái phát minh lại Agent Loop hoặc công nghệ lập lịch nhiệm vụ ở cấp độ cơ sở, đóng góp cốt lõi của nó nằm ở việc đóng gói hệ thống ở cấp sản phẩm. LangChain giải quyết "làm thế nào để xây dựng Agent", trong khi OpenClaw giải quyết "làm thế nào để sở hữu Agent". Nó đã bỏ qua lớp giữa của công nghệ, tích hợp các khả năng khung rải rác thành một sản phẩm hoàn chỉnh mà cá nhân có thể cấu hình trực tiếp và sử dụng lâu dài, thực hiện chuyển đổi căn bản từ "dự án phát triển" sang "cá nhân", cụ thể thể hiện qua sáu chiều đổi mới sản phẩm:
Nhân cách hóa danh tính: trao cho Agent một cái tên và danh tính liên tục, phá vỡ cảm giác công cụ của việc gọi API không trạng thái.
Thông thường hóa cửa ngõ: sử dụng các phần mềm giao tiếp tần suất cao như Telegram/WhatsApp làm giao diện tương tác, thay thế cho dòng lệnh phức tạp hoặc IDE.
Trạng thái thường trú: hoạt động như một tiến trình nền chạy trực tuyến lâu dài, thực hiện bước nhảy từ "chờ đợi" thụ động sang "có mặt" chủ động.
Thực thể hóa quyền hạn: đưa hệ thống tệp của người dùng, trình duyệt, thiết bị đầu cuối và khả năng hành động thực tế vào sâu trong ranh giới hoạt động của Agent.
Khả năng mở rộng: thông qua Skills, Memory và plugin cộng đồng, tích lũy quy trình thành khả năng có thể tái sử dụng, mở rộng ranh giới hành động.
Quyền sở hữu tâm trí: sự chuyển đổi cốt lõi nhất - người dùng từ "sử dụng một công cụ AI" chuyển thành "sở hữu một người bạn số riêng".
Tại sao cơn sốt tôm hùm không hình thành tâm trí thứ hai
Sự phổ biến của OpenClaw đã tạo ra nhiều sản phẩm giả mạo. Những sản phẩm này giải quyết các vấn đề thực sự của người dùng: quy trình cài đặt phức tạp, khó khăn trong cấu hình môi trường, thiếu kênh như WeChat và Feishu, khả năng tương thích của mô hình trong nước, triển khai nhanh trên máy chủ đám mây, quản lý quyền hạn doanh nghiệp, cập nhật tự động và cách ly an toàn. Chúng đều có nhóm người dùng riêng và có logic thương mại hợp lý. Nhưng gần như không có sản phẩm nào hình thành tâm trí thương hiệu độc lập - lý do là chúng trả lời câu hỏi "làm thế nào để sử dụng OpenClaw dễ dàng hơn", chứ không phải "Agent cá nhân nên tiến hóa về đâu sau OpenClaw". Vị trí của những người thách thức trong câu chuyện này là rất hiếm trong toàn bộ thị trường Agent cá nhân.
II. Tại sao cuối cùng Hermes lại vượt lên
Mô hình, cộng đồng và bối cảnh Crypto-native của Nous
Nous Research bắt nguồn từ cộng đồng nghiên cứu AI mã nguồn mở trên Discord vào năm 2022 và chính thức hoàn thành hoạt động công ty vào năm 2023, đội ngũ sáng lập cốt lõi bao gồm Jeffrey Quesnelle, Karan Malhotra, Teknium và Shivani Mitra, với các hoạt động bao gồm:
Dòng mô hình Hermes: thương hiệu mô hình mã nguồn mở đại diện nhất của Nous, tập trung lâu dài vào huấn luyện sau mô hình, tinh chỉnh chỉ dẫn và khả năng Agent, đã xây dựng một nền tảng lớn cho các nhà phát triển trên Hugging Face.
DisTrO (Đào tạo phân tán qua Internet): giảm đáng kể chi phí giao tiếp giữa các nút trong đào tạo phân tán, làm giảm nhu cầu giao tiếp giữa các nút trong đào tạo phân tán, cho phép các phần cứng khác nhau tham gia đào tạo hợp tác dưới điều kiện băng thông Internet.
Mạng đào tạo phi tập trung Psyche: mạng hóa DisTrO hơn nữa, thông qua Solana điều phối các nút tính toán phân tán toàn cầu, cho phép GPU từ các mạng và môi trường phần cứng khác nhau cùng tham gia đào tạo mô hình lớn.
Hermes Agent: sản phẩm Agent cá nhân được Nous phát hành cho người dùng cuối, tích hợp mô hình Hermes, gọi công cụ, Memory, Skills, kênh tin nhắn và khả năng hoạt động lâu dài thành một Agent thường trú.
Vào tháng 4 năm 2025, Nous Research hoàn thành vòng gọi vốn Series A trị giá 50 triệu USD do Paradigm dẫn đầu, với định giá token sau đầu tư đạt 1 tỷ USD. Trước vòng gọi vốn này, công ty đã hoàn thành khoảng 20 triệu USD vốn đầu tư sớm, với các nhà đầu tư bao gồm Distributed Global, North Island Ventures và Delphi Digital.
Nous đã xây dựng vòng khép kín công nghệ "Hermes (khả năng mô hình), DisTrO (đào tạo phân tán), Psyche (mạng tính toán phi tập trung) và Hermes Agent (sản phẩm đầu cuối cá nhân)". Việc phát hành Hermes Agent không phải là một Fork tạm thời theo đuổi sự phổ biến, mà là sự mở rộng chiến lược đầu tiên từ phía cung (dữ liệu, mô hình, đào tạo, trọng số mở) sang phía cầu (người dùng thực, nhiệm vụ, quy trình công việc) sau khi đã hoàn thành sự tích lũy lâu dài - điều này cung cấp cho nó một điểm khởi đầu sâu hơn để xây dựng sự khác biệt so với các sản phẩm giả mạo thông thường.
Điểm đau trong vận hành của OpenClaw trở thành động lực tăng trưởng của Hermes
Hermes và OpenClaw không có sự khác biệt đáng kể trong việc đóng gói cơ sở (mô hình + công cụ + Memory + lập lịch). Sự bùng nổ hiện tượng của nó không phụ thuộc vào sự khác biệt công nghệ, mà là khép kín một chuỗi nguyên nhân tăng trưởng hệ thống: thông qua việc chuyển giao công cụ liền mạch để tiếp nhận người dùng đã được giáo dục trưởng thành và chịu đựng điểm đau trong vận hành của OpenClaw, tạo thành động lực tăng trưởng cốt lõi nhất trong giai đoạn đầu.
Bước nhảy vọt về sức mạnh sản phẩm: thiết lập "độ tin cậy ủy thác" (Delegation Trust)
Giả thuyết cốt lõi của sản phẩm Hermes là giải quyết "chuyển giao trách nhiệm vận hành", cam kết "sẽ được hệ thống nội bộ hấp thụ và sửa chữa khi có lỗi":
Độ tin cậy: đảm bảo nhiệm vụ tiếp tục tiến triển và phục hồi sau thất bại (Kanban bền vững, chế độ /goal, tự phục hồi công cụ).
Độ an toàn: ngăn chặn quyền hạn vượt mức, xóa nhầm hoặc rò rỉ dữ liệu (luồng phê duyệt Approvals, sandbox, ranh giới quyền hạn nghiêm ngặt).
Độ tin cậy có thể xác minh: chứng minh nhiệm vụ đã hoàn thành thực sự (Hợp đồng hoàn thành và Trích dẫn có căn cứ).
Phân tích khái niệm: "tự tiến hóa" (lợi thế kể chuyện) vs "tự phục hồi" (khác biệt trải nghiệm)
Trong câu chuyện sản phẩm của Hermes, giá trị sản phẩm giữa "tự tiến hóa" và "tự phục hồi" có sự khác biệt rõ rệt:
Tự tiến hóa (Self-improvement): bản chất là thích ứng quy trình dựa trên Memory và Skills. Do các sản phẩm cạnh tranh có cơ sở hạ tầng tương tự, sự khác biệt của nó chủ yếu nằm ở việc tích hợp sớm thành hệ thống mặc định có quản lý vòng đời, chiếm lĩnh lợi thế kể chuyện "sẽ phát triển", chứ không phải là rào cản công nghệ đã được chứng minh và không thể vượt qua.
Tự phục hồi (Autonomous Recovery): đây là sự khác biệt trải nghiệm đáng kiểm chứng nhất hiện nay. Nhờ vào việc trả về lỗi có cấu trúc và Provider tự động quay lại, Hermes có thể tiêu hóa sự cố trong hệ thống nội bộ. Sự ổn định cấp hệ thống "không làm phiền người dùng thường xuyên" này là sự khác biệt sức mạnh sản phẩm trực tiếp và có thể cảm nhận được hơn.
Lợi ích cấu trúc: khả năng ủy thác và giám sát đối với Agent chuyên nghiệp
Giá trị cốt lõi của Hermes không nằm ở việc thực hiện tất cả các nhiệm vụ chuyên môn mà là đảm nhận vai trò tổng kiểm soát (Orchestrator) để hoàn thiện nhu cầu, phân tách nhiệm vụ, giám sát lộ trình và nghiệm thu cuối cùng. Thông qua việc ủy quyền cho Claude Code/Codex và các CLI bên ngoài thực hiện công việc cụ thể, cộng đồng đã hình thành một mô hình thực hành "Hermes tổng kiểm soát + CLI bên ngoài làm Worker" (như cơ chế /goal và công cụ phối hợp oh-my-hermes), thể hiện lợi thế kiến trúc của nó trong việc tăng cường độ phức tạp của nhiệm vụ thông qua việc điều phối các Agent chuyên nghiệp.
Từ Crypto-native đến Crypto-invisible: Hệ điều hành Web3 ẩn sau Hermes
Việc đơn giản quy kết thành công của Hermes cho "bối cảnh Web3" là một sự đơn giản hóa quá mức. Web3 cung cấp cho Nous một bộ "hệ điều hành tổ chức" mà các đội khởi nghiệp AI khác khó có thể có được cùng một lúc, cho phép họ tham gia vào thị trường chính thống với trải nghiệm sản phẩm AI tiêu chuẩn mượt mà:
Sự kiên nhẫn của vốn đầu tư mạo hiểm: Vốn Crypto-Native hỗ trợ đầu tư dài hạn, không chắc chắn cao và nhiều lộ trình song song, cho phép Nous đồng thời phát triển mô hình, đào tạo, Runtime và Cloud mà không cần phải thu hẹp quá sớm vào một nguồn thu nhập duy nhất.
Thị trường người dùng sẵn có: Cung cấp một nhóm người dùng Crypto AI quen thuộc với Telegram, máy chủ, API và tự lưu trữ, giảm đáng kể chi phí giáo dục khởi động lạnh, đồng thời thúc đẩy việc sử dụng mạnh mẽ, truyền bá hướng dẫn và đóng góp Skills.
Giá trị quyền sở hữu của người dùng: Giữ vững định hướng tự lưu trữ, mở, có thể di chuyển và chống khóa nền tảng, được hiện thực hóa trực tiếp thành Giấy phép MIT, hỗ trợ nhiều nhà cung cấp, BYOK và kiến trúc cơ sở hạ tầng có thể di chuyển Memory/Skills.
Nghiên cứu và phát triển cộng đồng cùng với tính chuyên môn hóa: Dựa vào hợp tác từ xa toàn cầu và văn hóa mã nguồn mở, người dùng tự phát trở thành Contributor, tác giả Skill và nhà thiết kế sản phẩm cho các lĩnh vực chuyên biệt.
Hermes hầu như không để Crypto lộ diện trước người dùng. Việc sử dụng Agent, Memory, Skills và khả năng tự động hóa của nó không cần phải kết nối ví, mua Token hoặc hiểu Solana. Trong khi đó, vốn Paradigm, Psyche, đào tạo phân tán và cộng đồng Crypto AI vẫn tồn tại trong nền sản phẩm. Điều này tạo ra một hình thái sản phẩm có thể được tóm tắt là "Crypto-native trong tổ chức, crypto-invisible trong sản phẩm" - giữ lại những phần có giá trị nhất của Crypto ở cấp độ tổ chức (vốn, cộng đồng toàn cầu, quyền sở hữu của người dùng và khả năng điều phối), loại bỏ những phần dễ cản trở việc áp dụng chính thống ở cấp độ sản phẩm (ví, Token, câu chuyện đầu cơ và ma sát trong các thao tác trên chuỗi).
Tại sao OpenClaw từ chối Crypto, tại sao Hermes lại ẩn Crypto
Sự đối lập bề mặt giữa OpenClaw và Hermes về vấn đề Crypto không phải là cuộc chiến ý thức hệ giữa "từ chối" và "ôm ấp", mà từ kết quả sản phẩm, cả hai đều thể hiện định hướng mã nguồn mở, kiểm soát của người dùng và giảm thiểu khóa nền tảng; sự khác biệt nằm ở chỗ Nous đã sử dụng cơ chế kinh tế mã hóa cho việc điều phối đào tạo phân tán, trong khi OpenClaw chủ yếu thực hiện quyền sở hữu của người dùng thông qua kiến trúc Local-first:
OpenClaw (Quyền sở hữu Local-first): Kháng cự lại đầu cơ tài chính, bảo vệ quyền sở hữu "địa phương ưu tiên". Do đã gặp phải lừa đảo tiền giả trong giai đoạn đầu, họ áp dụng chính sách "không khoan nhượng" đối với Crypto. Thông qua mã nguồn mở hoàn toàn và hoạt động tại chỗ, họ thực hiện việc bảo vệ quyền sở hữu của người dùng mà không cần đến blockchain, kiên quyết từ chối việc tài chính hóa ở cấp độ sản phẩm.
Hermes/Nous (Quyền sở hữu Cryptoeconomic): Hướng đến kỹ thuật, Crypto chỉ là công cụ điều phối cơ sở. Việc đưa blockchain vào là một lựa chọn thực dụng để đối phó với các thách thức kỹ thuật (như mạng Psyche sử dụng Solana để điều phối sức mạnh tính toán không đồng nhất), chứ không phải để xây dựng câu chuyện tài chính hướng đến người dùng cuối.

Ba, Mô hình nâng cao của Hermes - từ Agent cá nhân đến quản gia nhiệm vụ
Mục tiêu của phần này là trả lời một câu hỏi cơ bản hơn: Khi Claude Code và Codex đã có thể hoàn thành hầu hết các nhiệm vụ thực hiện chuyên môn với chất lượng cao, lý do tồn tại của Hermes như một sản phẩm độc lập là gì?
Mô hình A: Hợp tác trực tiếp (lợi ích hạn chế): Người dùng quen với việc thủ công tạo Prompt trong LLM và chuyển giao thực hiện, tự tay vận chuyển kết quả và kiểm tra. Chất lượng đầu ra một lần tuy cao, nhưng phải gánh chịu toàn bộ công việc quản lý dự án và điều phối nhiều Agent. Đối với những người dùng thích tự làm, tự động hóa của Hermes lại bị coi là "lớp trung gian làm tăng độ không minh bạch", không giảm bớt hiệu quả.
Mô hình B: Quản lý ủy quyền (lợi ích rõ ràng): Người dùng coi Hermes là tổng kiểm soát thường trực, chỉ đưa ra mục tiêu cuối cùng. Hermes chịu trách nhiệm phân tách nhiệm vụ, ủy quyền các nhiệm vụ con, theo dõi trạng thái GitHub/CI và tự động kích hoạt làm lại. Thực tiễn cộng đồng (như oh-my-hermes) cho thấy giá trị cốt lõi của Hermes chính là thay thế công việc điều phối phức tạp giữa các Agent và quản lý dự án.
Lớp đầu tiên · Mục tiêu và quản trị của người dùng
Người dùng định nghĩa mục tiêu cuối cùng, ngân sách, ranh giới rủi ro và quyền phê duyệt
↓
Lớp thứ hai · Lớp tổng kiểm soát nhiệm vụ Hermes
Hoàn thiện nhu cầu / Phân tách kế hoạch / Memory xuyên suốt / Lựa chọn và ủy quyền Agent / Giám sát tiến độ / Nghiệm thu kết quả / Khởi động làm lại
↓
Lớp thứ ba · Thực hiện chuyên môn và cơ sở hạ tầng
Claude Code / Codex / Các CLI chuyên biệt khác · GitHub / VM / Trình duyệt / Cơ sở dữ liệu / Cloud
Trong khung này, Hermes và Claude Code/Codex không phải là mối quan hệ thay thế mà là mối quan hệ phân lớp: cái sau cung cấp chất lượng thực hiện ở lớp thứ ba, cái trước cung cấp tính liên tục, trạng thái xuyên suốt và điều phối giữa các Agent ở lớp thứ hai. Giá trị của Hermes không phân bổ đồng đều cho tất cả người dùng mà có thể tập trung cao độ vào nhóm người dùng cao cấp thực hiện nhiệm vụ dài hạn, xuyên hệ thống và không đồng bộ. Sự đánh giá này chính xác hơn so với nhận định chung "trí tuệ thứ hai của Agent cá nhân đã hình thành" và cũng phù hợp hơn để hướng dẫn thương mại hóa và ưu tiên sản phẩm.

Hình 2 · Toàn cảnh kiến trúc công nghệ Hermes Agent (cổng người dùng → Gateway → lõi điều khiển → lớp nhà cung cấp → lớp thực hiện → lớp điều phối → lớp trạng thái → lớp quản trị)
Dựa trên nghiên cứu cộng đồng tài liệu chính thức, khung kiến trúc công nghệ Hermes Agent bao phủ toàn bộ chuỗi liên kết từ tương tác người dùng đến quản trị học tập:
Hỗ trợ cấp hệ thống tự phục hồi: "lõi điều khiển" rõ ràng bao gồm nén Context, Fallback nhà cung cấp và lưu trạng thái gián đoạn, cung cấp cơ sở kỹ thuật cho việc phục hồi sự cố và khả năng tự chữa lành của hệ thống khi nhiệm vụ thất bại.
Logic thực hiện "ủy quyền chứ không thay thế": "công cụ và lớp thực hiện chuyên môn" đặt Claude Code, Codex và các CLI bên ngoài ngang hàng với các công cụ gốc của Hermes (Terminal, Trình duyệt, v.v.), xác nhận vị trí của nó như một trung tâm điều phối.
Tính chất quản trị "tự tiến hóa": "lớp học tập, bảo trì và quản trị" bao gồm các nút như Curator, Skill/Command Approval, cho thấy sự tích lũy kinh nghiệm của nó là một quy trình quản trị có cơ chế can thiệp của con người, chứ không phải là một hộp đen hoàn toàn tự động.
Bốn, Mô hình kinh doanh - Ai sẽ trả tiền cho "Hermes"?
Nếu chỉ so sánh chi phí Token của nó với việc đăng ký trực tiếp Claude Code/Codex, sẽ dẫn đến kết luận sai lầm. Bởi vì thuật toán này bỏ qua giá trị cốt lõi của Hermes: thay thế công việc quản lý dự án, vận chuyển ngữ cảnh và điều phối giữa các Agent mà người dùng phải tự thực hiện.
Công thức giá trị người dùng Hermes = Thời gian điều phối nhân công tiết kiệm + Giá trị không người giám sát và không cần người + Lợi ích tự động hóa giữa các hệ thống - Chi phí Token và công cụ - Chi phí can thiệp của con người - Rủi ro thất bại và an toàn
Do đó, tính kinh tế của Hermes không phải là tuyệt đối mà phụ thuộc cao vào "độ sâu ủy quyền" của người dùng:
Độ sâu ủy quyền cao (tính kinh tế có hiệu lực): Nếu Hermes có thể biến những nhiệm vụ cần hàng giờ giám sát của con người thành thực hiện không cần giám sát thực sự, ngay cả khi chi phí Token hơi cao, tổng chi phí thời gian và lợi ích hiệu quả vẫn là tích cực.
Độ sâu ủy quyền thấp (tính kinh tế sụp đổ): Nếu người dùng vẫn cần can thiệp thường xuyên để sửa lỗi và cứu hỏa, Hermes sẽ trở thành một thiết bị tiêu thụ Token thuần túy và khuếch đại sự cố.
Cơ chế này giải thích chính xác lý do tại sao các nhóm người dùng khác nhau có đánh giá hoàn toàn trái ngược về tính kinh tế của Hermes, và cũng gợi ý cho chúng ta: việc xác minh logic thương mại của nó nằm ở việc định lượng "tỷ lệ hoàn thành không cần giám sát" và "số lần can thiệp của con người cho mỗi nhiệm vụ", chứ không chỉ đơn thuần so sánh giá của API mô hình.
Nền tảng thương mại hóa: Nous Portal và Hermes Cloud
Hermes Agent được cấp phép mã nguồn mở theo giấy phép MIT, định vị là động cơ tăng trưởng hệ sinh thái. Vòng khép kín thương mại hóa thực sự tập trung vào Nous Portal, với giá trị cốt lõi là "một đăng ký, tích hợp nhiều loại khóa API", bao gồm ba mô-đun lớn:
Định tuyến mô hình: Tập hợp 252 mô hình (thông qua OpenRouter và kết nối trực tiếp với nhà cung cấp để cung cấp suy diễn).
Cổng công cụ (Tool Gateway): Tích hợp Firecrawl (tìm kiếm web), FAL (tạo hình ảnh), Sử dụng Trình duyệt (trình duyệt đám mây), Modal (thực hiện trong hộp cát) và OpenAI Audio (TTS) cùng với các công cụ tần suất cao khác.
Dịch vụ lưu trữ: Các phiên bản Hermes Cloud sẵn sàng sử dụng (thu phí hàng ngày cho việc vận hành, không bao gồm phí suy diễn và gọi công cụ).
Doanh thu thực tế của Nous phụ thuộc cao vào lộ trình sử dụng của người dùng, hiện đang thể hiện sự phân hóa cấu trúc rõ rệt:

Mã nguồn mở và thương mại hóa, liệu Hermes có trở thành "Linux của thế giới Agent" không?
Chiến lược mã nguồn mở MIT của Hermes trong khi thúc đẩy tăng trưởng bùng nổ, cũng tạo ra những ràng buộc cấu trúc cho thương mại hóa. Mô hình miễn phí tự lưu trữ yêu cầu phiên bản trả phí của nó phải có giá trị bổ sung không thể thay thế, nhưng hiện tại vẫn chưa hình thành được con đường chuyển đổi khác biệt rõ ràng. Rủi ro sâu hơn nằm ở "giá trị bị giữ lại": nếu Hermes tiếp tục được tích hợp rộng rãi như một Runtime tùy chọn bởi các nhà cung cấp đám mây, có thể sẽ lặp lại tình huống kinh điển của Linux hoặc K8s, giá trị thương mại cốt lõi bị các nhà cung cấp đám mây cung cấp sức mạnh tính toán và lưu trữ giữ lại. Giấy phép MIT, trong khi đổi lấy sự thịnh vượng của hệ sinh thái, cũng có nghĩa là từ bỏ quyền kiểm soát tuyệt đối đối với các kênh phân phối. Chỉ cần người dùng có thể tự do lựa chọn "tự lưu trữ + API riêng" hoặc "triển khai đám mây bên thứ ba", khối lượng sử dụng khổng lồ sẽ không thể ép buộc chuyển đổi thành doanh thu trực tiếp, khiến Nous đối mặt với thử thách nghiêm trọng về "nâng cao vị thế sinh thái" và "không tương xứng với lợi nhuận thương mại thực tế".
V. Vị thế sinh thái của Agent ------ Tổng quản gia cá nhân, công cụ chuyên nghiệp và cấu trúc ba bên với Claw của các công ty lớn
OpenClaw, Hermes và Claude Code, Codex cùng các sản phẩm lưu trữ của các công ty lớn có sự khác biệt rõ rệt về người dùng mục tiêu và chủ đề cốt lõi, thuộc về các phân khúc khác nhau. Để làm rõ cấu trúc thị trường hiện tại, ma trận cạnh tranh cốt lõi của AI Agent như sau:

Hermes không theo đuổi thị trường đại chúng mà chính xác nhắm vào bốn loại Power User có mật độ cao, tạo thành nền tảng cho sự lan truyền hiện tượng của nó:
Người chơi tự lưu trữ và cơ sở hạ tầng: quen thuộc với VPS/Docker/SSH, coi Hermes là lớp kiểm soát tự nhiên cho cơ sở hạ tầng hiện có.
Nhà đầu tư đa mô hình: từ chối bị khóa bởi một nhà cung cấp duy nhất, quen với việc điều phối mô hình tiên tiến hoặc địa phương theo nhiệm vụ.
Người điều phối đa Agent: cần tự động hóa quy trình làm việc phức tạp liên kết giữa các nền tảng và công cụ.
Cộng đồng AI mã nguồn mở và Crypto: rất đồng tình với quyền sở hữu của người dùng và triết lý phi tập trung, cộng hưởng sâu sắc với văn hóa tổ chức của Nous.
Mặc dù số lượng nhóm này nhỏ, nhưng họ có mức tiêu thụ Token, đóng góp mã và khả năng truyền bá công nghệ rất cao, là động lực chính thúc đẩy sự lan truyền miệng trong giai đoạn đầu.
Claude Code/Codex: vừa là bên cung cấp, vừa là mối đe dọa
Sự cộng sinh ngắn hạn: nâng cao giới hạn thực hiện
Trong quy trình làm việc thực tế, Hermes đóng vai trò là lớp kiểm soát chính, thông qua cơ chế ủy quyền gọi Codex (thực hiện mã) và Claude Code (kiến trúc và kiểm tra). Agent chuyên nghiệp càng mạnh, độ phức tạp nhiệm vụ mà Hermes có thể giao phó càng cao, tạo thành mối quan hệ cộng sinh "Hermes chịu trách nhiệm định tuyến và nghiệm thu, Agent chuyên nghiệp chịu trách nhiệm thực hiện".
Dài hạn có thể nuốt chửng giá trị độc lập của Hermes:
Các nhà cung cấp mô hình đang tăng tốc thâm nhập vào lớp kiểm soát chính, mối đe dọa gần hơn dự kiến. Các Agent Quản lý của Claude từ Anthropic đã hỗ trợ việc điều phối đa Agent song song; OpenAI thậm chí đã xác định Codex App là "trung tâm điều khiển cho các Agent", hỗ trợ đa Agent song song, tự động hóa và chạy nền tảng lâu dài. Điều này có nghĩa là khả năng kiểm soát đa Agent của Codex trong ranh giới kỹ thuật phần mềm đã tương đối trưởng thành, thậm chí trong một số lĩnh vực vượt qua Hermes, không còn là "người thực hiện ở cấp độ cơ sở" đơn thuần.
Hermes tạm thời có lợi thế về mặt kiểm soát cá nhân qua các kênh, mô hình và dự án; nhưng Codex đã có khả năng sở hữu nhiệm vụ mạnh mẽ và quản lý đa Agent trong ranh giới kỹ thuật phần mềm, lợi thế cạnh tranh trong ranh giới này có thể mạnh hơn Hermes. Vấn đề cạnh tranh cốt lõi là: liệu Hermes có thể trước các nhà cung cấp mô hình, lưu trữ trạng thái dự án của người dùng, quy tắc phê duyệt, Kỹ năng, Bộ nhớ và quy trình làm việc đa Agent ở lớp của mình, tạo ra tài sản mà người dùng không muốn chuyển nhượng? Hay cuối cùng sẽ bị các sản phẩm gốc mô hình hấp thụ như một chức năng tiêu chuẩn?
Lựa chọn chiến lược của các công ty lớn về Agent
Để thảo luận về chiến lược của các công ty lớn đối phó với làn sóng Agent cá nhân, trước tiên cần làm rõ ranh giới sản phẩm của họ: dịch vụ lưu trữ Agent thường trú hướng đến cá nhân (như Tencent QClaw, Byte ArkClaw) và Agent làm việc chung hướng đến văn phòng/doanh nghiệp (như WorkBuddy, Trae) có định vị hoàn toàn khác nhau:
Lộ trình Claw của các công ty lớn: giảm bớt rào cản thông qua triển khai một lần, mẫu đã định sẵn và kết nối với hệ sinh thái địa phương. Nhưng khoảng cách sâu sắc nằm ở chỗ động lực của nền tảng không đáng tin cậy: bất kể hỗ trợ bao nhiêu mô hình bên ngoài, người dùng tự nhiên cho rằng mục đích cuối cùng của họ là dẫn dắt đến đám mây và hệ thống mô hình của riêng họ.
Tích hợp Hermes Runtime: Byte ArkClaw và Tencent Cloud đã chính thức đưa Agent Hermes vào như một plugin tùy chọn hoặc mẫu độc quyền kết nối vào bảng điều khiển đám mây của họ, xác lập chiến lược đa Runtime rõ ràng: các công ty lớn giữ lại nền tảng lưu trữ đám mây, thanh toán, an ninh và kiểm soát doanh nghiệp của riêng họ, đồng thời xem Hermes như một thành phần cao cấp có thể cắm vào, đạt được sự cộng sinh bổ sung giữa hệ sinh thái mã nguồn mở và nền tảng đám mây thương mại.
Chuyển đổi Agent văn phòng chung: hiện tại các công ty lớn đang chuyển nguồn lực cốt lõi từ Claw sang nền tảng Agent văn phòng chung có nhu cầu rõ ràng, dễ tiếp nhận và có thể chuyển đổi thành doanh thu (như WorkBuddy). Những nhiệm vụ này có thể gắn bó sâu sắc với hệ sinh thái của WeChat, DingTalk, Feishu và chuyển đổi thành doanh thu.
VI. Những gợi ý của Hermes cho Crypto AI
Web3 không trực tiếp biến Hermes thành một Agent thông minh hơn, mà cho Nous một cấu trúc vốn, cách tổ chức, người dùng hạt giống và nguồn gốc giá trị khác với các công ty khởi nghiệp AI truyền thống. Hermes ít nhất đã đưa ra một con đường Crypto AI trưởng thành hơn: để Crypto trở thành tổ chức và cơ sở hạ tầng, chứ không phải là giao diện sản phẩm mà người dùng phải đối mặt.
Hermes đã hoàn thành việc chuyển đổi từ thương hiệu nghiên cứu Crypto AI sang sản phẩm Agent mã nguồn mở toàn cầu, thiết lập các hoạt động suy diễn có thể quy cho quy mô lớn và tâm trí thứ hai rõ ràng ------ nhưng tâm trí này hiện vẫn tập trung vào hệ sinh thái OpenRouter và vòng tròn các nhà phát triển toàn cầu, chưa chuyển đổi thành GitHub Stars hoặc quy mô cộng đồng tổng thể vượt trội so với OpenClaw. Nó không có công nghệ độc quyền mà OpenClaw không thể sao chép, mà thông qua việc tiếp nhận chính xác người dùng có cường độ cao, xây dựng "có thể ủy quyền" và "tự tiến hóa" đã hoàn thành một lần lặp sản phẩm thách thức đáng nghiên cứu.
Gợi ý một: Crypto có thể là "hệ điều hành tổ chức", chứ không phải chức năng sản phẩm: giá trị thực sự của Web3 có thể được thể hiện qua cấu trúc vốn, nhóm người dùng cường độ cao giai đoạn đầu và nền tảng giá trị, không cần phải buộc phải lộ diện dưới dạng ví hoặc tương tác Token. Thực hiện "Crypto-native ở cấp tổ chức, Crypto-invisible ở cấp sản phẩm" là một chiến lược hiệu quả cân bằng giữa động lực đổi mới và trải nghiệm người dùng.
Gợi ý hai: Cơ sở hạ tầng phi tập trung phải định vị đầu vào phía nhu cầu để hình thành vòng khép kín: mạng lưới đào tạo phân tán thuần túy từ phía cung (như DisTrO, Psyche) nếu không có đầu vào người dùng thực tế và dữ liệu thực hiện hỗ trợ, khó có thể tự chứng minh giá trị thương mại. Agent Hermes chính là sự xác thực quan trọng cho sự chuyển đổi của Nous từ cơ sở hạ tầng sức mạnh tính toán cơ bản sang phía nhu cầu thực tế.
Gợi ý ba: Hàng rào bảo vệ có thể được xây dựng trên "niềm tin ủy quyền" chứ không chỉ đơn thuần là "khả năng mô hình": sự khác biệt của Agent cá nhân chưa chắc xuất phát từ khả năng thực hiện một lần mạnh mẽ hơn, mà nằm ở "người dùng có dám giao trách nhiệm lâu dài cho nó hay không". Tài sản niềm tin mềm này là một chiều hướng thường bị bỏ qua nhưng có rào cản lớn trong các dự án Crypto AI.
Gợi ý bốn: Mối quan hệ với các công ty đám mây không phải là trò chơi tổng bằng không, mà là sự bổ sung sinh thái: các công ty lớn đưa Hermes vào như một Runtime tùy chọn, chứng minh rằng Runtime mã nguồn mở và lớp kiểm soát của các công ty lớn có thể đồng tồn tại. Đối với các nhà khởi nghiệp, "bị tích hợp" là một con đường thương mại khả thi, nhưng cần cảnh giác với rủi ro giá trị cốt lõi bị các nhà cung cấp đám mây giữ lại.
Gợi ý năm: Cuộc cạnh tranh cuối cùng sẽ chuyển từ "khả năng thực hiện một lần" sang "quyền sở hữu nhiệm vụ và tích lũy niềm tin": trong tương lai, giá trị lớn nhất chưa chắc là mô hình mạnh nhất ở cấp thực hiện, mà là "hệ thống kiểm soát tổng thể" có thể tiếp nhận mục tiêu cuối cùng, duy trì Context lâu dài, thông minh điều phối các thực hiện chuyên nghiệp và khiến người dùng yên tâm giao trách nhiệm.
OpenClaw đã làm cho "cá nhân sở hữu Agent" trở thành một loại sản phẩm rõ ràng; Hermes thì thông qua trạng thái bền vững, phục hồi nhiệm vụ, nghiệm thu bằng chứng, cung cấp đa mô hình và ủy quyền Agent chuyên nghiệp, đã thúc đẩy "Agent ủy thác lâu dài" trở thành một hướng sản phẩm hệ thống hơn. Thử thách thực sự là: khi khả năng kiểm soát tổng thể của Claude Code, Codex trong ranh giới kỹ thuật phần mềm tiếp tục tăng cường, và các nền tảng đám mây của các công ty lớn làm cho việc tích hợp đa Runtime trở nên mượt mà hơn, liệu người dùng có vẫn sẵn lòng giao mục tiêu cuối cùng và niềm tin lâu dài cho Runtime mở đến từ bối cảnh Web3 này ------ và tiếp tục trả phí cho điều đó hay không.
Tuyên bố miễn trừ trách nhiệm: Trong quá trình sáng tác, bài viết này đã sử dụng các công cụ AI như Claude Opus 5, ChatGPT-5.5, Qwen 3.7 để hỗ trợ hoàn thành, tác giả đã cố gắng kiểm tra và đảm bảo thông tin là thật và chính xác, nhưng vẫn không thể tránh khỏi sai sót, mong được thông cảm. Cần đặc biệt lưu ý rằng nội dung bài viết này chỉ được sử dụng cho việc tổng hợp thông tin và trao đổi học thuật/nghiên cứu, không cấu thành bất kỳ lời khuyên đầu tư nào, cũng không nên được coi là bất kỳ khuyến nghị mua bán nào của bất kỳ token nào.












