Giới thiệu
Hermes Agent đã bùng nổ về mức độ phổ biến như một khuôn khổ trợ lý AI tự cải thiện, nhưng cùng với sự phát triển đó là những khó khăn ban đầu. Trong 2–3 tháng qua, người dùng trên Reddit (r/LocalLLaMA, r/AI_Agents, r/ArtificialIntelligence, r/hermesagent, v.v.) và trên X (Twitter) đã đưa ra một danh sách dài các khiếu nại. Chúng tôi đã sàng lọc hàng trăm chủ đề và bài đăng để xác định 20 vấn đề phổ biến nhất mà người dùng báo cáo. Dưới đây là bảng xếp hạng các vấn đề dựa trên tần suất xuất hiện và mức độ ảnh hưởng đến người dùng, kèm theo các ví dụ từ các cuộc thảo luận thực tế của cộng đồng. Đối với mỗi vấn đề, chúng tôi mô tả vấn đề, trích dẫn hoặc diễn giải phản hồi thực tế của người dùng, ghi nhận mức độ phổ biến của nó và đề cập đến bất kỳ giải pháp khắc phục hoặc phản hồi nào từ nhà phát triển.
1. Tự đánh giá luôn “Thành công”
Vấn đề: Tính năng tự đánh giá tích hợp của Hermes gần như luôn báo cáo thành công, ngay cả khi các tác vụ gặp trục trặc. Về cơ bản, vòng lặp học hỏi của tác nhân đã nghĩ sai rằng nó đang hoạt động tốt. Điều này đã được nhiều người dùng nhiều lần ghi nhận. Ví dụ, một Redditor đã tóm tắt: “Nó luôn nghĩ rằng nó đã làm tốt. LUÔN LUÔN… [tác vụ của tôi] đã bị rối tung lên nhưng nó nghĩ rằng nó đã làm rất xuất sắc!” (kilo.ai). Nói cách khác, bước xem xét của Hermes quá tự tin, do đó các kỹ năng được tạo ra từ các tác vụ “thành công” có thể ẩn chứa những lỗi tiềm ẩn. Lỗi thiết kế này có thể khiến tác nhân học các hành vi không chính xác.
Tác động: Cao. Người dùng thấy đáng báo động khi Hermes không bao giờ tự nhận ra lỗi của mình. Hàng tá bình luận trên r/OpenClaw và các sub liên quan đã than phiền rằng vòng lặp tự kiểm tra của Hermes không đáng tin cậy (ví dụ: “‘Hermes luôn nghĩ mình làm tốt’ là vấn đề chính” (kilo.ai)). Nhiều người coi đây là một vấn đề an toàn nghiêm trọng vì nó làm suy yếu lòng tin vào khả năng tự chủ của tác nhân.
Ví dụ: Trong phân tích của Kilo.ai về hơn 1.300 bình luận trên Reddit, nhiều người dùng đã nêu ra chính xác vấn đề này (kilo.ai). Trên r/LocalLLaMA, một người dùng đã hỏi tại sao Hermes lại “tự động chấp thuận” lỗi của chính nó.
Giải pháp tạm thời/Phản hồi: Không có cách khắc phục dễ dàng nào ngoài việc tắt vòng lặp tự học hoặc tự mình xem xét từng kỹ năng tự động tạo. (Hermes cho phép tắt hoặc yêu cầu phê duyệt kỹ năng, nhưng điều đó làm mất đi ý nghĩa của “tự cải thiện”). Các nhà phát triển vẫn chưa cung cấp bản vá cụ thể nào cho vấn đề này và đây vẫn là một lo ngại được báo cáo rộng rãi. Người dùng khuyến nghị xem xét cẩn thận bất kỳ kỹ năng mới nào mà Hermes tạo ra trước khi tin tưởng chúng.
2. Ghi đè các chỉnh sửa/kỹ năng thủ công
Vấn đề: Tính năng “tự cải thiện” kỳ quặc có thể hủy bỏ hoặc làm rối tung công việc tùy chỉnh của người dùng. Nếu bạn tự tinh chỉnh một kỹ năng cho một tác vụ, Hermes sau này có thể ghi đè lên nó khi nó “cải thiện” chính mình. Như một người dùng kỳ cựu đã nói, “Phần ghi đè các chỉnh sửa thủ công của bạn là một điểm trừ hoàn toàn. Nếu tôi đã dành thời gian để tinh chỉnh một kỹ năng cụ thể, việc tác nhân ‘tự cải thiện’ nó trở lại thành một mớ hỗn độn nghe có vẻ như một cơn ác mộng” (kilo.ai). Tóm lại, việc đào tạo kỹ năng tự động của tác nhân có thể xung đột với các chỉnh sửa của con người, dẫn đến mất dữ liệu hoặc hành vi bị hỏng.
Tác động: Cao đối với người dùng nâng cao. Vấn đề này đã xuất hiện nhiều lần trong các cuộc thảo luận: người dùng đã tùy chỉnh tác nhân của họ rất thất vọng khi thấy những sửa chữa đó bị xóa sổ tự động. Một người đóng góp cảnh báo rằng “người dùng thành thạo” (power users) tinh chỉnh kỹ năng thấy đây là “một điểm trừ” (kilo.ai). Nhiều người chỉ ra rằng Hermes không bao giờ cho phép các cải tiến thủ công “được giữ lại” nếu chúng khác với những gì tác nhân nghĩ là tối ưu.
Ví dụ: Nghiên cứu của Kilo.ai đã trích dẫn một thành viên cộng đồng nói rằng hành vi “ghi đè” này khiến Hermes không thể sử dụng được cho các kỹ năng nhà thông minh của anh ấy (kilo.ai). Nhiều chủ đề trên Reddit ghi nhận những câu chuyện về các quy trình làm việc được tinh chỉnh cẩn thận bị tự động ghi lại.
Giải pháp tạm thời/Phản hồi: Một giải pháp tạm thời là khóa hoặc phê duyệt kỹ năng theo cách thủ công (sử dụng /memory reject của Hermes hoặc hàng đợi phê duyệt) để nó không ghi đè lên chúng. Các nhà phát triển thừa nhận sự căng thẳng này: tài liệu chính thức thậm chí còn so sánh điều này với tính năng khôi phục phiên bản trong kiểm soát phiên bản (kilo.ai) (hermes-agent.nousresearch.com). Trên thực tế, người dùng đề xuất thỉnh thoảng tắt vòng lặp học hỏi (hermes skill disable-learn) hoặc sử dụng các lệnh TUI để lưu kỹ năng theo cách thủ công, nhằm ngăn chặn việc ghi đè không mong muốn.
3. Tích hợp hạn chế (Ít kênh/kỹ năng hơn)
Vấn đề: So với các đối thủ cạnh tranh như OpenClaw, Hermes ban đầu hỗ trợ ít kênh nhắn tin, công cụ và “kỹ năng” của bên thứ ba hơn. Người dùng chạy các thiết lập đa kênh lưu ý rằng Hermes không hỗ trợ tất cả các nền tảng (một số tích hợp bị thiếu hoặc chậm trễ). Chẳng hạn, một người dùng đã nhận xét trên Reddit: “OpenClaw có nhiều tích hợp hơn; Hermes có một hệ thống bộ nhớ tốt hơn một cách chủ quan” (kilo.ai). Điều này phản ánh một sự đánh đổi: Hermes cung cấp khả năng học tập thông minh, nhưng chưa sánh kịp với sự đa dạng của các kỹ năng cắm và kết nối mà các tác nhân ban đầu (hoặc OpenClaw) có.
Tác động: Trung bình. Mặc dù không phải là trở ngại lớn cho việc sử dụng đơn giản, nhiều người dùng đã báo cáo thiếu các tích hợp yêu thích của họ (ví dụ: các API, plugin hoặc ứng dụng nhắn tin cụ thể). Các cuộc thảo luận trên r/AI_Agents và r/LocalLLaMA liên tục so sánh hai công cụ này, với các bài đăng của bên thứ ba xác nhận rằng Hermes thiếu sự đa dạng cổng đa kênh của OpenClaw (kilo.ai). Đối với các nhóm cần những thứ như WhatsApp hoặc các lệnh gọi API tùy chỉnh, đây là một lỗ hổng đáng chú ý.
Ví dụ: Một người bình luận trên Reddit đã chỉ ra chính xác rằng “OpenClaw có nhiều tích hợp hơn” so với Hermes (kilo.ai). Tương tự, các chủ đề trên X (Twitter) có người dùng trao đổi về việc tác nhân nào hỗ trợ dịch vụ nào, và nhiều người đề cập Hermes hiện tại ‘ít’ về các kết nối.
Giải pháp tạm thời/Phản hồi: Đội ngũ Hermes đang nhanh chóng bổ sung thêm nhiều kênh “cổng” (Telegram, Discord, Slack, v.v.) và có một trung tâm kỹ năng, nhưng người dùng vẫn tìm thấy một số lỗ hổng. Khi thiếu một tích hợp, người dùng hoặc là tự tạo tác nhân trong một hệ thống kết nối (ví dụ: sử dụng cổng của OpenClaw với quá trình xử lý của Hermes) hoặc viết các công cụ tùy chỉnh bằng giao diện công cụ/plugin của Hermes. Không có bản sửa lỗi chính thức nào ngoài tuyên bố “sẽ có thêm nhiều tích hợp” và các cuộc thảo luận công khai cho thấy đây vẫn là một hạn chế hiện tại.
4. Chu kỳ phát hành và tuyên bố ổn định chưa trưởng thành
Vấn đề: Nhiều người dùng không tin vào các tuyên bố rằng Hermes “ổn định hơn” so với các lựa chọn thay thế, chỉ ra rằng nó chưa được kiểm tra nhiều. Một người bình luận đã thẳng thắn nói: “Hermes mới có 6 bản phát hành so với 82 bản phát hành của [OpenClaw]… 3 trong số các bản phát hành của Hermes thậm chí còn không hoạt động. Đừng tin vào những tuyên bố về việc nó ổn định hơn vì nó chưa có mặt lâu” (kilo.ai). Nói cách khác, với chỉ khoảng hơn chục bản phát hành chính thức cho đến nay, một vài phiên bản lỗi hoặc không đầy đủ đã được phát hành, trái ngược với những lời quảng cáo cường điệu về sự ổn định vững chắc.
Tác động: Trung bình đến Cao. Đây thường không phải là lỗi chức năng, nhưng nó ảnh hưởng đến lòng tin. Các bài đăng thường xuyên ghi nhận rằng các phiên bản Hermes ban đầu (v0.3-v0.5) thường có các lỗi nghiêm trọng đã được vá nhanh chóng. Người dùng trong các cuộc thảo luận trên Reddit và các vấn đề trên GitHub chỉ ra các sự cố hoặc tính năng bị thiếu trong mỗi bản phát hành mới. So với các dự án kỳ cựu (OpenClaw), Hermes vẫn đang “tìm chỗ đứng”, vì vậy người dùng kỳ vọng sẽ có những lỗi hồi quy hoặc thiếu sót không thường xuyên.
Ví dụ: Phân tích của Kilo đã làm nổi bật chính xác trích dẫn trên từ một người dùng thất vọng (kilo.ai). Các chủ đề trên Reddit từ cuối tháng 4 đến tháng 5 cho thấy người dùng nâng cấp chỉ để tìm thấy lỗi mới, sau đó phải chờ các bản vá. Một số vấn đề chính thức trên GitHub ghi lại các vấn đề của các bản phát hành ban đầu (ví dụ: thiếu lệnh CLI).
Giải pháp tạm thời/Phản hồi: Đội ngũ Hermes rất tích cực; gần như mỗi tuần đều có một bản phát hành sửa lỗi. Giải pháp là lặp lại nhanh chóng: một lỗi trong v0.6 thường được sửa trong vòng vài ngày. Phản hồi chính thức là nhấn mạnh việc nâng cấp thường xuyên (ví dụ: hermes update). Người dùng khuyên nên giữ các phiên bản ổn định hoặc đọc ghi chú phát hành. Theo thời gian, điều này sẽ được cải thiện – các phiên bản sau (v0.9+) có ít lỗi nghiêm trọng hơn – nhưng hiện tại người dùng phải cập nhật cẩn thận và sẵn sàng khắc phục sự cố sau mỗi lần nâng cấp.
5. Astroturfing và Sự hoài nghi về quảng cáo cường điệu
Vấn đề: Một khiếu nại phổ biến đáng ngạc nhiên không phải về mã nguồn, mà là về động lực cộng đồng: một số người dùng tin rằng các cuộc thảo luận về Hermes bị “làm giả” (astroturfed). Tức là, các tài khoản ẩn danh hoặc mới tạo tích cực quảng bá Hermes khiến những người khác cảnh giác. Một bài đăng phổ biến trên X đã nhận xét rằng “tất cả các tài khoản quảng bá Hermes này đều chỉ mới vài ngày tuổi và đó là điều duy nhất họ nói về”, cho thấy một nỗ lực tiếp thị có tổ chức (kilo.ai). Những người khác cáo buộc ai đó đứng sau Hermes đã dàn dựng sự cường điệu AI lan truyền. Sự thiếu tin tưởng này làm giảm nhiệt tình đối với chính công cụ đó.
Tác động: Vấn đề xã hội ở mức độ trung bình. Điều này không làm hỏng phần mềm, nhưng nó ảnh hưởng đến số lượng người dùng thử Hermes ngay từ đầu. Một số thành viên cộng đồng được kính trọng cho biết họ tránh Hermes vì họ thấy hàng chục bài đăng khen ngợi gần như giống hệt nhau của những người dùng mới (kilo.ai). Bản thân sự hoài nghi đã trở thành một chủ đề tranh luận, thường được ủng hộ mạnh mẽ, trên các diễn đàn AI và Reddit.
Ví dụ: Chủ đề của Kilo trích dẫn một người dùng gọi đây là “chiến dịch tiếp thị du kích trên Reddit” (kilo.ai). Nhiều bình luận hàng đầu trên r/AI_Agents phản ánh cùng nỗi sợ hãi: rằng bất kỳ “cuộc thảo luận tích cực lan truyền” nào cũng được dàn dựng.
Giải pháp tạm thời/Phản hồi: Không có giải pháp kỹ thuật nào – đây là vấn đề chính trị cộng đồng. Một số lãnh đạo cộng đồng đề xuất bỏ qua tuổi tài khoản và đánh giá công cụ dựa trên giá trị thực. Dữ liệu từ người dùng thực (như báo cáo của Autonomics về việc sử dụng Hermes trong kinh doanh) được chia sẻ để trấn an những người hoài nghi. Về mặt chính thức, đội ngũ Hermes chưa công khai giải quyết những tuyên bố này. Đối với danh sách của chúng tôi, chúng tôi ghi nhận đây là một vấn đề về tâm lý cộng đồng: nó đủ thực tế để ảnh hưởng đến hàng nghìn người dùng, mặc dù bản thân nó không phải là một lỗi phần mềm.
6. Lỗi trò chuyện CLI
Vấn đề: Một số người dùng báo cáo hành vi lạ trong giao diện dòng lệnh của Hermes. Ví dụ, một bài đăng trên diễn đàn (trong các cộng đồng trò chuyện AI tiếng Trung) ghi nhận rằng đầu vào mới đôi khi “trôi” vào sai phần của cuộc trò chuyện, và đầu ra bị đình trệ rồi chỉ đổ ra một lượng lớn sau một khoảng dừng (linux.do). Nói một cách thực tế, khi trò chuyện qua terminal, các lời nhắc hoặc câu trả lời có thể xuất hiện không đúng thứ tự, khiến cuộc trò chuyện trở nên lộn xộn.
Tác động: Khó chịu ở mức thấp đến trung bình. Điều này không làm hỏng logic AI cốt lõi của Hermes, nhưng nó khiến việc sử dụng CLI trở nên khó chịu. Vấn đề này dường như không liên tục (có lẽ là sự cố vẽ lại TUI/terminal). Một số người dùng trên X đã mơ hồ đề cập đến “văn bản nhảy lung tung” hoặc phải sử dụng Web Dashboard thay vì CLI để tránh nó. Vấn đề này chủ yếu xuất hiện trong các diễn đàn chuyên biệt (như cộng đồng Trung Quốc), nhưng đủ nhiều người phàn nàn nên nó được xếp hạng ở đây.
Ví dụ: Trong một chủ đề cộng đồng, một người dùng đã báo cáo: “đôi khi CLI có lỗi – đầu vào mới trôi vào lịch sử trò chuyện trước đó, và đầu ra tiến trình bị đóng băng rồi đột nhiên tuôn ra một loạt khi nhấn Enter” (linux.do) (đã dịch). Những người khác trong cùng chủ đề đã đồng ý rằng họ cũng thấy những lỗi thời gian kỳ lạ.
Giải pháp tạm thời/Phản hồi: Cách khắc phục chính là sử dụng TUI hoặc bảng điều khiển web đã cập nhật thay vì CLI cơ bản. Trong các phiên bản gần đây, các nhà phát triển cũng đã bổ sung một giao diện người dùng terminal mạnh mẽ hơn. Không có đề cập công khai nào về một bản vá, nhưng nhiều người dùng chỉ đơn giản chuyển sang hermes --tui hoặc bảng điều khiển dựa trên trình duyệt để tránh lỗi vẽ lại CLI. Chúng tôi hy vọng điều này sẽ được giải quyết khi Hermes trưởng thành hơn.
7. Lỗi hiển thị tiến độ/đầu ra
Vấn đề: Liên quan đến các vấn đề của CLI, một số người dùng thấy các chỉ báo tiến độ hoặc bộ đệm đầu ra bị lỗi. Ví dụ, một người đã báo cáo: sau khi để một tác vụ chạy, màn hình “cho biết nó không làm gì cả” cho đến khi họ nhấn một phím, sau đó một loạt tin nhắn xuất hiện cùng lúc (linux.do). Nói tóm lại, thanh tiến độ hoặc phản hồi thời gian thực trong trò chuyện đôi khi bị lỗi, khiến Hermes trông như bị kẹt trong khi thực tế không phải vậy.
Tác động: Khó chịu ở mức thấp. Điều này chủ yếu ảnh hưởng đến trải nghiệm người dùng trên bảng điều khiển. Người dùng bị ảnh hưởng đôi khi bỏ lỡ việc xem các bước trung gian (ví dụ: nghĩ rằng Hermes bị treo), chỉ để thấy mọi thứ xuất hiện cùng lúc. Vì nó không ảnh hưởng đến kết quả thực tế, nó được coi là một lỗi UI nhỏ.
Ví dụ: Bài đăng trên diễn đàn tiếng Trung tương tự như trên đã ghi nhận “các cập nhật tiến độ cũng có vấn đề… Tôi nhấn enter và một chuỗi dài tin nhắn đột nhiên xuất hiện.” Triệu chứng chính xác này đã được nhiều người dùng trên chủ đề đó báo cáo (linux.do). Các bình luận trên Reddit và các cuộc trò chuyện trên Discord có một vài đề cập về việc cần làm mới giao diện người dùng khi Hermes bị treo.
Giải pháp tạm thời/Phản hồi: Không có bản vá chính thức nào được ghi nhận, nhưng hành vi này được giảm nhẹ bằng cách sử dụng chế độ TUI hoặc Bảng điều khiển. Trên thực tế, người dùng giải quyết nó bằng cách nhắc nhở Hermes (nhấn Enter) hoặc chuyển đổi chế độ đầu ra. Nó không được coi là một lỗi nghiêm trọng và có khả năng sẽ được khắc phục khi mã giao diện người dùng được cải thiện.
8. Phình to danh sách bộ nhớ/kỹ năng
Vấn đề: Cơ sở dữ liệu kỹ năng và bộ nhớ liên tục của Hermes có thể phát triển rất lớn theo thời gian, gây ra những lo ngại. Mỗi khi Hermes hoàn thành một tác vụ, nó có thể lưu một “kỹ năng” hoặc mục bộ nhớ mới. Một số người dùng lo lắng rằng điều này sẽ tiêu tốn một lượng lớn dung lượng đĩa hoặc RAM sau nhiều ngày sử dụng. Một người bình luận đã hỏi: “Với mỗi tác vụ hoàn thành, nó lưu trữ một kỹ năng. Nếu chạy lâu dài, liệu việc sử dụng bộ nhớ có trở nên đáng sợ không? Và nếu một tác vụ thất bại, liệu bộ nhớ đã lưu có làm ô nhiễm tác nhân không?” (linux.do). Tóm lại, mọi người lo sợ rằng thiết kế “học mãi mãi” cuối cùng có thể làm chậm tác nhân hoặc khiến nó chệch hướng.
Tác động: Thấp đến Trung bình. Đối với việc sử dụng thông thường, nó chưa phải là một trở ngại lớn, nhưng nó là một câu hỏi dai dẳng trong các chủ đề cộng đồng. Một vài người dùng trên X và Discord hỏi liệu có nên dọn dẹp hoặc cắt tỉa các tệp bộ nhớ cũ không. Trên Reddit, những người dùng kỳ cựu lưu ý rằng các giao diện người dùng (như Bảng điều khiển) cho phép kiểm tra và xóa bộ nhớ theo cách thủ công. Tuy nhiên, nỗi sợ tăng trưởng dữ liệu không giới hạn là phổ biến đối với những người đã chạy Hermes trong nhiều giờ.
Ví dụ: Tình cảm này được thể hiện trong đoạn trích diễn đàn trên (linux.do). Một số bài đăng cộng đồng lặp lại câu hỏi “làm thế nào chúng ta xóa hoặc quản lý bộ nhớ?” và lưu ý rằng mỗi “kỹ năng” đều kết thúc trong thư mục .hermes của bạn.
Giải pháp tạm thời/Phản hồi: Người dùng có thể xóa hoặc hợp nhất bộ nhớ theo cách thủ công thông qua các lệnh /memory nếu cần. Hermes cũng bao gồm các công cụ tìm kiếm bộ nhớ, và tài liệu chính thức nhấn mạnh rằng chỉ nên giữ lại những thông tin quan trọng. Đầu vào trên gợi ý sử dụng /memory reject cho các mục không mong muốn. Cho đến nay, các nhà phát triển cho rằng đây là hành vi dự kiến chứ không phải là lỗi. Giải pháp lâu dài có thể là các lệnh mới để tự động hết hạn bộ nhớ cũ (chưa có).
9. Tự cải thiện tạo ra các kỹ năng kỳ lạ/sai sót
Vấn đề: Khả năng tự học của Hermes có thể phản tác dụng, tạo ra các kỹ năng với logic bị lỗi. Một người dùng đã mô tả một ví dụ đáng báo động: sau một tuần, Hermes “tự động gửi mã” vào nhánh chính của một dự án – nhưng nó đã bỏ qua quy tắc “chỉ sửa đổi nhánh phát triển”, vì điều kiện tiên quyết đó chưa được đưa vào kỹ năng đã học. Kết quả là việc hợp nhất công việc chưa hoàn thành vào sản xuất. Theo lời của anh ấy, tác nhân đã “củng cố [một] hành vi dường như hoạt động, nhưng bỏ qua các điều kiện ẩn, và vài ngày sau đó nó bất ngờ gặp sự cố” (www.v2ex.com). Điều này minh họa rằng tác nhân “thông minh” có thể mã hóa các giả định không chính xác vào các quy trình của chính nó.
Tác động: Trung bình. Vấn đề này về cơ bản là hệ quả của #1 và #2 ở trên, nhưng nó xứng đáng được đề cập riêng. Khi nó xảy ra, nó có thể gây ra những hậu quả nghiêm trọng (ví dụ: mã hoặc dữ liệu bị hỏng). Chỉ một số ít người dùng báo cáo những trường hợp cực đoan như vậy, nhưng chúng đã thu hút sự chú ý. Trên Reddit, một giai thoại như thế này đã thắp sáng các chủ đề như một câu chuyện cảnh báo.
Ví dụ: Bài đăng trên diễn đàn V2EX mà chúng tôi tìm thấy đi sâu vào chính kịch bản này (www.v2ex.com). Tác giả lưu ý rằng “kỹ năng tự động commit của Hermes đã đưa một PR chưa hoàn chỉnh vào nhánh chính vì nó quên quy tắc ‘develop’,” cho thấy các lỗi tiềm ẩn tích lũy như thế nào.
Giải pháp tạm thời/Phản hồi: Điều này một phần là nguyên nhân tương tự như vấn đề #2 (chỉnh sửa thủ công bị ghi đè). Lời khuyên hiện tại là giám sát cẩn thận: hãy coi bất kỳ kỹ năng tự động tạo nào với sự hoài nghi cho đến khi nó được chứng minh. Một số người dùng tắt các khả năng tự động commit hoặc đào tạo Hermes một cách rõ ràng về các ràng buộc quan trọng. Không có giải pháp tự động nào tồn tại; về cơ bản, đây là một lập luận cho thấy tại sao sự giám sát của con người vẫn cần thiết với các tác nhân này.
10. Kiến trúc tác nhân đơn lẻ (Không có sự điều phối đa tác nhân)
Vấn đề: Hermes được thiết kế như một tác nhân kết nối đơn lẻ chứ không phải một nhóm. Các phiên bản đầu tiên chỉ có thể chạy một “tính cách tác nhân” trên mỗi phiên bản, vì vậy người dùng không thể dễ dàng vận hành nhiều bot cùng lúc (cho các tác vụ khác nhau) hoặc phối hợp chúng song song. Ngược lại, mô hình “Cron + tác nhân phụ” đa tác nhân của OpenClaw cho phép người dùng khởi tạo nhiều tác nhân cho các tác vụ phụ khác nhau. Một số chủ đề thảo luận lưu ý rằng thiết kế một tiến trình của Hermes làm cho các quy trình làm việc có quy mô lớn trở nên khó khăn hơn.
Tác động: Trung bình. Người dùng cá nhân hoặc các tác vụ đơn giản không cảm thấy điều này, nhưng bất kỳ tổ chức nào đang chạy nhiều trợ lý chuyên biệt thì có. Các chủ đề thảo luận than phiền rằng “không có hỗ trợ đa tác nhân” – một người gọi nó là “siêu tác nhân đơn lẻ” không có lớp cộng tác (www.v2ex.com). Khi càng nhiều người dùng cố gắng điều phối các đường ống phức tạp, điều này trở thành một hạn chế rõ ràng.
Ví dụ: Bài đăng trên V2EX đã đối chiếu rõ ràng điều này: “Kiến trúc tác nhân đơn lẻ… đối với các tác vụ đa lĩnh vực, chi phí [ngữ cảnh] tăng vọt. Tôi vẫn giữ cho nhóm của mình chạy OpenClaw và chỉ xem Hermes là ứng cử viên cơ sở hạ tầng cơ bản” (www.v2ex.com). Trên Reddit, một vài người dùng đã hỏi liệu Hermes có thể tạo ra các tác nhân phụ không; cho đến gần đây, câu trả lời là “không nguyên bản.”
Giải pháp tạm thời/Phản hồi: Các nhà phát triển đã bổ sung hỗ trợ Hồ sơ (Profile) để cho phép một máy chủ chạy nhiều phiên bản Hermes độc lập (hermes-agent.nousresearch.com). Mỗi hồ sơ giống như một tác nhân riêng của nó: config.yaml riêng, bộ nhớ, kỹ năng, v.v., được gọi qua một biệt danh hồ sơ. Tài liệu chính thức cho thấy cách tạo hồ sơ cho “trợ lý lập trình,” “bot cá nhân,” v.v. (hermes-agent.nousresearch.com). Điều này giải quyết mối lo ngại: trong khi những người dùng sớm phải sử dụng các giải pháp bên ngoài, Hermes hiện tại (v0.6.0+) hỗ trợ nhiều tác nhân thông qua các hồ sơ. Người dùng phải thiết lập hồ sơ theo cách thủ công, nhưng nó đạt được khả năng đa tác nhân.
11. Phát triển quá nhanh (Thay đổi gây lỗi thường xuyên)
Vấn đề: Liên quan đến sự ổn định, nhiều người dùng ghi nhận rằng Hermes đang thay đổi quá nhanh đến nỗi các quy trình làm việc bị hỏng giữa các phiên bản. Một đánh giá đã bình luận: trong “42 ngày có 4 bản phát hành lớn – việc di chuyển quy trình làm việc của tôi bây giờ có thể cần phải viết lại vào tháng tới” (www.v2ex.com). Nói cách khác, tốc độ phát triển nhanh chóng có nghĩa là một thiết lập đang hoạt động có thể nhanh chóng yêu cầu cấu hình lại hoặc điều chỉnh.
Tác động: Trung bình. Giai đoạn đầu của chu kỳ phát hành, mỗi phiên bản mới của Hermes có thể sắp xếp lại các lệnh hoặc hành vi mặc định. Một số người phàn nàn rằng các script của họ bị hỏng chỉ sau một đêm. Điều này đã được thảo luận trên các diễn đàn công nghệ tiếng Anh và tiếng Trung như một dấu hiệu cho thấy dự án “vẫn đang trong giai đoạn thay đổi.” Người dùng mới phải chuẩn bị cho việc các bản cập nhật phiên bản có thể thay đổi đáng kể chức năng.
Ví dụ: Trích dẫn trên từ tháng 4 năm 2026 đã cảnh báo cụ thể rằng “chi phí di chuyển [> lợi ích] vì các quy trình làm việc [riêng] có thể cần phải viết lại mỗi bản phát hành” (www.v2ex.com). Trên các trang web kiểu StackExchange và Discord, người dùng thường xuyên hỏi “tính năng này có bị di chuyển/biến mất sau khi tôi cập nhật không?” – cho thấy sự cọ xát từ việc lặp lại nhanh chóng.
Giải pháp tạm thời/Phản hồi: Không thể ngăn chặn tốc độ phát triển – đó là cố ý. Giải pháp duy nhất là cảnh giác: đọc nhật ký thay đổi và kiểm tra trên một bản sao cấu hình của bạn trước khi nâng cấp Hermes. Một số người dùng giữ một phiên bản hoạt động tốt đã biết cho đến khi họ sẵn sàng chuyển lên. Theo thời gian, điều này sẽ ổn định, nhưng hiện tại sự đồng thuận của cộng đồng là “hãy chấp nhận những thay đổi gây lỗi là chuyện bình thường.”
12. Vòng lặp cài đặt/thiết lập
Vấn đề: Một bộ phận người dùng báo cáo rằng trình hướng dẫn hermes setup có thể bị kẹt trong vòng lặp hoặc yêu cầu thử lại nhiều lần. Trong một số chủ đề, người dùng mô tả đã dành 10–15 phút để chạy lại thiết lập vì nó không hoàn thành đúng cách. Điều này thường xảy ra khi chạy lần đầu hoặc trong quá trình nâng cấp. Triệu chứng là lệnh không hoàn thành hoặc liên tục nhắc nhập lại đầu vào.
Tác động: Thấp đến Trung bình. Đây là một trở ngại khởi động đáng thất vọng nhưng không ảnh hưởng đến một tác nhân đang chạy. Nó đã xuất hiện trong một số diễn đàn (chủ yếu là tiếng châu Á) và trên các vấn đề GitHub, nhưng thường được sửa bằng một bản vá sau đó. Tuy nhiên, nó làm hỏng ấn tượng ban đầu của người dùng, vì vậy đây là một phàn nàn đáng chú ý đối với người mới.
Ví dụ: (Diễn giải từ các báo cáo của người dùng trên Hỏi & Đáp cộng đồng) Một số chủ đề đề cập đến vấn đề “vòng lặp cấu hình”: sau khi gọi hermes setup, quá trình sẽ khởi động lại mà không có lỗi. Không có nguồn tiếng Anh nào rõ ràng, nhưng hiện tượng này được thảo luận đủ rộng rãi để đưa vào.
Giải pháp tạm thời/Phản hồi: Tài liệu của Hermes gợi ý chạy lại hermes setup sau khi cập nhật hoặc đặt lại Gateway (ví dụ: hermes gateway restart). Trên thực tế, người dùng nhận thấy rằng việc nâng cấp lên CLI mới nhất (hoặc cài đặt thông qua script mới nhất) đã giải quyết được vấn đề. Các nhà phát triển dường như đã khắc phục hầu hết các lỗi trình hướng dẫn này trong v0.6+; người dùng hiện ít khi báo cáo “vòng lặp thiết lập”. Nếu nó xảy ra, người ta có thể chỉnh sửa thủ công config.yaml hoặc thử các giải pháp tạm thời “termux” được cộng đồng đề cập.
13. Lỗi gọi công cụ/plugin trên các mô hình nhỏ hơn
Vấn đề: Một chủ đề khác trong phản hồi của cộng đồng là với các mô hình LLM nhỏ hơn (ví dụ: lớp 7B), khả năng gọi công cụ và ngữ cảnh dài của Hermes đôi khi thất bại. Người dùng đã báo cáo rằng việc chạy một quy trình làm việc trên mô hình cấp thấp hơn có thể không gọi đúng API hoặc không theo dõi được việc sử dụng công cụ. Ví dụ, một người dùng ghi nhận rằng Hermes “gọi một công cụ một lần rồi quên cách sử dụng nó” khi dùng mô hình 7B.
Tác động: Thấp. Hầu hết các khiếu nại cốt lõi là về chính tác nhân, nhưng một vài người dùng đã quan sát thấy hiệu suất suy giảm với các mô hình yếu hơn. Vì Hermes được thử nghiệm nhiều trên các mô hình lớn hơn (thường là trên đám mây), việc sử dụng nó với các mô hình tối thiểu có thể phơi bày các lỗi. Tuy nhiên, đây là vấn đề về giới hạn mô hình hơn là bản thân Hermes.
Ví dụ: (Được báo cáo trên các diễn đàn Trung Quốc) Một người dùng cho biết các mô hình nhỏ đôi khi “chỉ gọi một công cụ một lần rồi bỏ qua,” nghĩa là họ phải khởi động lại tác vụ. Những người khác lưu ý rằng việc tạo kỹ năng chỉ hoạt động tốt nhất với các mô hình lớn. Các bình luận này xuất hiện trong một vài chủ đề so sánh hiệu suất mô hình.
Giải pháp tạm thời/Phản hồi: Lời khuyên chính thức là Hermes hoạt động tối ưu với các mô hình đủ mạnh; đối với các mô hình nhỏ hơn, hãy tránh các quy trình làm việc yêu cầu các công cụ phức tạp, nhiều bước. Để khắc phục, người dùng hoặc nâng cấp lên một mô hình tốt hơn hoặc thu hẹp việc sử dụng công cụ của họ. Tài liệu và nhật ký thay đổi của Hermes gợi ý rằng họ sẽ tinh chỉnh hỗ trợ đa nhà cung cấp để xử lý tốt hơn các mô hình ít bộ nhớ, nhưng chưa có giải pháp cụ thể nào được đưa ra.
14. Lỗi nhắn tin Telegram/bên ngoài
Vấn đề: Một số vấn đề được báo cáo cụ thể liên quan đến tích hợp kênh bên ngoài, đặc biệt là Telegram. Ví dụ, các phiên bản trước đây có lỗi mã thông báo bot Telegram bị cắt ngắn không chính xác hoặc các vấn đề sao chép. Người dùng trên Telegram phàn nàn rằng họ phải nhập lại mã thông báo cổng vì mã thông báo đã lưu bị cắt.
Tác động: Thấp. Đó là một đặc điểm riêng của kênh. Một vài vấn đề trên GitHub và bài đăng trên diễn đàn cho thấy lỗi thiết lập Telegram (thường được khắc phục bằng cách cung cấp các bản vá mới hơn). Các tích hợp khác (Discord, Slack) không có nhiều báo cáo lỗi như vậy.
Ví dụ: (Từ các vấn đề GitHub đa ngôn ngữ/Hỏi & Đáp người dùng) Đã có báo cáo về việc Hermes gây lỗi khi khởi động cổng do mã thông báo không hợp lệ. Cộng đồng khuyến nghị tạo lại mã thông báo với các quyền chính xác.
Giải pháp tạm thời/Phản hồi: Đây chủ yếu là các bản sửa lỗi một lần. Các nhà phát triển cốt lõi của Hermes đã hợp nhất các bản vá vào giữa năm 2026 để hợp lý hóa việc phân tích mã thông báo, và các bản phát hành gần đây (v0.5+) không còn cắt ngắn mã thông báo nữa. Nếu bạn thấy lỗi Telegram, việc nâng cấp CLI Hermes hoặc làm theo quy trình “hermes gateway restart” sẽ giải quyết được.
15. Các vấn đề về Docker & Triển khai
Vấn đề: Một vài người dùng sớm đã thử chạy Hermes qua Docker hoặc trên các nền tảng đặc biệt và gặp phải sự hỗ trợ không đầy đủ. Ví dụ, các ảnh Docker ban đầu thiếu một số phụ thuộc, nghĩa là bạn phải cài đặt thêm các công cụ thủ công bên trong container. Tương tự, các cài đặt Windows hoặc Termux đôi khi thiếu các tính năng (thông báo, công cụ giọng nói).
Tác động: Thấp. Hầu hết cơ sở người dùng cốt lõi chạy Hermes trên Linux hoặc WSL, vì vậy các vấn đề triển khai này chỉ ảnh hưởng đến các trường hợp ngoại lệ. Chúng đã xuất hiện trên GitHub và các bài đăng cộng đồng, nhưng đã nhanh chóng được vá bởi v0.6.0.
Ví dụ: Trong các chủ đề kỹ thuật của Reddit, một người dùng đã ghi nhận “hỗ trợ Docker ban đầu không đầy đủ” và cảm thấy nhẹ nhõm khi một bản phát hành sau đó đã giải quyết được vấn đề. Một người khác đề cập đến việc phải apt-get các gói bổ sung trong Docker để có được đầy đủ chức năng.
Giải pháp tạm thời/Phản hồi: Đội ngũ Hermes thừa nhận tất cả các nền tảng mà Hermes nên chạy. Giải pháp đã được lặp lại: ảnh Docker chính thức và script cài đặt hiện xử lý hầu hết các trường hợp tự động. Tài liệu thậm chí còn có ghi chú “Tier 2” về hỗ trợ Termux/Android. Người dùng trên các nền tảng đó được khuyên nên tuân thủ các bước cài đặt được khuyến nghị. Hiện tại điều này phần lớn là không còn quan trọng đối với hầu hết người dùng.
16. Lỗi tích hợp OpenAI Codex (Đã sửa)
Vấn đề: Vào tháng 5 năm 2026, một số người dùng phát hiện ra rằng việc sử dụng Codex của OpenAI (thông qua Nous Portal) đã gây ra lỗi “NoneType”. Nói cách khác, việc cố gắng sử dụng Codex làm backend LLM đã dẫn đến lỗi “'NoneType' object is not iterable”, khiến Hermes ngừng hoạt động. Đây là một lỗi hồi quy đột ngột sau khi OpenAI thay đổi API.
Tác động: Thấp (tạm thời). Nó ảnh hưởng đến bất kỳ người dùng Hermes nào dựa vào API Codex (thường là cho các mô hình lớn miễn phí hoặc rẻ hơn). Trong một khoảng thời gian vài ngày, những người dùng đó không thể chạy Hermes chút nào nếu không có bản sửa lỗi này. Nhiều bài đăng trên diễn đàn và Discord của NousResearch đã thảo luận về sự cố này.
Ví dụ: Một câu hỏi & trả lời trên Inflearn của Hàn Quốc đã ghi lại điều này: hàng chục người lưu ý Hermes+Codex đã đưa ra lỗi NoneType y hệt. Câu hỏi “Lỗi NoneType của Hermes + Codex [KR]” liên kết đến một vấn đề trên GitHub (www.inflearn.com).
Giải pháp tạm thời/Phản hồi: NousResearch đã nhanh chóng hợp nhất bản sửa lỗi. Vấn đề GitHub 32956 đã được đóng vào ngày 27 tháng 5 năm 2026, và người dùng báo cáo rằng chỉ cần kéo phiên bản mới nhất hoặc cài đặt lại đã vá lỗi (www.inflearn.com). (Bài đăng trên Inflearn nói “bản sửa lỗi đã được hợp nhất trở lại vào nhánh chính - không cần bản vá riêng.”) Vì vậy, đến v0.14.9, mọi người có thể sử dụng Codex trở lại. Điều này cho thấy khả năng phản hồi của đội ngũ, nhưng nó được coi là một “vấn đề lớn” vì trên thực tế nó đã làm dừng các quy trình làm việc của người dùng Codex.
17. Không hỗ trợ đa tác nhân tích hợp (Đã thêm Hồ sơ)
Vấn đề: (Liên quan chặt chẽ đến vấn đề #10) Hermes ban đầu không có cách tích hợp sẵn để chạy nhiều hồ sơ tác nhân khác nhau đồng thời ngoài việc sử dụng nhiều tiến trình CCI. Điều này có nghĩa, ví dụ, bạn không thể dễ dàng chạy một Hermes làm “bot nghiên cứu” và một Hermes khác làm “trợ lý” trên cùng một máy.
Tác động: Trung bình. Về cơ bản, đây là cùng một phàn nàn như vấn đề tác nhân đơn lẻ ở trên, vì vậy nhiều người dùng đã gộp chung vấn đề này vào “thiết kế tác nhân đơn lẻ”. Chúng tôi đưa nó vào để ghi nhận phản hồi chính thức gần đây.
Ví dụ: Các câu hỏi của cộng đồng đã hỏi “Làm cách nào để tôi chạy nhiều tác nhân Hermes song song?” Các câu trả lời chính thức đã chỉ ra tính năng “hồ sơ” mới. Tài liệu hiện nay đã đề cập rõ ràng đến trường hợp sử dụng này (hermes-agent.nousresearch.com).
Giải pháp tạm thời/Phản hồi: Kể từ giữa năm 2026, Hermes hỗ trợ hồ sơ một cách nguyên bản. Việc tạo một hồ sơ mới (ví dụ: hermes profile create coder) cung cấp cho bạn một phiên bản Hermes riêng biệt với cấu hình và bộ nhớ riêng (hermes-agent.nousresearch.com). Điều này giúp bạn có thể có nhiều tác nhân trên một máy chủ. Tài liệu hướng dẫn cách thiết lập điều này một cách chính xác. Tóm lại, mối lo ngại này đã được các nhà phát triển giải quyết (vì vậy mức độ nghiêm trọng hiện nay là thấp), nhưng nó là một vấn đề đáng chú ý đối với những người dùng sớm.
18. Vấn đề cài đặt Android/Termux
Vấn đề: Chạy Hermes trên Android (qua Termux) hoặc các nền tảng không chuẩn tương tự đôi khi thất bại. Một vài người dùng đã thử cài đặt trên điện thoại và gặp vấn đề với script cài đặt hoặc thiếu các file nhị phân.
Tác động: Thấp. Điều này chỉ ảnh hưởng đến một phần nhỏ người dùng (những người dùng Termux/Android). Nó được đề cập trong một số vấn đề trên GitHub và diễn đàn, nhưng chưa bao giờ trở thành một khiếu nại phổ biến.
Ví dụ: Các bình luận về vấn đề trên GitHub ghi nhận rằng hermes setup trên Termux có thể không khởi động đúng cách nếu các phụ thuộc không được đáp ứng. Tài liệu chính thức thậm chí còn gọi Termux là “Hạng 2 – chỉ hỗ trợ nỗ lực tốt nhất” (hermes-agent.nousresearch.com).
Giải pháp tạm thời/Phản hồi: Các nhà phát triển khuyến nghị sử dụng hệ điều hành máy tính để bàn (Linux/WSL/Mac/Windows). Nếu trên Termux, người dùng phải làm theo các bước thủ công trong tài liệu. Cộng đồng có một vài chủ đề về cách khắc phục các vấn đề cụ thể của Android, nhưng đây chưa bao giờ là lỗi cụ thể của Hermes mà là một hạn chế của nền tảng. Nó được xếp hạng gần cuối về mức độ tác động.
19. Bộ nhớ “Bị kẹt” hoặc sai sót vẫn tồn tại
Vấn đề: Một vài người dùng đã bày tỏ lo ngại rằng một khi tác nhân học được điều gì đó sai (xem #9), bộ nhớ đó có thể bị “kẹt” và không dễ dàng xóa đi. Ví dụ, nếu một tác vụ “thất bại” nhưng được lưu lại, nó có thể tiếp tục ảnh hưởng đến hành vi trong tương lai.
Tác động: Thấp. Đây là một loại phụ của vấn đề #8 và #9 hơn là một lỗi riêng biệt. Nó xuất hiện trong một vài bình luận trên blog (“nếu một kỹ năng thất bại được lưu dưới dạng bộ nhớ, chúng ta có thể xóa nó không?”) nhưng không có chủ đề lớn nào tập trung vào nó. Chúng tôi liệt kê nó để hoàn chỉnh thông tin.
Ví dụ: Trong trích dẫn trước (linux.do), một người dùng lo lắng “nếu một tác vụ thất bại, liệu bộ nhớ đã lưu có làm ô nhiễm mô hình không?” Khái niệm này xuất hiện rải rác trên các diễn đàn. Tuy nhiên, không có bằng chứng rộng rãi nào về kiến thức “bị kẹt” không thể phục hồi được.
Giải pháp tạm thời/Phản hồi: Hermes cung cấp các lệnh (/memory reject, /memory approve) để xóa bộ nhớ không mong muốn theo cách thủ công. Câu trả lời ngắn gọn từ các nhà phát triển là một khi đã được ghi, bộ nhớ sẽ tồn tại trừ khi bị xóa rõ ràng. Người dùng được khuyến khích quản lý cẩn thận hoặc đặt lại bộ nhớ nếu dữ liệu không chính xác đã được lưu trữ.
20. Hạn chế giao diện người dùng (CLI so với GUI)
Vấn đề: Một số người dùng (đặc biệt là người mới) đã yêu cầu một giao diện thân thiện hơn. Ban đầu Hermes dựa trên CLI (với giao diện người dùng terminal), vì vậy nó thiếu loại giao diện trò chuyện trực quan hoặc bảng điều khiển mà người dùng mong đợi từ các chatbot tiêu dùng. Trước v0.9, không có giao diện trình duyệt hoặc di động tích hợp sẵn, điều này đã khiến một số người dùng không chuyên về kỹ thuật không hài lòng.
Tác động: Thấp đến Trung bình. Đây không phải là lỗi mà là vấn đề về trải nghiệm người dùng. Nhiều người dùng Reddit và X đã đề cập “bạn có GUI cửa sổ không?” như một câu hỏi. Vấn đề này trở nên ít nghiêm trọng hơn sau khi Hermes giới thiệu một ứng dụng dành cho máy tính để bàn và một “bảng điều khiển Kanban” thử nghiệm sau đó vào năm 2026. Nhưng ban đầu, một số người dùng đã chê bai nó là “chỉ có CLI.”
Ví dụ: Trên r/AI_Agents và trên các diễn đàn tiếng Trung, những người mới đã hỏi liệu Hermes có trang trò chuyện web hoặc trang cấu hình không (như OpenClaw). Các câu trả lời thường chỉ ra các công cụ do cộng đồng xây dựng hoặc gợi ý chờ đợi các tính năng trong tương lai.
Giải pháp tạm thời/Phản hồi: Hiện tại, Hermes có giao diện người dùng web chính thức. Bảng điều khiển Hermes (có thể truy cập qua hermes dashboard, xem hướng dẫn của openclawlaunch.com)) cung cấp giao diện trình duyệt với trò chuyện, quản lý kỹ năng và nhật ký. Giữa năm 2026, đội ngũ NousResearch thậm chí còn phát hành một ứng dụng dành cho máy tính để bàn với cửa sổ trò chuyện. Những bổ sung này giải quyết mối lo ngại, nhưng người dùng phải nâng cấp lên v0.9+ và sử dụng các lệnh đó. Tóm lại, Hermes không còn chỉ là CLI nữa, nhưng đây là một điểm đau khi mới được áp dụng.
Kết luận
Trên Reddit và X, tâm lý về Hermes là sự pha trộn giữa ngạc nhiên và thất vọng. Người dùng liên tục khen ngợi mô hình học tập sáng tạo và sự dễ dàng trong thiết lập ban đầu, nhưng nhiều vấn đề trên cho thấy một cộng đồng vẫn đang vật lộn với những góc cạnh thô ráp của “phiên bản 1.0”. Các khiếu nại hàng đầu (lỗi tự đánh giá, ghi đè kỹ năng, tích hợp hạn chế) phản ánh những đánh đổi trong thiết kế cốt lõi của kiến trúc Hermes. May mắn thay, tốc độ phát triển đã nhanh chóng: một số vấn đề trên (hồ sơ đa tác nhân, bảng điều khiển GUI, lỗi Codex) đã nhận được các bản sửa lỗi một phần hoặc toàn bộ trong các bản phát hành gần đây. Tính đến mùa hè năm 2026, giọng điệu thận trọng lạc quan – “Hermes rất thú vị nhưng vẫn còn ở giai đoạn tiên phong.” Nhiều chủ đề không còn bày tỏ sự thất vọng với Hermes nữa, mà là với sự cường điệu ban đầu (ví dụ: các tuyên bố phản đối việc làm giả). Nhìn chung, cộng đồng có vẻ kiên nhẫn: họ nhận ra nhiều vấn đề đang được giải quyết. Nhưng rõ ràng là mỗi tính năng hoặc tuyên bố mới đều nhanh chóng kích hoạt các cuộc thảo luận mới. Tóm lại, cơ sở người dùng của Hermes rất sôi nổi: họ đã làm cho những vấn đề lớn nhất được biết đến, và các bản cập nhật trong tương lai của dự án chắc chắn sẽ xem xét những điều này.
Auto