Hermes Agent – co to jest i jak zacząć? Praktyczny przewodnik po agencie AI
Hermes Agent to otwarty agent AI od studia Nous Research, który z każdym dniem pracy zna cię lepiej. Nie jest to kolejny chatbot do zadawania pytań, tylko program, który sam planuje kroki, uruchamia narzędzia, zapamiętuje ustalenia i wykonuje zadania na twojej maszynie, nawet gdy ty masz zajęte ręce. W tym przewodniku wyjaśniam, czym dokładnie jest Hermes, jak działa jego pętla samouczenia, jak przebiega instalacja i od czego zacząć pierwsze automatyzacje.
Co to jest Hermes Agent?
Hermes Agent to framework agentowy o otwartym kodzie, udostępniony na licencji MIT i rozwijany przez Nous Research, laboratorium znane z serii modeli Hermes. Slogan projektu brzmi „the agent that grows with you", czyli agent, który rośnie razem z tobą. I nie jest to marketingowa pustka: Hermes faktycznie buduje sobie bibliotekę umiejętności i notatki o tobie w trakcie wspólnej pracy.
Najprościej myśleć o nim jak o warstwie sterującej, a nie o modelu językowym. Sam Hermes nie generuje tekstu - rozumowanie zleca podłączonemu modelowi, a jego rolą jest orkiestracja: co uruchomić, w jakiej kolejności, jakie dane przygotować i co zapamiętać na później. Model podłączysz praktycznie dowolny: przez OpenRouter, OpenAI, Anthropic, Nous Portal albo lokalnie przez Ollama czy llama.cpp. Zmiana dostawcy to jedno polecenie hermes model.
To odróżnia go od klasycznych chatbotów. Zwykły asystent AI odpowiada w oknie rozmowy i kończy na tym. Hermes ma dostęp do terminala, systemu plików i ponad sześćdziesięciu narzędzi, więc może realnie coś wykonać: napisać i uruchomić skrypt, zescrapować stronę, przygotować raport, obsłużyć pocztę czy zaplanować cykliczne zadanie. Działa tam, gdzie go postawisz - na własnym laptopie, na serwerze VPS za kilka dolarów miesięcznie albo w środowisku serverless, które w czasie bezczynności praktycznie nic nie kosztuje.
Hermes wpisuje się w szerszy trend samodzielnych programów AI, o którym regularnie piszemy w naszej kategorii poświęconej agentom i automatyzacjom AI.
Jak działa pętla samouczenia Hermesa
Główny wyróżnik projektu to zamknięta pętla uczenia. Składa się na nią kilka mechanizmów, które współgrają ze sobą na bieżąco.
Pierwszy to umiejętności tworzone z doświadczenia. Gdy Hermes wykona trudniejsze zadanie, sam zapisuje z niego procedurę w pliku SKILL.md: nazwę, opis i instrukcję krok po kroku. Przy następnym podobnym zadaniu nie odkrywa koła od nowa, tylko sięga po gotowy przepis, a z czasem dopracowuje go o wnioski z nowych realizacji. Umiejętności korzystają z otwartego standardu agentskills.io, więc można je wymieniać z innymi użytkownikami.
Drugi mechanizm to pamięć trwała. Agent prowadzi dwa pliki: MEMORY.md z notatkami o środowisku i projektach oraz USER.md z profilem użytkownika, czyli twoimi preferencjami i sposobem pracy. Oba mają twarde limity długości, żeby nie rozdymały kontekstu każdej rozmowy. Okresowo Hermes sam dostaje impuls, by przejrzeć ostatnią rozmowę i zapisać to, co warto zachować na stałe.
Trzeci element to wyszukiwanie po wcześniejszych sesjach. Wszystkie rozmowy trafiają do lokalnej bazy SQLite z indeksem pełnotekstowym. Możesz zapytać „o czym rozmawialiśmy w zeszłym tygodniu", a agent znajdzie właściwy fragment w ułamku sekundy. Pamięć stała trzyma fakty do zawsze pod ręką, a wyszukiwanie sesji służy do sięgania po szczegóły sprzed tygodni.
Czwarty, najbardziej dyskretny, to modelowanie użytkownika przez wtyczkę Honcho. Z każdą rozmową Hermes buduje coraz dokładniejszy obraz tego, jak pracujesz i czego oczekujesz. Stąd wrażenie, że po kilku tygodniach agent mniej się powtarza i lepiej trafia w twoje intencje bez tłumaczenia od zera.
Jak zainstalować Hermes Agent krok po kroku
Instalacja jest prosta, bo jednoplikowy instalator sam dociąga wszystko, czego potrzebuje: Pythona 3.11, menedżera uv, Node.js, ripgrep i ffmpeg. Jedynym wymaganiem wstępnym jest obecność gita. Na Linuksie, macOS, WSL2 oraz Androidzie z Termuksem uruchom w terminalu:
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Na Windowsie Hermes działa natywnie i instaluje się przez PowerShell:
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
Dostępna jest także aplikacja Hermes Desktop dla osób, którym bliżej do okna programu niż do terminala. Drobne zastrzeżenie dotyczy komputerów Mac - wsparcie obejmuje układy Apple Silicon, starsze maszyny z procesorami Intela nie są obsługiwane.
Po zakończeniu instalacji przeładuj powłokę i wpisz hermes, aby rozpocząć pierwszą rozmowę. Konfigurację najszybciej przeprowadzisz kreatorem hermes setup, który poprowadzi cię przez wybór modelu i narzędzi. Jeśli nie chcesz zbierać osobno kluczy do wyszukiwarki, generatora obrazów czy syntezy mowy, użyj wariantu hermes setup --portal: jedno logowanie przez Nous Portal załatwia model oraz zestaw narzędzi, w tym wyszukiwanie internetowe i przeglądarkę w chmurze. Wszystkie ustawienia lądują w pliku ~/.hermes/config.yaml i zmiany działają od razu, bez restartu.
Gdyby coś nie zagrało, diagnostyką zajmie się hermes doctor, który wskaże brakujące elementy i podpowie, jak je naprawić. Stan konfiguracji sprawdzisz poleceniem hermes status.
Najważniejsze komendy na start
| Komenda | Do czego służy |
|---|---|
hermes | Start interaktywnej rozmowy w terminalu |
hermes setup | Kreator konfiguracji modelu i narzędzi |
hermes model | Zmiana dostawcy i konkretnego modelu |
hermes tools | Włączanie i wyłączanie zestawów narzędzi |
hermes gateway | Uruchomienie bramy do komunikatorów |
hermes doctor | Diagnostyka problemów z instalacją i konfiguracją |
hermes update | Aktualizacja do najnowszej wersji |
/new | Rozpoczęcie świeżej rozmowy (slash-komenda) |
/usage | Podgląd zużycia tokenów i kosztów |
W trakcie rozmowy działają też między innymi /model do zmiany modelu w locie, /skills do przeglądania umiejętności czy /compress do skrócenia kontekstu przy długich sesjach. Większość slash-komend działa tak samo w terminalu i na komunikatorach, więc nie uczysz się dwóch osobnych interfejsów.
Co potrafi Hermes Agent w praktyce
Największa zmiana w stosunku do typowej pracy z chatbotem polega na tym, że Hermes nie czeka w okienku, aż coś mu napiszesz. Serce automatyzacji to wbudowany harmonogram w stylu crona, w którym zadania opisuje się zwykłym językiem. Prosisz o dzienne podsumowanie wiadomości o 8:00, nocną kopię zapasową katalogu z projektami albo cotygodniowy przegląd cen i wskazujesz, gdzie ma trafić wynik. Resztą agent zajmuje się sam.
Drugim filarem jest obecność na komunikatorach. Polecenie hermes gateway uruchamia jeden proces obsługujący ponad dwadzieścia platform, między innymi Telegram, Discorda, Slacka, WhatsApp, Signal, Microsoft Teams i pocztę e-mail. Zlecasz zadanie z telefonu, Hermes wykonuje je na serwerze, a wynik wraca na ten sam czat. Rozmowa zachowuje ciągłość między kanałami, więc wątek zaczęty w terminalu dokończysz na komunikatorze, a wiadomości głosowe są transkrybowane.

Przy większych zadaniach Hermes deleguje pracę: uruchamia odizolowanych podagentów pracujących równolegle nad osobnymi wątkami, a na końcu scala ich wyniki. Rozszerzalność zapewnia obsługa protokołu MCP, czyli możliwość podłączenia zewnętrznych serwerów narzędziowych bez pisania własnych integracji. Do tego dochodzi Bot Mode, w którym budujesz zespół wyspecjalizowanych botów współpracujących w grupowych czatach.
Na pierwszy dzień z agentem sprawdzą się proste, ale realne zadania:
- codzienne poranne podsumowanie wybranego tematu z dostawą na Telegram,
- przypomnienia o terminach i cykliczne przeglądy skrzynki mailowej,
- monitoring ceny lub dostępności produktu z powiadomieniem,
- porządki w katalogu z plikami: sortowanie, zmiana nazw, archiwizacja,
- krótki raport z pracy nad projektem na koniec tygodnia.
Jeśli interesują cię lokalne modele, którymi można zasilić Hermesa bez wysyłania danych do chmury, zajrzyj do naszego poradnika, jak uruchomić Ollama na własnym komputerze.
Ile kosztuje korzystanie z Hermesa
Sam Hermes jest darmowy i pozostaje taki na zawsze dzięki licencji MIT. Realny rachunek składają się na dwa elementy. Pierwszym jest model językowy: płacisz dostawcy za zużyte tokeny, podłączając własny klucz do OpenRouter, OpenAI, Anthropic albo innego endpointu. Alternatywą jest subskrypcja Nous Portal, która obejmuje ponad trzysta modeli i pakiet narzędzi, takich jak wyszukiwanie internetowe czy generowanie obrazów, w ramach jednego rozliczenia. Drugim elementem jest infrastruktura: praca na własnym komputerze nic nie kosztuje, popularnym wyborem jest serwer VPS za około pięć dolarów miesięcznie, a backendy serverless Daytona i Modal hibernują środowisko w czasie bezczynności, więc rachunek praktycznie zanika, gdy nikt z agenta nie korzysta.
Bezpieczeństwo - na co uważać na początku
Agent z dostępem do terminala i plików to narzędzie o poważnych uprawnieniach, dlatego Hermes stosuje kilka warstw ochrony. Domyślny tryb zatwierdzania pyta o zgodę przy operacjach uznanych za ryzykowne, a tryb manual wymusza potwierdzenie każdego polecenia. Poniżej tych ustawień działa twarda lista blokad operacji nieodwracalnych, której nie da się wyłączyć żadną opcją konfiguracji. Na komunikatorach dostęp chronią listy dozwolonych użytkowników, więc przypadkowa osoba nie wyda agentowi rozkazów, a pracę wrażliwą można izolować w kontenerze Dockera.
Jedno ostrzeżenie jest tu szczególnie istotne. Istnieje tryb /yolo, który wyłącza pytania o zgodę na czas sesji. Bywa wygodny przy długich zadaniach, ale łatwo o nim zapomnieć, mimo czerwonego banera ostrzegawczego. Na start zostaw domyślne zatwierdzanie i obserwuj, jak agent podejmuje decyzje - zrozumiesz wtedy jego nawyki, zanim oddasz mu więcej swobody.
Hermes Agent pokazuje, dokąd zmierza branża agentów AI: w stronę programów, które działają cały czas na twojej infrastrukturze, pamiętają kontekst współpracy i same doskonalą swoje procedury. Jeśli lubisz grzebać w terminalu, chcesz zautomatyzować powtarzalne czynności i nie boisz się jednorazowej konfiguracji, to obecnie jeden z ciekawszych projektów open source do przetestowania. Wystarczy jedna linijka instalacji i kwadrans na kreatorze setupu, żeby ocenić to na własnej skórze. Jeśli natomiast szukasz rozwiązania w pełni klikalnego, bez kontaktu z konsolą, zacznij od aplikacji Hermes Desktop i dopiero potem sięgaj po pełną wersję.
FAQ
Tak, sam Hermes jest w pełni darmowy i udostępniony na licencji MIT. Płacisz tylko za podłączony model językowy (np. za tokeny u OpenRouter czy OpenAI) oraz opcjonalnie za infrastrukturę, jeśli uruchamiasz agenta na serwerze VPS.
ChatGPT to chatbot odpowiadający w oknie przeglądarki. Hermes to agent, który wykonuje zadania na twojej maszynie: ma dostęp do terminala i plików, uruchamia narzędzia, prowadzi harmonogram zadań cyklicznych, pamięta ustalenia między sesjami i rozmawia z tobą przez komunikatory takie jak Telegram.
Nie. Hermes sam nie uruchamia modelu, tylko korzysta z API dostawcy, więc wymagania sprzętowe są niskie. Wystarczy zwykły komputer albo serwer VPS za kilka dolarów miesięcznie. Jeśli chcesz działać w pełni lokalnie, możesz podłączyć modele przez Ollama, ale wtedy przydaje się mocniejszy sprzęt z GPU.
Instalator obsługuje Linuksa, macOS na układach Apple Silicon, Windowsa natywnie, a także WSL2 i Androida z aplikacją Termux. Dostępna jest dodatkowo aplikacja Hermes Desktop dla osób preferujących okno programu zamiast terminala.