Selfhosting

Usuń wszystkie modele routera llama.cpp bez restartowania

Usuń wszystkie modele routera llama.cpp bez restartowania

Darmowa pamięć VRAM bez zabijania llama-server.

Tryb routera w llama.cpp to jedna z najbardziej przydatnych zmian wprowadzonych do llama-server w ciągu ostatnich lat. Wreszcie daje lokalnym operatorom modeli LLM coś w rodzaju zarządzania modelami, do którego są przyzwyczajeni z Ollama, jednocześnie zachowując surową wydajność i kontrolę na niskim poziomie, która sprawia, że warto korzystać z llama.cpp w pierwszej kolejności.

Sterowanie głosem Hermes z telefonu

Sterowanie głosem Hermes z telefonu

Pozwól, by Hermes rozmawiał z Tobą przez telefon

Już teraz rozmawiasz z agentem Hermes przez telefon za pomocą wiadomości tekstowych. Teraz chcesz rozmawiać z nim bezpośrednio i otrzymywać odpowiedzi w formie mowy. Zazwyczaj jest to słuszny krok, zwłaszcza jeśli już korzystasz z Hermesa jako trwałego, lokalnie hostowanego asystenta. Pisanie długich promptów na małym ekranie jest powolne i podatne na błędy.

Tworzenie umiejętności dla Agenta Hermesa — struktura pliku SKILL.md i najlepsze praktyki

Tworzenie umiejętności dla Agenta Hermesa — struktura pliku SKILL.md i najlepsze praktyki

Hermes oferuje szybko ładujące się i niezawodnie działające umiejętności.

Hermes Agent traktuje umiejętności (skills) jako domyślną metodę nauczania powtarzalnych workflow. Oficjalna dokumentacja opisuje je jako dokumenty wiedzy dostarczane na żądanie, zgodne z otwartym formatem agentskills.io, ładowane przez postępującą ekspozycję (progressive disclosure), dzięki czemu model widzi najpierw mały indeks i pobiera pełne instrukcje dopiero wtedy, gdy zadanie ich faktycznie wymaga.

Pamięć systemów AI — trwała wiedza i pamięć agentów

Pamięć systemów AI — trwała wiedza i pamięć agentów

Trwała wiedza wykraczająca poza pojedynczy wątek rozmowy.

Ta sekcja gromadzi przewodniki dotyczące trwałej wiedzy i pamięci dla systemów AI — jak asystenci zachowują fakty, preferencje i skondensowany kontekst między sesjami, bez przeciążania jednego promptu każdą możliwą daną. W tym kontekście pamięć oznacza świadome utrwalanie (fakty o użytkowniku, podsumowania, magazyny danych wspierane przez wtyczki), a nie pamięć RAM GPU ani ciężary modelu.

System pamięci Hermes Agent: Jak realnie działa trwała pamięć AI

System pamięci Hermes Agent: Jak realnie działa trwała pamięć AI

Pamięć to różnica między narzędziem a partnerem.

Znasz ten scenariusz. Otwierasz czat z agentem AI, tłumaczysz mu swój projekt, dzielisz się swoimi preferencjami, wykonujesz część pracy i zamykasz kartę. Wracasz tydzień później i czujesz się, jakbyś rozmawiał z kimś obcym — cały kontekst zniknął, każda preferencja została zapomniana, a projekt trzeba wyjaśnić od nowa.