Weekendens eksperiment var at kigge på Hermes Agent, en personlig AI agent...

Weekendens eksperiment var at kigge på Hermes Agent, en personlig AI agent platform: https://hermes-agent.nousresearch.com/
Hermes Agent er lavet af Nous Research (https://nousresearch.com/) et mindre AI lab der foruden agent-projektet har gang i model-training og andre ret spændede ting.
Nå, men projektet lykkedes og var markant lettere at få op at køre end OpenClaw (https://openclaw.ai/)
𝗗𝗲𝘁𝗮𝗹𝗷𝗲𝗿𝗻𝗲 for de nok MEGET tekniske typer og folk der er glade for links
- Kører på billig Hetzner (https://www.hetzner.com/) VPS
- Bruger OpenRouter (https://openrouter.ai/) til LLM-provider med Minimax m3 som default LLM men det er nemt at teste andre modeller af.
- Bruger fal.ai (https://fal.ai/) API til billedgenerering.
- Bruger Brave Search API (https://brave.com/search/api/) til websøgning
- Min agent har sin egen Google account og vi kan sende emails til hinanden.
- Vores fælles arbejdsdokumenter er en delt mappe på Google Drive - Hermes bruger google workspace integration og kan forstå docs, sheets og slides.
- Vi hænger også ud i et lukket Slack workspace.
- Sikret igennem et Tailscale (https://tailscale.com/) VPN mesh netværk så den kun kan bruges fra familiens maskiner.
- Det primære interface til agenten er Hermes Desktop, som er en udvidet Chat-UI, installeret som Electron app, der snakker med Hermes backend gateway på VPS'en. Lidt som en Claude Desktop bare uden adgang til lokale ressourcer. Måske mere som OpenWebUI (https://docs.openwebui.com/).
- Sekundære interface er at jeg SSH'er ind i VPS'en, hvor jeg så også kan køre min Claude Code hvis jeg skal bygge ting som jeg plejer at arbejde. Split tmux (https://tmux.app/) panes med Hermes + Claude Code fungerer.
- Arbejdet i agentens filer er gennem en Visual Studio Code (https://code.visualstudio.com/) remote session ind i VPS'en. Fordi jeg ikke helt er blevet venner med neovim (https://neovim.io/) i workspace mode.
𝗣𝗿𝗶𝘀𝗲𝗻 Jeg har brugt en del intelligens på at lave mit setup, så ~20$ på tokens til etablering svarende til en pizza+sodavand combo. Drift er de der ca 8 Euro/md + tokens. Det udestår at jeg må findes en balance i pris og kvalitet(intelligens). Og måske skal agentens LLM-provider defaulte til at bruge min Strix Halo 128gb box, der har Lemonade (https://lemonade-server.ai/) kørende, hvis den er tændt. Her kan jeg serve Gemma-4-26b (https://huggingface.co/google/gemma-4-26B-A4B-it) og Qwen3.6-27b-MTB (https://huggingface.co/froggeric/Qwen3.6-27B-MTP-GGUF) i tålelig performance til ting, der ikke er tidssensitivt.
𝗠å𝗹𝗲𝘁 Lidt research-opgaver og det man vist kalder "Capability-exploration" -- altså at pille ting lidt fra hinanden, for at finde ud af, hvordan de fungerer og hvad de egentlig kan.
Og den her ting kan altså en del 🤯
(Linkedins algoritme siges at straffe mange outgoing links. Buhuu.)
Oprindeligt delt på LinkedIn