Hermes Agent: Self Hosted KI Agent von Nous Research
Hermes Agent von Nous Research: selbstlernender Open Source KI Agent mit Memory, Skills System und MCP. Installation, Vergleich und DSGVO Bewertung.
Mehr erfahren
Pi ist ein minimaler Agent Harness für das Terminal. Der Agent bringt vier Werkzeuge mit, dazu einen sehr kurzen System Prompt. Alles andere baust du selbst als Extension oder installierst es als Paket.
Entwickelt hat Pi der Österreicher Mario Zechner, in der Szene bekannt als badlogic. Sein Name steht seit Jahren für libGDX, eines der meistgenutzten Java Game Frameworks. Die erste Version von Pi erschien im August 2025. Seit April 2026 liegt das Projekt bei Earendil Inc., mitgegründet von Armin Ronacher, dem Erfinder von Flask. Das Repository wanderte von badlogic/pi-mono zu earendil-works/pi. Der Kern bleibt MIT lizenziert.
Der Satz auf der Startseite von pi.dev bringt die Haltung auf den Punkt: Es gibt viele Agent Harnesses, aber dieser hier gehört dir. Gemeint ist damit kein Marketing, sondern eine Architektur. Pi zwingt dich nicht in einen Workflow. Du formst Pi um deinen Workflow herum.
Bekannt wurde Pi vor allem durch ein anderes Projekt. OpenClaw nutzt Pi über den SDK Modus als Motor. Der virale persönliche Assistent, den halb Twitter im Januar 2026 installiert hat, läuft im Kern auf diesem schlanken Harness. Wer MoltBot und ClawdBot kennt, kennt Pi also längst, ohne es zu wissen.
Terminal Agents sind unser tägliches Werkzeug. Wir arbeiten seit Jahren mit Claude Code und OpenCode an Symfony, Sulu CMS und Astro Projekten. Wir wissen deshalb sehr genau, wo ein Harness Zeit spart und wo er Token verbrennt. Pi ordnen wir editorial ein, weil die minimale Bauweise für kleine lokale Modelle echte Vorteile bringt.
Was wir konkret anbieten: Vibe Coding Consulting für Teams, die einen Terminal Agent sauber ins Projekt holen wollen. Aufbau eines lokalen KI Stacks mit Ollama und Qwen Modellen auf eigenen Servern. Vibe Coding Best Practices für Teams, die KI Code in Produktion bringen. Und lokale KI für Compliance, wenn DSGVO und Berufsgeheimnis den Einsatz von Cloud Providern verbieten.
Ob Pi zu deinem Team passt oder ob ein Agent mit mehr Vorgaben die bessere Wahl ist, klären wir im Beratungsprojekt. Wir lernen uns kennen, schätzen den Aufwand und rechnen minutengenau ab.
Finde das passende Angebot für dein Projekt
Hey! Ich bin CodeBot. Lass uns herausfinden, wie wir dein Projekt zum Fliegen bringen.
Was soll entstehen?
Die meistdiskutierte Stelle auf pi.dev ist eine Liste von Dingen, die fehlen. Andere Tools werben mit Features. Pi wirbt mit Verzicht. Für jeden weggelassenen Punkt steht daneben, wie du dasselbe Ergebnis mit den Grundwerkzeugen erreichst.
Diese Liste ist der eigentliche Kern von Pi. Ein Harness mit vielen Features schreibt seine Annahmen in jeden Prompt. Ein Harness ohne Features lässt dem Modell und dir den Platz. Wer sauber mit Exact Coding arbeitet und seine Regeln ohnehin in einer AGENTS.md pflegt, verliert durch den Verzicht wenig und gewinnt Kontrolle.
Pi kennt read, write, edit und bash. Mehr nicht. Der System Prompt liegt im Bereich von wenigen hundert Wörtern, während andere Harnesses mehrere tausend Token allein für ihre Grundanweisung verbrauchen.
Das klingt nach Verzicht, ist aber vor allem Rechenkunst. Jedes Token im System Prompt fehlt beim eigentlichen Problem. Bei einem Kontextfenster von 200.000 Token frisst ein aufgeblasener Harness spürbar Platz, bevor die erste Datei gelesen ist. Der Effekt ist besonders bei kleinen lokalen Modellen wichtig. Ein Modell, das an einem überladenen Harness scheitert, kommt mit einem schlanken oft noch durch.
Die These dahinter: Moderne Modelle brauchen kein Gerüst mehr, das ihnen jeden Schritt vorschreibt. Ausführliche Anweisungen waren eine Krücke für schwächere Modelle. Wie sich Agenten in ihrer Schleife tatsächlich verhalten, erklären wir im Detail unter Agent Looping.
Pi braucht eine aktuelle Node Version, git und bash. Die Installation läuft über npm oder das Installationsskript von pi.dev.
npm install -g @earendil-works/pi-coding-agent
# oder direkt:
curl -fsSL https://pi.dev/install.sh | sh
Danach setzt du einen Schlüssel für deinen Provider und startest Pi im Projektordner.
pi config set ANTHROPIC_API_KEY=dein-key
cd mein-projekt
pi
Projektanweisungen liest Pi beim Start aus AGENTS.md Dateien, sowohl im aktuellen Verzeichnis als auch in den übergeordneten Ordnern. Über SYSTEM.md ersetzt oder ergänzt du den Standard Prompt pro Projekt. Wer das Format kennt, findet sich sofort zurecht, denn es folgt derselben Idee wie SKILL.md und die Agent Skills anderer Anbieter.
Pi spricht über fünfzehn Provider an, darunter Anthropic, OpenAI, Google, Azure, Bedrock, Mistral, Groq, Cerebras, xAI, Hugging Face, MiniMax, NVIDIA, OpenRouter und Ollama. Die Anmeldung läuft wahlweise über API Schlüssel oder OAuth.
Der Wechsel passiert mitten in der Arbeit. Ein Tastenkürzel, ein anderes Modell, gleiche Session. Du erkundest eine fremde Codebase mit einem starken Modell, holst dir eine zweite Meinung von einem anderen Anbieter und lässt die stumpfe Fleißarbeit von einem günstigen Modell erledigen.
Für lokale Modelle hinterlegst du einen eigenen Provider in der models.json.
{
"providers": {
"ollama-local": {
"baseUrl": "http://localhost:11434/v1",
"api": "openai-completions",
"apiKey": "ollama"
}
}
}
Genau hier wird Pi für deutsche Teams spannend. Kein Code verlässt den eigenen Server. Welche lokalen Modelle sich dafür eignen, haben wir in unserem Vergleich der besten lokalen Coder Modelle zusammengetragen.
Pi lässt sich in Stufen an dein Team anpassen. Die meisten Entwickler starten auf Stufe eins und bleiben dort eine Weile. Erst wenn ein Handgriff sich zum dritten Mal wiederholt, lohnt der Sprung nach oben. Die Tabelle zeigt, was auf welcher Stufe passiert.
| Level | Werkzeug | Aufwand |
|---|---|---|
| Level 1: Defaults nutzen | Pi ohne Anpassung, AGENTS.md im Projekt | Minuten |
| Level 2: Prompt Templates | Wiederkehrende Prompts als Markdown Dateien | Stunden |
| Level 3: Skills | Fähigkeiten mit eigenen CLI Tools, bei Bedarf geladen | Tage |
| Level 4: Extensions und Packages | TypeScript Module mit Zugriff auf Tools, Befehle und Oberfläche | Projektarbeit |
Extensions sind TypeScript Module. Sie hängen sich an Lebenszyklus Punkte, ergänzen Werkzeuge, legen Tastenkürzel an, greifen in die Nachrichten ein, bevor sie beim Modell landen, und dürfen die komplette Terminal Oberfläche bespielen. Kompiliert wird zur Laufzeit, ein Bauschritt entfällt.
Der eigentliche Trick ist banal und stark zugleich. Fehlt dir eine Funktion, bittest du Pi darum, sie zu schreiben. Der Agent verändert seine eigene Installation, ein Neuladen genügt, und du arbeitest weiter. Genau die Beispiele, die andere Anbieter fest einbauen, liegen bei Pi als Beispiel Extensions im Repository: Sub Agents, Plan Mode, Freigabe Regeln, geschützte Pfade, Ausführung über SSH, Sandbox.
Fertige Bündel aus Extensions, Skills, Prompt Templates und Themes verteilst du als Pi Packages über npm oder git. Wer das Prinzip aus dem Claude Code Plugin Marketplace oder von Claude Code Plugins kennt, findet sich sofort zurecht.
pi install npm:@foo/pi-tools
pi install git:github.com/badlogic/pi-doom
Die meisten Agenten führen ein Protokoll. Pi führt einen Baum. Du springst zu jeder früheren Nachricht zurück und arbeitest von dort in eine neue Richtung weiter. Alle Zweige liegen in einer einzigen Datei.
Das löst ein Problem, das jeder kennt, der lange mit einem Agenten arbeitet. Der Agent biegt falsch ab, du merkst es zehn Schritte später, und der halbe Kontext ist vergiftet. Statt neu zu starten, gehst du an die Gabelung zurück.
Ergebnisse teilst du als HTML Export oder als GitHub Gist mit einer Adresse, die die Sitzung sauber darstellt. Für Code Reviews im Team ist das erstaunlich nützlich. Wer parallel an mehreren Zweigen arbeitet, kombiniert das mit Git Worktrees.
Der Print Modus ist der stille Star. Ein Pi Aufruf in einer Pipeline schreibt Commit Nachrichten, prüft Migrationen oder erzeugt Changelogs. Für Teams, die ohnehin auf saubere Automatisierung setzen, ist das der einfachste Einstieg.
Drei Open Source Projekte, drei völlig verschiedene Antworten auf dieselbe Frage. Alle drei sind MIT lizenziert, alle drei laufen mit lokalen Modellen.
Wer zwischen den beiden Plattformen schwankt, findet die Details in unserem Vergleich Paperclip gegen Hermes Agent. Im Terminal Lager steht Pi neben OpenCode, Crush und Kilo Code. Eine Gesamtübersicht liefert unser Ranking der Top 10 Vibe Coding Tools.
I think pi is the most steerable coding harness out there.
In NCA Projekten arbeiten wir täglich mit Terminal Agents. Claude Code für große Refactorings in Symfony und Sulu CMS, OpenCode für lokale Abläufe mit Ollama. Beide bringen viel mit, und genau das ist der Punkt, an dem Pi interessant wird.
Pi ist etwas für Teams, die im Terminal zuhause sind. Wer tmux, Container und Skripte ohnehin nutzt, gewinnt Kontrolle. Wer einen Assistenten sucht, der nach der Installation sofort mit Plan Mode, Freigabedialogen und Aufgabenlisten losläuft, ist mit einem stärker vorgegebenen Agenten besser bedient. Das ist keine Schwäche von Pi, sondern eine bewusste Entscheidung des Projekts.
Besonders spannend finden wir den kleinen Fußabdruck im Kontext für lokale Modelle. Wer Code aus DSGVO Gründen nicht in die Cloud geben darf, arbeitet mit begrenzter Hardware. Jedes gesparte Token zählt. In dieser Konstellation ist ein schlanker Harness kein Purismus, sondern schlicht die Bedingung dafür, dass es überhaupt läuft.
Roland Golla ist der Gründer von Never Code Alone in Duisburg. Sein Thema: Die KI schreibt den Code, er sorgt für die Qualität. Bei der Bewertung von Agent Tooling zählt für uns weniger die Feature Liste als die Frage, ob das Team am Ende Code liefert, den es auch in einem Jahr noch warten kann.
Roland Golla ist Entwickler aus Leidenschaft – seit über 20 Jahren. Er hat hunderte Projekte begleitet, von Legacy-Refactoring bis KI-Integration. Bei Vibe Coding verbindet er das Beste aus beiden Welten: Die Geschwindigkeit von KI-generiertem Code mit der Qualität professioneller Softwareentwicklung. Kein Bullshit, keine Agentur-Floskeln – direkte Hilfe von jemandem, der selbst täglich im Code steckt.
Die wichtigsten Fragen zu Pi, zur Installation, zur Lizenz und zur Abgrenzung von anderen Terminal Agents.
Pi ist ein minimaler Agent Harness für das Terminal, entwickelt von Mario Zechner und seit April 2026 bei Earendil Inc. Der Agent bringt vier Werkzeuge mit: read, write, edit und bash. Alles Weitere baust du als TypeScript Extension oder installierst es als Pi Package über npm oder git.
Ja. Der Kern von Pi bleibt MIT lizenziert, auch nach dem Wechsel zu Earendil Inc. im April 2026. Das Repository liegt unter earendil-works/pi. Earendil hat angekündigt, dass einzelne künftige Zusatzkomponenten anders lizenziert sein können. Der Agent selbst bleibt offen.
Über npm mit dem Paket at earendil-works/pi-coding-agent oder über das Installationsskript von pi.dev. Voraussetzung sind eine aktuelle Node Version, git und bash. Danach hinterlegst du einen API Schlüssel und startest Pi im Projektordner.
Der Verzicht ist gewollt. Manche MCP Server schieben große Mengen an Werkzeugbeschreibungen in das Kontextfenster, bevor die erste Aufgabe beginnt. Pi setzt stattdessen auf CLI Tools mit einer README, die als Skill nur bei Bedarf geladen werden. Wer MCP braucht, kann es als Extension nachrüsten.
Pi spricht über fünfzehn Provider an, darunter Anthropic, OpenAI, Google, Azure, Bedrock, Mistral, Groq, Cerebras, xAI, Hugging Face, MiniMax, NVIDIA, OpenRouter und Ollama. Der Wechsel läuft mitten in der Session per Tastenkürzel. Eigene Provider trägst du in der models.json nach.
Claude Code bringt Plan Mode, Sub Agents, Freigabedialoge und MCP von Haus aus mit. Pi lässt all das bewusst weg und stellt dir stattdessen die Bausteine bereit. Claude Code liefert schneller Ergebnisse ohne Konfiguration. Pi gibt dir mehr Kontrolle, kostet aber Einrichtungszeit.
OpenClaw nutzt Pi über den SDK Modus als Kern. Pi übernimmt die Kommunikation mit dem Sprachmodell, OpenClaw ergänzt Messaging Anbindung und Assistenzschicht. Der virale Assistent aus dem Januar 2026 läuft also auf diesem Harness.
Ja. Du trägst Ollama als Provider in der models.json ein und richtest Pi auf die lokale Schnittstelle. Weil der System Prompt klein bleibt, haben auch kleinere lokale Modelle eine reelle Chance, Aufgaben sauber zu Ende zu bringen.
Mario Zechner aus Österreich, in der Szene bekannt als badlogic und Schöpfer des Java Game Frameworks libGDX. Seit April 2026 gehört Pi zu Earendil Inc., einer Public Benefit Corporation, die Armin Ronacher mitgegründet hat. Zechner ist dort Anteilseigner und entscheidet weiter über Pi.
Extensions sind TypeScript Module, die zur Laufzeit kompiliert werden. Sie greifen auf Werkzeuge, Befehle, Tastenkürzel, Ereignisse und die Terminal Oberfläche zu. Du kannst Pi bitten, eine fehlende Funktion selbst zu schreiben, neu zu laden und direkt weiterzuarbeiten.
Pi Packages bündeln Extensions, Skills, Prompt Templates und Themes zu einer installierbaren Einheit. Verteilt werden sie über npm oder git. So teilst du deinen Team Standard, statt jeden Rechner einzeln einzurichten.
Der Print Modus liefert auf einen Aufruf eine Antwort und eignet sich damit für Skripte und Pipelines. Typische Einsätze sind Commit Nachrichten, Prüfungen vor dem Deployment oder das Erzeugen von Changelogs. Mit dem JSON Modus verarbeitest du den Ereignisstrom weiter.
Sessions liegen als Baum in einer einzigen Datei. Du exportierst sie als HTML oder lädst sie als GitHub Gist hoch und erhältst eine Adresse, die den Verlauf lesbar darstellt. Für Code Reviews ist das ein praktischer Nebeneffekt.
Eher nicht. Pi setzt voraus, dass tmux, Container und Skripte zum Alltag gehören. Teams ohne diese Grundlage kommen mit einem stärker vorgegebenen Agenten schneller ans Ziel. Welche Variante zu deinem Team passt, ordnen wir im Beratungsprojekt gemeinsam ein.
Wie du mit Open-Source-Tools wie PostHog und GrowthBook plus KI-Coding-Agents professionelles A/B Testing selbst umsetzt - ohne teure SaaS-Loesungen.
Der iterative Loop ist die Kernarchitektur jedes autonomen KI Agenten. Wie er funktioniert, wo er durchdreht und welche Safeguards Production braucht.
Vercels offenes Ökosystem aus modularen Skill Packages für KI Coding Agents wie Claude Code, OpenCode, Cursor und Codex. Mit npx skills CLI, skills.sh Directory und mehr als 18 unterstützten Agenten.
Was ist AGI? Definition, aktueller Stand 2026, die große Debatte ob wir AGI bereits erreicht haben und was das für Entwickler und Unternehmen bedeutet.
Microsofts Open-Source-Framework für Multi-Agent-Systeme – autonome KI-Agenten, die miteinander kommunizieren und komplexe Aufgaben lösen.
Le Chat von Mistral schlägt ChatGPT 2026 in vier Dimensionen: DSGVO und EU AI Act, Geschwindigkeit mit Flash Answers, Preis, Open Source Verfügbarkeit.
OpenAIs ChatGPT im Überblick: GPT 5.6 mit Sol, Terra und Luna, neue Effort Settings, ChatGPT Work und die Einordnung für Entwickler.
Agent Teams ist das neue Feature in Claude Code: Mehrere KI-Instanzen arbeiten parallel an einem Projekt, koordinieren sich autonom und lösen komplexe Aufgaben schneller als ein einzelner Agent.
Der dezentrale Marktplatz für Claude-Code-Erweiterungen: Plugins finden, installieren und eigene Marketplaces erstellen.
Claude Code Plugins bündeln Slash-Commands, Agents, Hooks und MCP-Server in installierbare Pakete. Mit dezentralen Git-Marketplaces und über 4.600 Community-Repositories ist ein ganzes Ökosystem entstanden.
Claude Code Remote Control, SSH und Cloud Sessions im Vergleich: So arbeiten Entwickler 2026 ortsunabhängig mit dem KI-Coding-Agent von Anthropic.
Was ist Claude Cowork 2026? Der KI-Agent von Anthropic für Desktop-Automatisierung. Funktionen, Anwendungsfälle und Einschränkungen im Überblick.
Claude Design ist Anthropics KI Design Tool mit Opus 4.7. Prototypen, Wireframes und Pitch Decks aus Text, mit direktem Handoff zu Claude Code.
Claude Security scannt Codebases nach Schwachstellen und generiert Patches. Public Beta seit April 2026, powered by Opus 4.7.
Claw Code ist ein quelloffenes KI-Coding-Agent-Framework in Python und Rust. Clean-Room-Rewrite der Claude Code Architektur mit 172k GitHub Stars.
Schritt-für-Schritt Installationsanleitung für den Open-Source KI-Assistenten Clawdbot auf macOS, Linux und Windows mit Provider-Anbindung und Sicherheitskonfiguration.
Mac Mini als Always-on-Server für Clawdbot: Hardware-Empfehlung, macOS-Optimierung, Headless-Betrieb und Sicherheitskonfiguration für das Self-Hosted Setup.
CodeRabbit ist das meistinstallierte KI-Code-Review-Tool auf GitHub mit \u00fcber 2 Mio. verbundenen Repos und 13 Mio. reviewten Pull Requests.
CodexBar zeigt KI-Token-Limits für Claude Code, Cursor und Codex direkt in der macOS Menu Bar. Open Source, MIT-Lizenz, 7.400+ Stars.
ComfyUI ist die leistungsst\u00e4rkste Open-Source-Workflow-Engine f\u00fcr KI-Bildgenerierung. Lokal, DSGVO-konform, unterst\u00fctzt Flux, SDXL, Video und mehr.
Framework für rollenbasierte KI-Agenten-Teams – definiere Rollen, Ziele und Backstories, und lass die Crew autonom zusammenarbeiten.
Welches Datenformat liefert dem LLM bei KI Auswertungen die besten Ergebnisse und spart Tokens
Cursor BugBot ist Cursors KI-Agent für automatisches Code-Review und Debugging direkt im Editor. Mit über 2 Millionen analysierten Pull Requests pro Monat und einer Resolution Rate von 70 % ist er 2026 ein zentrales Tool im Vibe-Coding-Workflow.
Dify ist die Open Source Plattform für visuelle Agentic AI Workflows und Production grade LLM Apps. NCA bewertet Funktionen, Stärken und Use Cases 2026.
Was ein Digitaler Zwilling ist, wie er sich von Simulation und digitalem Schatten unterscheidet und welche Rolle KI Modelle 2026 dabei spielen.
Open Source Embedding Modelle 2026 für RAG: Qwen3, BGE M3, Nomic, Jina und der Klassiker all MiniLM im strukturierten Vergleich mit Auswahlkriterien.
Überblick über Embodied AI Foundation Models und Vision Language Action Modelle 2026 für Robotik und physische Agenten.
Everything Claude Code (ECC) ist das größte Open Source Skill und Agent Ökosystem für KI Coding Agents. 178.000 GitHub Stars, MIT Lizenz, läuft in Claude Code und OpenCode.
Googles cloudbasierte Entwicklungsumgebung für Full-Stack-Apps mit Gemini-KI: Prototyping per Prompt, App-Deployment per Klick und kostenlos für 3 Workspaces.
Gemini 3.5 Flash schlägt Gemini 3.1 Pro auf agentischen Benchmarks bei einem Drittel des Preises. Verfügbar seit 19. Mai 2026 über Antigravity 2.0 und die Gemini API.
Die Gemini Familie 2026 mit Gemini 3.5 Flash, Gemini Omni Flash, Gemini 3.1 Pro und Deep Think im Vergleich. Benchmarks, Preise und Use Cases.
Gemini Nano ist das kleinste Modell der Gemini Familie, lokal installiert in Chrome und auf Pixel Geräten. Mit DSGVO Bedenken durch Silent Install.
Worktrees gehören Git, nicht Anthropic. Codex, OpenCode, Aider und lokale Modelle parallel nutzen, ganz ohne US Anbieter Bindung 2026.
Git Worktrees isolieren parallele KI Agenten in eigenen Arbeitsverzeichnissen. Native Claude Code Unterstützung, worktreeinclude und Tool Vergleich 2026.
GitBook kombiniert technische Dokumentation mit KI Agent, MCP Server und Git Synchronisation. Überblick für Entwicklerteams und technische Autoren 2026.
GitHub MCP Server verbindet KI Agents direkt mit Repositories, Issues und CI/CD Pipelines. Installation und DSGVO Bewertung 2026.
Google Antigravity 2.0 bringt Desktop App, CLI, SDK und Managed Agents in der Gemini API. Powered by Gemini 3.5 Flash mit zwölffacher Geschwindigkeit.
Agent First Plattform mit Desktop App, CLI, SDK und Managed Agents API, powered by Gemini 3.5 Flash. Neuerungen, Features und Anwendungsbeispiele 2026.
Gemini Gems erstellen individuelle KI-Assistenten mit Live-Drive-Anbindung, 1M Token Kontext und Team-Sharing – die kostenlose ChatGPT-Custom-GPT-Alternative.
Google Stitch ist das KI-native Design-Tool aus Google Labs: UI per Text oder Sprache generieren, interaktiv prototypen und direkt in HTML/CSS exportieren.
Groq nutzt eigene LPU Chips für extrem schnelle Inferenz von Open Source Modellen wie Llama oder Qwen. Wann lohnt sich der Einsatz, wann ist Ollama oder vLLM die bessere Wahl?
Von Content Pipeline bis Deployment Automation: zehn praktische Anwendungsfälle für Hermes Agent und wie NCA agentenbasierte KI Workflows einordnet.
Hermes Agent ist ein selbstlernender Open Source KI Agent von Nous Research mit persistentem Memory, autonomer Skill Erstellung und Multi Plattform Gateway für Telegram, Slack, WhatsApp und Discord.
Hugging Face ist die zentrale Plattform für Open Source KI Modelle mit 2 Millionen Modellen, Datasets, Spaces und Inference Endpoints. NCA Einordnung 2026.
Open Source Framework von HeyGen für lokales Video Rendering. HTML statt React, agent native für Claude Code und Cursor.
Andrej Karpathy ist einer der einflussreichsten LLM-Lehrer weltweit. Sein Wiki, seine GitHub-Projekte und YouTube-Kurse sind Pflichtlektüre für jeden KI-Entwickler.
Was ist eine KI Strategie? Definition, vier Reifegrad Levels vom Experimentieren bis zur skalierten KI und die Bausteine für eine erfolgreiche Umsetzung 2026.
Kilo Code als Open Source Nachfolger von Roo Code: Modellfreiheit, OpenCode Fundament und Governance Risiken, ehrlich eingeordnet von NCA.
Moonshot AIs Kimi Modellreihe: Von K2.5 bis K2.6 mit Agent Swarm, 1T MoE Parametern und Ollama Cloud. Alle Features und Benchmarks.
Foundation Bildmodell von Krea, bewusst ohne KI generierte Bilder trainiert. Open Weights, Style Control und lokale Nutzung im Experten Check 2026
Open Source Framework für LLM Anwendungen mit Chains, Agents und LCEL Pipeline Syntax. Mit LangGraph für Orchestrierung, LangSmith für Evaluation und 1000 Integrationen.
Tracing, Evals und Prompt Management für LLM Anwendungen. NCA ordnet Funktionen, Self Hosting und die ClickHouse Übernahme ein.
LangChains Framework für zustandsbehaftete KI Workflows: Agenten als Graphen mit definierten Zuständen, Übergängen und Kontrollfluss.
Open Source Bibliothek für lokale LLM Inferenz in C/C++ ohne Abhängigkeiten. GGUF Format, Quantisierung, OpenAI kompatible API.
Open Source RAG Framework von Run-Llama für Indexing, Query Engines und agentenbasierte Document Processing. Im NCA Stack für DSGVO konforme Knowledge Bases mit Ollama.
KI Modelle direkt auf iPhone und Android ausführen: Komplett offline, DSGVO konform und ohne Cloud. Die besten Apps, Hardware Anforderungen und Modelle für On Device KI 2026.
LM Studio ist die GUI für lokale LLMs. Features, Ubuntu Installation und wann LM Studio die richtige Wahl ist.
Privacy first, local first, AGPL lizenziert. Logseq ist die DSGVO konforme Antwort auf Notion und Roam Research, mit Ollama Integration für lokale KI Workflows.
Wann DSGVO, Berufsgeheimnis und IP Schutz lokale KI erzwingen — die Szenarien mit Paragraphenbezug für Compliance Pflicht.
Wann sich lokale KI rechnet — Edge, Offline, Mass Processing, CI/CD und Kostenkontrolle als ROI Treiber 2026.
MemPalace ist ein Open Source KI Memory System von Milla Jovovich und Ben Sigman. Es speichert Konversationen lokal mit ChromaDB und SQLite, erreicht 96,6% auf LongMemEval und loest das Problem der KI Amnesie fuer Entwickler und Power User.
Open Source KI Prediction Engine mit GraphRAG und Multi Agent Simulation. Lade Dokumente hoch und simuliere Reaktionen tausender KI Agents.
Mistral AI ist Europas führender KI Anbieter aus Paris. Medium 3.5 mit 256K Kontext, Le Chat mit Work Mode und Vibe CLI Cloud Coding Agents im Überblick.
Mistral Connectors verbinden KI-Agents mit Enterprise-Daten per MCP-Protokoll. Reusable Tool-Integration in Mistral Studio 2026.
Das virale Social Network für KI-Agenten: Funktionsweise, Sicherheitsrisiken und die Debatte um autonome KI-Kommunikation.
Open-Source KI-Assistent mit 60.000+ GitHub Stars, der über WhatsApp, Telegram und andere Messaging-Apps gesteuert wird.
intfloat/multilingual-e5-large ist das stärkste kostenlose Embedding-Modell für RAG und Semantic Search. Self-hosted, MIT-Lizenz, 1024 Dimensionen, kein API-Key nötig.
Nano Banana 2 ist Googles neuester KI-Bildgenerator auf Basis von Gemini 3.1 Flash Image. Pro-Qualität bei Flash-Geschwindigkeit, kostenlos, mit 4K und Real-Time Web Search.
NVIDIA NemoClaw bringt Privacy- und Security-Guardrails zu autonomen KI-Agenten. Deploy mit einem Befehl, lokale Modelle via Nemotron, OpenShell-Controls.
Obsidian ist ein lokales, DSGVO-konformes Markdown-Wissenssystem mit nativer KI-Integration für Claude Code und Vibe Coding Workflows.
Was Odysseus AI kann, warum PewDiePie es so nennt, wie privat es wirklich ist und wann sich der self hosted KI Workspace lohnt. Die NCA Einordnung.
Googles offener Markdown Standard für portables KI Wissen, vendor neutral und ohne Lock in. Funktionsweise, Vergleich mit MCP und Einordnung für 2026.
Ollama ist der führende Open-Source-Runner für lokale KI-Modelle. Mit über 150 Modellen, Subagenten-Support und integrierter Websuche macht Ollama KI-gestützte Entwicklung DSGVO-konform und offline-fähig.
Massively multilingual Zero Shot TTS Modell mit Voice Cloning und Voice Design. Apache 2.0, lokal lauffähig, 600 Sprachen Support.
Open Design ist die Open Source Claude Design Alternative. Local first, Apache 2.0, BYOK: dein vorhandener Coding Agent wird zur Design Engine für Prototypen, Slides und Dashboards.
Open Notebook bringt NotebookLM Features auf den eigenen Server: 18 plus KI Provider, Multi Speaker Podcasts, REST API und volle Datenhoheit. NCA testet das Open Source Tool gerade intern.
Open WebUI ist eine browserbasierte Oberfläche für lokale KI-Modelle wie Ollama. DSGVO-konform, offline-fähig, erweiterbar durch RAG und Python-Tools – ideal für Entwickler und Unternehmen.
Der dreifach umbenannte KI-Agent – von ClawdBot über MoltBot zu OpenClaw. 100.000+ GitHub Stars, autonome Aufgabenausführung, und erhebliche Sicherheitsbedenken.
Spec-Driven Development Framework für AI Coding Assistants – eine Single Source of Truth für deterministische KI-Entwicklung.
Paperclip verwandelt einzelne KI Agenten in ein koordiniertes Unternehmen. Mit Org Charts, Budgetkontrolle und vollstaendigem Audit Log. Open Source und selbst gehostet.
Paperclip ist die Firma, Hermes Agent der Mitarbeiter mit Memory. Wann nutzt du welche Plattform, wo ergänzen sie sich, was passt zu deinem Stack.
Open Source macOS Automation Toolkit. CLI plus MCP Server für KI Agenten wie Codex, Claude Code und Cursor.
Claude Mythos Preview findet tausende Zero-Day-Schwachstellen in Betriebssystemen und Browsern. Was bedeutet das für Entwickler und DSGVO-konforme KI?
Qwen von Alibaba Cloud ist eine der stärksten Open-Source KI-Modellserien 2026. Qwen3, Qwen3-Coder, QwQ und Qwen3-Omni lokal nutzen – ohne API-Kosten, DSGVO-konform.
Der virale Marktplatz, auf dem KI-Agenten Menschen für reale Aufgaben buchen – per MCP-Call. Funktionsweise, Chancen und Risiken.
Ruflo koordiniert KI-Agenten-Swarms in Claude Code. Open Source, lokal betreibbar und DSGVO-konform. Die Enterprise-Alternative zu Cloud-basierten Agent-Plattformen.
Scrapling ist das adaptive Open Source Web Scraping Framework in Python. Selbstheilende Selektoren, Cloudflare Bypass, Spider Framework und MCP Server für KI Agenten.
Shannon analysiert Quellcode, findet Angriffsvektoren und f\u00fchrt echte Exploits aus \u2013 bevor sie in Produktion gelangen. Open Source, self-hosted, DSGVO-konform.
SKILL.md ist die Kerndatei jedes Agent Skills. Aufbau, Frontmatter, Progressive Disclosure und die description als Trigger, verständlich erklärt von Never Code Alone.
Subquadratic launcht SubQ mit Subquadratic Sparse Attention und 12 Millionen Token Context Window. NCA ordnet die Behauptungen und die Skepsis der Forschungs-Community ein.
Das Sylius MCP Server Plugin macht Ihren Onlineshop für KI Agenten zugänglich. Produktsuche, Warenkorb und Checkout per natürlicher Sprache.
Symfony AI Mate verbindet KI Assistenten mit PHP Projekten per Model Context Protocol. Profiler, Logs, Services direkt im KI Workflow.
Kompaktes Datenformat das die Tokenkosten von JSON in LLM Prompts deutlich senkt
Canonical bringt mit Ubuntu 26.04 LTS und Ubuntu 26.10 lokale KI Modelle als Inference Snaps direkt ins Betriebssystem.
Unsloth beschleunigt Fine Tuning von LLMs um Faktor 2 bei 70 Prozent weniger VRAM. NCA bewertet LoRA, QLoRA, DoRA und Use Cases für 2026.
Open Source Web UI für lokale KI Modelle, GGUFs ausführen mit Tool Calling, Code Execution und Websuche, DSGVO konform auf eigener Hardware
Wie das url context Tool der Gemini API Webinhalte direkt aus URLs liest, wofür es taugt und wo die Grenzen liegen. Einordnung von Never Code Alone.
Vise Coding ist der strukturierte Gegenansatz zu Vibe Coding: KI erzeugt nur kleine, pr\u00fcfbare \u00c4nderungen mit Tests und Dokumentation f\u00fcr echten Produktionscode.
High Performance LLM Serving mit PagedAttention, Continuous Batching und OpenAI kompatibler API. Ideal für DSGVO konformes Self Hosting.
NCA migrierte den eigenen Chatbot von OpenAI auf Voyage AI voyage-3-m-exp. Erfahrungsbericht: bessere Retrieval Qualität, DSGVO-nähere Kontrolle und konkrete Migrationstipps.