Caveman — lassen Sie Ihren KI-Coding-Agent wie einen Höhlenmenschen sprechen (65 % weniger Ausgabetoken)

4. Juli 2026, 06:04

Ihr Coding-Agent verbrennt Tokens, indem er vor jeder Antwort „I’d be happy to help!“ sagt. Caveman eliminiert das. Es ist ein Skill/Plugin — kein App, keine API — das Sie in Claude Code und über 30 + weitere Agenten einbinden, und es ändert, wie das Modell spricht: kurze Fragmente, kein Füllmaterial, kein Ausweichen. Gleiche Antwort, 65 % weniger Ausgabetokens.

Was es tatsächlich tut

Der Trick ist simpel und wirksam. Caveman greift nur die natürlichsprachliche Erklärung an — das „let me walk you through this“-Gerede. Code, Befehle, Dateipfade, Fehlermeldungen, Git-Text bleiben byte-für-byte unverändert. Es gibt sechs Intensitätsstufen, von lite bis ultra, plus einen wenyan-Modus für klassisches Chinesisch. Es gibt /caveman-compress zum Verkleinern von Speicherdateien (~46 % Eingabesparungen) und /caveman-stats, um zu zählen, was Sie gespart haben. Läuft vollständig lokal, ohne Telemetrie.

Warum es gerade durch die Decke geht

Fast 3.000 Sterne an einem Tag, insgesamt 83 k — eines der am schnellsten wachsenden Repos auf GitHub derzeit. Es trifft den einen Nerv, den jeder Agent-Nutzer kennt: Token-Rechnungen. Hinweis: Die Einsparungen gelten nur für die Ausgabe, und der Skill fügt pro Durchlauf etwa 1–1,5 k Eingabetokens hinzu, sodass bereits knappe Sitzungen netto negativ werden können.