llama.app gibt llama.cpp einen einfachen Zugang: ein Curl‑Befehl, 123,5 K Sterne, keine API‑Schlüssel

12. August 2026, 12:03

llama.cpp wurde drei Jahre lang ohne Website ausgeliefert. Du hast es selbst kompiliert oder du hast es nicht benutzt. Jetzt hat das ggml‑Team eine Produktseite davor gestellt – llama.app – und das Ganze lässt sich auf curl -LsSf https://llama.app/install.sh | sh, Brew oder Winget reduzieren. HN vergab 221 Punkte.

Was es eigentlich ist

Eine lokale KI‑Laufzeit, keine Chat‑App. Der Installer legt eine einzige llama‑Binärdatei ab, die den alten Werkzeug‑Zoo (llama-server, llama-cli) hinter einer einzigen CLI zusammenfasst. Handabgestimmte Kernel unterstützen Apple Silicon, normale CPUs, RTX 3090 bis 5090, H100, AMD Radeon, Intel Arc, Jetson. Qwen 3.6, Gemma 4, GPT‑OSS laufen sofort. Das Versprechen: Frontier‑KI vollständig auf deiner Maschine ausführen. Keine API‑Schlüssel, keine Telemetrie, keine Beschränkungen.

Der Teil, der für Entwickler wichtig ist

llama-server stellt einen OpenAI‑kompatiblen HTTP‑Endpoint bereit, sodass alles, was die OpenAI‑API versteht – deine App, dein IDE‑Plugin – auf localhost zeigt und funktioniert. Und llama.app wird zusammen mit Pi geliefert, einem lokalen Coding‑Agenten, der automatisch Modelle entdeckt, die du bereits heruntergeladen hast, ohne Konfigurationsdatei.

Dieser letzte Teil ist der eigentliche Durchbruch. Lokaler Claude Code, kostenlos, MIT‑lizenziert.