-
Voicebox erreicht 43 K GitHub-Sterne: ein kostenloser, lokaler ElevenLabs, der KI‑Agenten Ihre Stimme gibt
Jamie Pine — der Entwickler hinter Spacedrive — hat Voicebox gebaut, und es erhielt an einem einzigen Tag 629 Sterne auf dem Weg zu 43 K. Es ist ein Open-Source-Desktop-Voice-Studio (Tauri-Rust-Shell + React + FastAPI-Sidecar), das gleichzeitig zwei Abonnements eliminiert: ElevenLabs für die Stimmenerzeugung, WisprFlow für die Diktierung. Alles läuft auf Ihrem…
-
Alibaba’s Qwen 3.8 (Qwen3.8-Max-Preview) behauptet, es sei „nur hinter Fable 5“ — ohne veröffentlichte Benchmarks.
Qwen hat am 19. Juli Qwen3.8-Max-Preview veröffentlicht: ein 2,4‑Billionen‑Parameter‑Modell, das erste multimodale Modell des Teams, das die 1T‑Marke überschreitet. Es kann Bilder, Videos und Dokumente lesen. Alibaba sagt, dass es open-weight werden soll – was es zum größten offenen multimodalen Modell aller Zeiten machen würde. Vorerst gibt es nur die gehostete Vorschau. Die Schlagzeile lautet: Leistung „nur zweitrangig …“.
-
Kimi CLI erreicht 9.600 GitHub‑Stars, während Moonshot AI in das Gebiet von Claude Code vordringt.
Kimi CLI ist auf GitHub im Trend, und das Timing ist kein Zufall. Tage nachdem Kimi K3 den ersten Platz in Frontend Code Arena mit einer paarweisen Gewinnrate von 76 % erreicht hatte – vor Claude Fable 5 mit 63 % – hat Moonshot AI’s offizieller Terminal-Coding-Agent die 9.600 Sterne übertroffen. Was es ist: Ein Open-Source (Apache 2.0)-Coding-Agent…
-
Transcribe.cpp führt über 60 Sprachmodelle in einer Laufzeit aus — das llama.cpp der Stimme, unterstützt von Mozilla.ai
Lokale Spracherkennung ist fragmentiert. whisper.cpp führt nur Whisper aus; Parakeet, Canary, Voxtral und Kyutai existieren jeweils in eigenen Repositories mit eigenen Eigenheiten. Transcribe.cpp fasst all das zu einer einzigen C/C++-Inference-Bibliothek zusammen: über 16 ASR-Modellfamilien, mehr als 60 Modelle, alles im GGUF-Format, alles auf dem ggml-Runtime. Hacker News vergab dafür 526 Punkte. Das…
-
Clawk erreicht 721 GitHub-Stars: eine Einweg-Linux-VM für Claude Code, mit einem Befehl
Jede Coding-Agent-Sitzung endet auf eine von zwei Arten: Sie babysitten den ganzen Tag über Berechtigungsprompts, oder Sie führen –dangerously-skip-permissions aus und hoffen. Clawks Wette: Diese Flags sind nicht rücksichtslos, wenn der Agent nicht auf Ihrer Maschine läuft. Show HN stimmte zu — 225 Punkte, 157 Kommentare. Was Clawk ist, ein Open-Source-CLI, das eine leichte VM startet…
-
Moonshine passt einen kompletten Sprach‑Stack in 500KB — und schlägt immer noch Whisper
Moonshine ist ein Open-Source-Sprach-Stack von Moonshine AI (früher Useful Sensors), gegründet von Pete Warden — dem Ingenieur hinter TensorFlow Lite bei Google. Speech-to-text, intent recognition und text-to-speech, alles in C++, alles auf dem Gerät. Der Micro‑Build läuft eine komplette Sprachschnittstelle in 470 KB RAM auf einem 80‑Cent Raspberry Pi RP2350‑Chip. Kein Cloud,…
-
code-review-graph erreicht 20 K GitHub‑Sterne — ein 82‑facher Kontext‑Cut für Claude Code und Cursor
Coding‑Agents verbrauchen die meisten ihrer Tokens, indem sie Dateien lesen, die sie nicht benötigen — Claude Code, das beim Start 33 k Tokens verzehrt, war ein ganzes Diskussionsthema. code-review-graph, jetzt das #1‑KI‑Repo auf GitHub Trending mit 20.125 Stars und +356 in einem Tag, greift das Problem direkt an. Es ist ein local‑first‑MCP‑Server plus CLI: Tree‑sitter parst Ihre …
-
EU befiehlt Google, Android für konkurrierende KI‑Agenten zu öffnen — ChatGPT und Claude erhalten Zugriff auf Gemini‑Niveau
Die Europäische Kommission hat diese Woche nach dem Digital Markets Act entschieden: Google muss rivalisierenden KI‑Assistenten denselben Android‑Zugang gewähren, den Gemini genießt – Apps, Systemdienste, alles. Das ist keine Produkteinführung, sondern eine Regulierung, die die Produktverteilung bestimmt: Wer das Standard‑Gehirn auf jedem europäischen Android‑Handy wird. Was tatsächlich eröffnet …
-
Ant Group veröffentlicht LingBot-Map als Open-Source: 98,98 F1 bei ETH3D, 21 Punkte vor allen anderen.
Benchmarks sehen selten so aus. LingBot-Map, das neue feed-forward 3D-Rekonstruktions-Foundation-Model des Robbyant-Teams von Ant Group, erzielt 98,98 F1 auf ETH3D – mehr als 21 Punkte über dem zweiten Platz. Es erreichte #1 bei GitHub Trending mit +827 Sternen an einem einzigen Tag, und sowohl Code als auch Gewichte sind offen. Was es tatsächlich macht…
-
GPT-5.6 schließt eine 30-jährige Lücke in der konvexen Optimierung (Sébastien Bubeck) — 168 Minuten Nachdenken, ein offenes Problem weniger
Sébastien Bubeck hat seit zwei Jahren eine Frage verwendet, um KI-Modelle zu testen: Wie lang kann ein Gradient-Fluss-Pfad auf einer konvexen Funktion innerhalb der Einheitskugel in n Dimensionen sein? Trivial zu formulieren, brutal zu lösen — die beste veröffentlichte Schranke, n^O(n), stammt von Manselli und Pucci aus dem Jahr 1991. Jedes Modell scheiterte. GPT-5.6, OpenAI’s…