-
pdf-inspector (Firecrawl) gewinnt 1.699 GitHub‑Stars an einem Tag — die Rust‑Bibliothek, die entscheidet, welche PDFs OCR benötigen
Jede RAG-Pipeline scheitert an derselben Frage: Handelt es sich bei diesem PDF um echten Text oder um einen Scan? Liegt man falsch, verbrennt man entweder GPU‑Zyklen damit, Klartext per OCR zu verarbeiten, oder füttert das LLM mit Müll. pdf-inspector, Firecrawl’s Open-Source-Rust-Bibliothek, beantwortet das in 10–50 Millisekunden. Sie hat 8,6 k Sterne, +1.699 heute — das am schnellsten wachsende KI-Repo…
-
Swiftlet führt ein 80B Qwen in 4,3 GB RAM aus — und ein 35B auf Ihrem iPhone.
Ein 80B‑Modell benötigt normalerweise mehr als 40 GB Speicher. Swiftlet, ein neues Show HN‑Projekt, ist eine Swift + Metal‑Inference‑Runtime, die Qwen3‑Next / 3.5 / 3.6‑MoE‑Modelle auf Apple‑Geräten mit fast keinem Speicherbedarf ausführt: 42 GB auf Festplatte, 4,3 GB Spitzen‑RAM. Der Trick: SSD als VRAM – MoE‑Modelle aktivieren pro Token nur etwa 3 Mrd. Parameter.
-
Cloudflare skaliert das Hosting von Kimi und GLM: Eine Open-Source-Modell-„kleiner, schneller, sicherer“-Pipeline
Cloudflare hat gerade seine Hausaufgaben präsentiert: ein technischer Deep‑Dive, wie es die Kimi K2.6 von Moonshot und das GLM 5.2 von Z.ai – massive Long‑Context‑MoE‑Modelle – über sein globales Edge‑Netzwerk bereitstellt. 96 Punkte auf HackerNews am Tag der Veröffentlichung. Kleiner, schneller, sicherer – mit Zahlen. Drei Schritte. FP8‑KV‑Cache‑Quantisierung verdoppelt den unterstützten Kontext von Kimi K2.6 von…
-
Redis‑Erfinder antirez veröffentlicht ds4 (DwarfStar), eine rein-C-Engine zum lokalen Ausführen von DeepSeek V4.
antirez verbrachte 15 Jahre damit, Redis schnell zu machen. Jetzt richtet er dieselbe Obsession auf lokale KI: ds4 (DwarfStar), eine lokale Inferenz-Engine, geschrieben in C, die DeepSeek V4 Flash/PRO und GLM 5.2 auf Ihrer eigenen Hardware ausführt. 20,3 k GitHub Stars, +385 heute, Spitzenreiter bei GitHub Trending. Absichtlich eng, aggressiv optimiert ist ds4 kein weiteres General-Purpose…
-
Halluzination SQLite-CVE-Vorfall: LLM‑Slop greift CVE‑System an (JFrog‑Untersuchung) — gefälschte KI‑geschriebene Bugs erreichten 9,8 Critical
Jemand nutzte ein LLM, um massenhaft gefälschte Schwachstellenberichte gegen SQLite zu erzeugen — und das offizielle CVE‑System ließ sie durchgehen. CVE‑2026‑51302 bis 51304 erhielten Kritisch‑Scores von 9,8; Red Hat bewertete einen kurzzeitig mit einer perfekten 10,0. Das ist kein Produkt, sondern eine Untersuchung von JFrog Research, und Hacker News brachte es auf 508 Punkte, weil das Ziel…
-
Qwen3.8-Max geht GA: Alibabas 2,4 T‑Modell schlägt Claude Fable 5 im Terminal-Bench, Gewichte werden nächste Woche veröffentlicht.
884 Punkte bei HackerNews, die größte KI‑Story des Tages. Alibaba hat Qwen3.8-Max gerade aus der Vorschau genommen: ein 2,4-Billionen-Parameter-MoE-Modell, das pro Anfrage nur 95 Mrd. aktiviert und für Programmierung und Long-Horizon-Agenten-Arbeit gebaut wurde. Die relevanten Zahlen Terminal-Bench 2.1: 86,6 — über Claude Opus 4,8 und Fable 5 (84,6), hinter nur…
-
Microsoft MAI-Cyber-1-Flash + MDASH: ein 5B-Modell, das 16 Windows-CVEs gefunden hat und 96 % bei CyberGym erreicht hat.
Microsoft hat sein erstes Modell trainiert, das ausschließlich für Sicherheit gebaut ist. Kein allgemeiner Chatbot, der an ein SOC angekoppelt ist — ein cyber-spezialisiertes Fine‑Tune von MAI-Code-1-Flash, sparsames MoE, 137 B Gesamt‑Parameter, aber nur 5 B aktiv, 256k Kontext. Klein und billig bewusst. Was es tatsächlich tut, MAI-Cyber-1-Flash lebt innerhalb von MDASH, Microsofts Multi‑Model‑Vulnerability‑Scanning‑Harness, das entdeckt, validiert und …
-
Suno verliert wegweisenden deutschen Urheberrechtsfall gegen GEMA (erstes europäisches KI-Musik-Urteil)
Suno ist der Text-zu-Musik-Generator, der aus einer Eingabeaufforderung in Sekunden einen kompletten Song erzeugt. Am 31. Juli 2026 entschied das Landgericht München, dass er das Urheberrecht verletzt – das erste Urteil Europas zu KI-Musik-Training. Was das Gericht tatsächlich entschied: Der clevere Teil: Die GEMA argumentierte nicht über abstraktes „Lernen“. Sie zeigte, dass das Modell …
-
Zwei API-Einstellungen haben die ARC-AGI-3-Punktzahl von GPT-5.6 Sol verdreifacht — OpenAI sagt, das Harness, nicht das Modell, sei das Problem.
GPT-5.6 Sol kann mathematische Probleme knacken, erreichte jedoch lächerliche 13,3 % bei ARC-AGI-3, einer Sammlung von 2D-Puzzle-Spielen. Am 31. Juli veröffentlichte OpenAI die Autopsie, und der Schuldige war nicht das Modell. Das Harness ließ das Modell verhungern. Der offizielle ARC-AGI-3-Runner verwirft das Denken des Modells nach jedem einzelnen Zug, und einmal…
-
OpenAI Astra widerlegte Connes’ Rigidity Conjecture — und 9 weitere jahrzehntealte mathematische Probleme, jedes mit einem Lean‑Zertifikat
Am 1. August veröffentlichte OpenAI „Zehn Fortschritte in Mathematik und theoretischer Informatik“ und gab den Namen seines nächsten Flaggschiffs bekannt: Astra. Das ist kein Chatbot. Astra ist ein Multi-Agent-Langzeit-Modell – viele Agenten arbeiten stunden‑ oder tageweise an einem einzigen Problem. Was es tatsächlich tat, war zehn Probleme zu lösen, die schon seit…