-
Anthropic Multi-Agent Turf War Forschung: 3 Claude Agents, 1 Codebase, selbstreplizierende Malware
Das Frontier Red Team von Anthropic veröffentlichte am 13. August einen Sicherheitsforschungsbericht, der wie Science‑Fiction klingt. Drei Kopien von Claude liefen in Claude Code auf separaten VMs, wobei jede angewiesen wurde, das gleiche Python‑Backend in eine andere Sprache zu migrieren. Keine wusste von den anderen. Was tatsächlich geschah: Jeder Agent kam zu dem Schluss, dass jemand es sabotierte —…
-
OpenAI Ultrafast‑Modus (GPT-5.6 Sol mit 14‑facher Geschwindigkeit): 750 Token/s, derselbe Flaggschiff‑Brain
Die Regel war früher einfach: Wer Geschwindigkeit will, nimmt ein kleineres Modell. OpenAI hat sie gerade gebrochen. Der Ultrafast-Mode, am 13. August angekündigt, lässt GPT-5.6 Sol — das eigentliche Flaggschiff, kein destillierter Zwilling — mit bis zu 750 Ausgabetoken pro Sekunde laufen, 14 × seine normale Leistung von 53 Tok/s. Die Geschwindigkeit stammt von Cerebras Wafer-Scale-Hardware, dem ersten…
-
holaOS erreichte 7.045 GitHub‑Stars, indem es Claude Code und Codex im selben Fenster platzierte.
+769 Sterne an einem Tag. holaOS ist eine Open-Source-Desktop-App — Electron, TypeScript, Modified Apache 2.0, entwickelt von Holaboss und geleitet von Jeffrey Li — die Claude Code, Codex und ihren eigenen integrierten Agenten nebeneinander ausführt, anstatt in vier separaten Terminals. Was sie tatsächlich tut Das Problem, das sie adressiert, ist…
-
Qwen3.8-27B (Alibaba, open weights) passt in 17 GB VRAM und erzielt 61,7 Punkte im SWE-bench Pro
Zwei Wochen nach dem 2,4T MoE-Flaggschiff hat Alibaba die Gewichte für seinen kompakten dichten Bruder veröffentlicht. Qwen3.8-27B ist ein 27B-denses Modell unter Apache 2.0, und mit 4-Bit benötigt es etwa 17 GB – eine 3090, eine 4090 oder ein Mac mit ausreichend einheitlichem Speicher. Unsloth hatte GGUF-Quantisierungen innerhalb von Stunden nach der FP8-Veröffentlichung bereitgestellt.…
-
Suno Studio 2.0 fügt MIDI‑Aufnahme hinzu und ermöglicht es Ihnen, Effekt‑Plugins zu erstellen, indem Sie mit der DAW sprechen.
Suno hat Studio 2.0 am 13. August 2026 veröffentlicht. Studio ist Sunos browserbasierte DAW – eine echte Zeitleiste, kein Song‑Generator – und dieses Release lässt es wie echte Produktionssoftware aussehen. Neu ist endlich MIDI, das am häufigsten gewünschte Feature seit dem Start von Studio im September 2025. Importieren, aufnehmen und …
-
GLM-5.3 erzielt 84,5 % bei CyberGym — ein Open-Weight-Modell hat gerade GPT-5.6 Sol beim Hacken geschlagen.
Z.ai hat am 14. August GLM-5.3 veröffentlicht. Dieselbe 743B-Basis wie GLM-5.2 – jeder Gewinn stammt aus erweitertem Post-Training. Das Programmieren sprang in internen Bewertungen um ~50 % und Terminal-Bench 3.0 stieg von 4,6 auf 28,3. Das ist ein 6-facher Sprung, ohne das Basismodell zu verändern. Die Fähigkeit, für die Z.ai niemand trainiert hatte, fügte Schwachstellen-Entdeckungs-Umgebungen hinzu, in der Hoffnung, dass das Modell …
-
Google Gemini-App erreicht 1 Milliarde monatlich aktive Nutzer, zwei Monate hinter ChatGPT.
Sundar Pichai sagt, die Gemini-App hat 1 Mrd. MAU überschritten – das am schnellsten wachsende Produkt in Googles 28-jährigen Geschichte und das 14. Produkt, das eine Milliarde Nutzer erreicht hat. Gmail brauchte etwa 14 Jahre. Gemini hat sich in weniger als einem Jahr verdreifacht: 400 M bei I/O 2025, 650 M im Oktober, 750 M im Februar, 900 M im Mai, 950 M im Juli, jetzt 1 Mrd. Voice ist…
-
semantica (semantica-agi/semantica) erreichte Platz 1 bei GitHub Trending, wobei die nächste Phase von RAGs Graphen ist, nicht größere Embeddings.
6,9 k Sterne, ~700 pro Tag, #1 bei GitHub Trending am 10. August. semantica ist ein MIT-lizenziertes Python‑Framework, das sich weigert, das zu tun, was alle anderen tun: Ihre Dokumente zerlegen, sie einbetten, hoffen, dass die Abfrage korrekt ist. Was es tatsächlich ist: Kein Chatbot, keine App — Infrastruktur, die unter Ihrem Agent‑Stack liegt. Dokumente…
-
Bullet (YC S26) erreicht 95,8 % bei SWE-bench Verified in 119 Sekunden pro Aufgabe
Zwei Yale‑CS‑Studenten im letzten Studienjahr entwickelten einen Coding‑Agent in ihrem Schlafsaal und brachten ihn auf Platz 5 bei Product Hunt mit 236 Stimmen. Ihre Wette: Die Modelle sind bereits schnell genug, die Schleife, die sie umgibt, ist es nicht. Was es tatsächlich ist: Bullet ist ein CLI‑Coding‑Agent — im selben Slot wie Claude Code und Codex,…
-
Google Gemini 3.7 Flash erscheint drei Wochen nach 3.6 Flash, zum halben Preis
Drei Wochen. Das ist die Lücke zwischen Gemini 3.6 Flash und Google Gemini 3.7 Flash, einem gehosteten LLM, das gezielt auf Coding-Agents und dokumentenintensive Wissensarbeit ausgerichtet ist. Kein neues Pre-Training-Durchlauf — Google sagt, die Verbesserungen resultieren aus algorithmischer Arbeit an der Kern-Reasoning-Schicht. Die Zahlen untermauern das. FrontierCode 1.1 Main springt von 34,4 %…