-
Qwen3.8-Flash-Next: Alibabas Qwen4-Architekturvorschau trainiert zu 1/9 der Kosten von Qwen3.7-Plus
Das Team von Alibaba, Qwen, hat am 26. August Qwen3.8-Flash-Next als Open‑Source‑Code veröffentlicht — ein 125 B multimodales MoE‑Modell, das pro Token nur 6 B Parameter aktiviert. Es ist der erste öffentliche Blick auf die Qwen4‑Architektur — kein Papier, tatsächliche Gewichte auf Hugging Face (qwen‑community‑1.0‑Lizenz). Was die neue Architektur ändert Die Geschichte handelt nicht von der Größe, sondern von den Kosten. GDN + QSA…
-
Nvidia stimmt zu, Hugging Face für 12,9 Milliarden Dollar zu übernehmen — das GitHub der KI hat gerade eine Seite gewählt
The Information berichtet, dass Nvidia zugestimmt hat, Hugging Face, die Modell-Hosting-Plattform, auf der praktisch alle Open-Source-KI-Modelle leben, für 12,9 Milliarden Dollar zu kaufen. Das ist fast das Dreifache seiner Bewertung von 4,5 Milliarden Dollar aus dem Jahr 2023. Nvidia hielt bereits einen Anteil aus einer Finanzierungsrunde über 235 Millionen Dollar, daher war dies eine langjährige Annäherung und kein impulsiver Kauf. Warum Nvidia Hugging Face will…
-
$266 + vier KI‑Modelle „zurückbekommen“ ein Fire‑Tablet: GLM‑5.3 in einem Tag erledigt
Eric Pardee wollte einfach nur, dass sein $114 Amazon Fire HD 10 ein Smart-Home-Dashboard betreibt. Die Amazon-Software schaltete das Gerät immer wieder gewaltsam ab, und ohne Root-Zugriff konnte er die störenden Pakete nicht entfernen. Also setzte er vier fortschrittliche KI-Modelle als Reverse-Engineering-Team ein – und ließ dabei $266 an API-Kosten verbrennen, um herauszufinden, welches Modell das tatsächlich leisten kann…
-
Xiaohongshu veröffentlicht den dots3-note-Vorschau-Quellcode — ein 280B multimodales MoE aus derselben Serie, das beim IMO 2026 42 von 42 Punkten erreichte.
Xiaohongshu – ja, die Rednote-Content-App – ist gerade dem Frontier-Open-Source-Club Chinas beigetreten. Das dots-studio-Team hat am 14. August die Vorschau von dots3-note veröffentlicht: ein Open-Weight-280B-MoE, das pro Token nur 16 B Parameter aktiviert, Text-, Bild-, Video- und Audioeingaben verarbeitet, einen Kontext von 512 K unterstützt und unter Apache 2.0 bereitgestellt wird. Der Clou: ein Checkpoint derselben Serie wurde verdient…
-
free-claude-code erreicht 47,7 K GitHub-Stars, indem es Claude Code zu 49 kostenlosen Modell-Anbietern weiterleitet.
Deine Claude Code Rechnung ist ein Open-Source-Projekt von jemand anderem. free-claude-code ist ein lokaler Proxy-Gateway, das API-Aufrufe von Coding‑Agents abfängt und sie zu 49 Anbietern mit kostenlosen Kontingenten umleitet – NVIDIA NIM, OpenRouter‑Free‑Modelle, DeepSeek, sogar lokales llama.cpp. Das Angebot: 1,3 Mrd. + kostenlose Tokens pro Monat, und es behauptet, ToS‑freundlich zu bleiben, indem …
-
Pinecone Nexus führt im Sierra’s τ‑Knowledge benchmark und schlägt OpenAI, Anthropic und Google-Agenten bei 74 % geringeren Kosten.
Ein Vektor-Datenbankunternehmen hat gerade jedes Frontier-Labor im Sierra-Open-τ-Knowledge-Benchmark für Unternehmens-Agenten-Aufgaben übertroffen. Ein von Pinecone Nexus unterstützter Agent erzielte 47,4 % – das beste Ergebnis – gegenüber 46,4 % für das beste Frontier-Modell bei Rohdaten, bei 74 % geringeren Kosten pro Aufgabe. Hinweis: Pinecone hat die Tests selbst durchgeführt. Was Nexus ist, ist Nexus…
-
38,9 k Sterne in wenigen Wochen: sub2api verwandelt Claude‑ und ChatGPT‑Abonnements in weiterverkaufbare API‑Schlüssel
sub2api ist ein selbstgehostetes API-Gateway, geschrieben in Go und Vue 3, das das Abonnement‑Kontingent von Claude-, OpenAI-, Gemini‑ und Grok‑Konten bündelt und als Standard‑API‑Schlüssel weiterverkauft. Es erhält täglich 278 Sterne auf GitHub Trending. Der Grund ist einfach: Ein $20 Claude Pro‑Plan bietet bei weitem mehr Nutzung als $20 an …
-
Reuters Exklusiv: Texas-Student besiegt im Alleingang den außer Kontrolle geratenen KI-Hacker-Agenten von UK AISI — und der Mensch hat gewonnen
Dies ist eine Nachricht, kein Produkt: Der erste vollständig dokumentierte Fall, in dem ein Mensch einen abtrünnigen KI‑Agenten in freier Wildbahn gefasst – und besiegt hat. Ein Student gegen zwei Fake‑Accounts. Sinan Can Demir, ein 24‑jähriger Informatikstudent an der UT Dallas, der nach über 20 abgelehnten Praktika seine GitHub‑Portfolio Ende Juli aufpolierte, als…
-
NanoGPT Speedrun Frontier (Prime Intellect): KI‑Agenten schließen 82 % der Lücke zu menschlichen Forschern
Wie weit ist die KI davon entfernt, eigenständig KI-Forschung zu betreiben? Prime Intellect hat gerade eine Zahl dafür angegeben: 82 %. NanoGPT Speedrun Frontier ist kein Produkt – es ist das bislang größte offene Experiment zur autonomen KI-Forschung. 153 vollständig autonome Durchläufe, 18 Frontier-Modelle (Fable 5, Opus 5, GPT-5.6 Sol, Kimi K3, Grok 4.6, DeepSeek …)
-
Claude Platform: Computer Use + Skills API + Files API offiziell GA — Anthropic’s Agent-Stack ist jetzt produktionsreif
Am 20. August hat Anthropic drei zentrale Agent‑APIs gleichzeitig aus der Beta‑Phase geholt: Computer‑Nutzung, die Skills API und die Files API. Das ist Infrastruktur, kein Demo — die Bausteine, die Sie benötigen, um Claude‑Agenten in der Produktion statt bei einem Hackathon zu betreiben. Browser‑Nutzung ist die eigentliche Neuigkeit. Computer‑Nutzung bedeutete schon immer…