Tencent hat Hunyuan Hy3 am 6. Juli als Open‑Source veröffentlicht: ein 295B MoE‑Sprachmodell, das pro Token nur 21B Parameter aktiviert, mit 256K Kontext und einem Schnell/Langsam‑Denken‑Schalter. Apache 2.0, keine geografischen Ausnahmen. Die Gewichte sind auf GitHub, HuggingFace und ModelScope verfügbar.
Die Schlagzeile: GLM‑5.2‑Klassen‑Ergebnisse bei halber Größe. Hy3 erzielt 90,4 bei GPQA Diamond und gewinnt fast jeden Non‑Coding‑Benchmark, verliert jedoch SWE‑Bench Verified 78,0 gegen 84,2. Tencent gibt an, dass die Aufgabenerfüllung von Agenten in den eigenen Apps 90 % erreicht — Yuanbao, CodeBuddy und ima laufen bereits darauf. Die Halluzinationsrate sank von 12,5 % auf 5,4 % gegenüber der vorherigen Generation.
API‑Zugang und Preisgestaltung
Selbst‑hosten Sie die Gewichte oder nutzen Sie die API von Tencent Cloud für etwa 0,15 $ pro Million Eingabe‑Token und 0,59 $ für die Ausgabe. OpenRouter stellt sie bis zum 21. Juli kostenlos bereit. Am besten geeignet: Lang‑Kontext‑Agent‑Workloads und Tool‑Calling‑Pipelines, bei denen die Preisgestaltung von Frontier‑Modellen nicht rentabel ist.
Warum das wichtig ist
Die Hälfte der Parameter bedeutet etwa die Hälfte der Bereitstellungskosten bei gleicher Qualität — das ist derzeit der eigentliche Wettstreit im chinesischen Open‑Source‑Bereich. Wenn Ihre Agenten nicht den ganzen Tag Code schreiben, ist Hy3 jetzt kaum noch zu übersehen.