Meta hat Emu eingestellt. Die ersten Mediengenerierungs-Modelle von Superintelligence Labs – der Organisation, die Alexandr Wang leitet – heißen Muse Image und Muse Video und sind ganz anders als die Llama-Ära-Werkzeuge, die sie ersetzen.
Bildgenerierung, die wie ein Agent agiert
Muse Image ist nicht einfach Prompt-zu-Bild. Es arbeitet agentisch: Es ruft Such- und Code-Tools auf, um Fakten zu prüfen, kontrolliert und korrigiert seine eigene Ausgabe selbst und verbraucht Test-Rechenzeit, um die Qualität zu erhöhen. Es holt sogar Kontext von Ihrem Instagram, sodass „Mach ein Poster für mein Café“ weiß, wie Ihr Café aussieht. In Metas internen Bearbeitungstests schlägt es Nano Banana 2, liegt aber noch hinter OpenAI’s GPT Image 2.
Es ist heute in der Meta AI-App, meta.ai, US-Instagram-Stories und WhatsApp in einigen Ländern verfügbar. Facebook folgt als Nächstes.
Video mit nativer Audio
Muse Video läuft auf derselben Vortrainings-Basis und erzeugt Sound nativ – ohne separaten Audio-Durchlauf. Es belegt Platz 3 im menschlichen Präferenz-Elo auf der Arena Text-zu-Video-Rangliste, hinter Veo, ist aber im echten Wettbewerb.
Der Punkt: Das ist das erste Mal, dass Meta einen Bild-und-Video-Stack hat, der tatsächlich mit Nano Banana und Sora mithalten kann, anstatt nur von der Bank aus zuzusehen.