Speko (YC S26) — OpenRouter für Voice AI: 61 Modelle benchmarked, Nutzung um 25 % pro Woche gestiegen

18. August 2026, 00:09

Stripe hat gerade über $7 Mrd+ für OpenRouter bezahlt. Spekos Wette: dieselbe Routing‑Layer‑Strategie, aber für Sprache. Sein Launch HN traf diese Woche die Titelseite.

Eine API für mehr als 15 Sprach-Anbieter

Speko ist ein API‑Gateway, das jeden Aufruf über mehr als 15 STT‑, TTS‑ und Voice-to-Voice‑Anbieter — ElevenLabs, OpenAI, Cartesia, Deepgram, Rime, Hume — leitet und das beste Modell für Ihre Sprache, Latenz, Kosten oder Genauigkeitsziel auswählt. Gründer Beknazar Abdikamalov verbrachte vier Jahre damit, Sprach‑Agenten in über 10 Sprachen in Asien zu bauen, wo die Modellqualität stark schwankt und niemand jedes Quartal neu benchmarkt.

Die API ist das Produkt

Ein einheitlicher Endpunkt plus ein TypeScript‑SDK: Deklarieren Sie eine Einschränkung (Genauigkeit, Latenz, Kosten oder ausgewogen), Speko gibt den Sieger‑Anbieter in den Response‑Headern zurück, mit serverseitigem Failover. Sitzungs‑Pläne werden vorab geladen, sodass das Routing während eines Anrufs keine zusätzlichen Round‑Trips verursacht. Das Gateway ist MIT‑Open‑Source; der gehostete Router ist die kostenpflichtige Stufe. Ein medizinisches Team stellte fest, dass die STT‑Wortfehlerraten bei den Anbietern zwischen 8 % und 19 % lagen.

Warum die Daten der Burggraben sind

Kontinuierliche Benchmarks von 61 Sprach‑Modellen in 10 Sprachen, offen veröffentlicht — einschließlich Fällen, in denen ihr Router die falsche Wahl traf. Spitzen‑Modelle erreichten 94 % Turn‑Taking‑Genauigkeit gegenüber 46,9 % für einfache VAD‑Timer. Die Nutzung ist seit Ende Juni wöchentlich um etwa 25 % gestiegen. HN‑Skeptiker sagen, End‑to‑End‑Sprach‑Modelle würden die Kaskade zerstören; Enterprise‑Betreiber entgegnen, dass 95 % der Produktions‑Sprache noch kaskadiert werden. So oder so muss jemand die Punkte zählen.