knowledge-base/wiki/concepts/llm/jev-vercel-ai-gateway.md
Hector b4061888d1 ingest(xpost): jev auf dem vercel ai gateway + isenberg-geschaeftsideen
- raw: gregisenberg-post (18.09.2026) + vercel changelog/modellseite (16.09.2026, lokal gelesen)
- wiki neu: concepts/llm/jev-vercel-ai-gateway, institutions/vercel, people/greg-isenberg, people/ryan-vogel
- wiki update: system-one-models-jev (verteilungs-abschnitt), typesafe-ai (distribution), llm-model-catalog
- index 220. update + log
2026-09-18 23:33:24 +02:00

8.9 KiB
Raw Blame History

created updated sources tags
2026-09-18 2026-09-18
xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md
blog/2026-09-16_vercel-jev-ai-gateway.md
concept
llm
jev
typesafe-ai
vercel
ai-gateway
ai-sdk
distribution
system-one-models
evaluation-models
structured-outputs

Jev auf dem Vercel AI Gateway — Verteilung statt Waitlist

Quelle: Greg Isenberg (../../people/greg-isenberg.md), X-Post vom 18.09.2026 (raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md) + Vercel-Changelog und -Modellseite vom 16.09.2026, lokal gelesen (raw/blog/2026-09-16_vercel-jev-ai-gateway.md). Anlass: geteilt von Pit Weber in OME Topic „JEV", 18.09.2026. Modell und Testlage selbst: system-one-models-jev.md.

Kernidee

Jev ist nicht mehr nur über TypeSafes eigene Waitlist erreichbar. Seit 16.09.2026 läuft das Modell im ../../institutions/vercel.md AI Gateway — also in der Routing- und Abrechnungsschicht eines Fremdanbieters. Damit ist die Ankündigungsphase des Modells beendet und die Verteilungsphase beginnt: nicht „wie gut ist Jev", sondern „wie kommt es in Code".

Das ist der eigentliche Neuigkeitswert des Isenberg-Posts. Seine Beschreibung des Modells („it sorts, it doesn't write back") ist korrekt, aber die substanzielle Information steckt in zwei Nebensätzen: live on the Vercel AI Gateway und skip the waitlist.

Technischer Zugang (lokal verifiziert, 18.09.2026)

Feld Wert
Modell-ID typesafe-ai/jev
Zugang Vercel AI Gateway, AI SDK 7.0.105+ (experimental evaluate API)
Frage-Typen Choice (Option wählen), Score (Rubrik bewerten), Boolean (Wahrscheinlichkeit für „true")
Eingabe ein gemeinsames state (String, Objekt oder Array) + Map benannter questions
Ausgabe typisierte Antworten mit Wahrscheinlichkeiten; Question-IDs und Choice-Keys bleiben erhalten; getrennte Confidence für Choice und Score unter result.providerMetadata.typesafe.confidence
Latenz-/Kostenangaben 70500 ms, $0,042/MTok Input, Output $0 (TypeSafe-Angabe, siehe system-one-models-jev.md)
Preis auf der Gateway-Seite $0,04 / 1 Mio. Input-Token — gerundete Anzeige, zwei Nachkommastellen
Datenschutz-Optionen Zero Data Retention und No Training, pro Request über providerOptions.gateway
Abrechnung Auswertungen erscheinen in Logs/Custom Reporting und zählen gegen Gateway-Budgets

Beispiel der Anbieterseite: ein Support-Fall wird in drei Fragen zerlegt — Queue, Priority, Refund-Review; unsichere Fälle gehen ins manuelle Review. Der Satz, der die ganze Produktkategorie zusammenfasst, steht im Vercel-Changelog: „automate clear cases while routing uncertain ones to review".

Der Gateway-Auftritt kostet TypeSafe nichts an Kontrolle, aber er verschiebt die Bezahl- und Log-Schicht zu Vercel. Wer Jev über den Gateway ruft, hat Vercel im Datenpfad — mit ZDR als Option, nicht als Default.

Die sieben Geschäftsideen des Posts — was daran Jev ist

Isenberg listet Anwendungen, die sich alle als Frage an ein Entscheidungsmodell formulieren lassen. Die Grenze verläuft nicht zwischen den Ideen, sondern innerhalb jeder Idee: Jev sortiert, es arbeitet nicht.

# Idee des Posts Einordnung
1 „Instant Quotes" unter einer Sekunde (Dachdecker, Umzüge, Versicherung, Legal Intake) Entspricht einer Score-/Choice-Frage über Formulardaten; der eigentliche Aufwand bleibt das Preiswerk und die Haftung, nicht die Klassifikation
2 Lead Scoring als Produkt — echte Anfragen aufs Handy des Inhabers Klassischer Fall, deckt sich mit TypeSafes eigenem Muster
3 Support-Triage ohne Support-Team Deckt sich mit dem dokumentierten Intent-Routing-Muster von TypeSafe (docs.typesafe.ai/patterns/intent-routing)
4 Clipping: bester Moment aus einem Transcript in Sekunden bewertet Als Score-Frage plausibel; „bester Moment" ist eine Rubrik, kein Text
5 Bewerbungs-/Antragsstapel (Grants, Permits, Claims, Kredite) Reichweitenstärkster Fall und der mit dem größten Fehlerpreis — hier zählt Kalibrierung, nicht Tempo
6 Marketplace-Matching statt Rückruf Plausibel als Klassifikation gegen ein Verzeichnis
7 „Browser agents that actually move FAST" Teilweise am Produkt vorbei: Jev beschleunigt die Entscheidung, nicht das Browsen. Der Flaschenhals dieser Idee liegt in der Browser-Schicht, nicht im Entscheidungsmodell

Die Formel des Posts — „find an expensive queue and put Jev at the front of it" — ist eine brauchbare Heuristik, aber sie beschreibt nur die halbe Arbeit. Vor jede Warteschlange gehört ein Gate, hinter jede Entscheidung eine Eskalation. Genau dafür liefert das Gateway die Confidence-Werte, und genau deshalb ist die Kalibrierung die entscheidende Eigenschaft (siehe system-one-models-jev.md).

Einordnung: Distribution als eigene Produktphase

  • Gateway statt SDK-Wettbewerb. TypeSafe verkauft kein Harness, sondern ein Modell — und verteilt es über die Schicht, die andere Harnesses ohnehin schon benutzen. Das ist der schnellste Weg in fremden Code, ohne eigene Developer-Relations-Maschine.
  • Wiederverwendung einer bestehenden Bezahlgrenze. Budgets, Logs, ZDR-Schalter: Der Gateway bringt Kostenkontrolle und Compliance-Rahmen mit. Für die Freigrenze „Checks sind so billig, dass man sie laufend macht" (siehe ../agents/agent-budget-breaker.md) ist das die passende Infrastruktur.
  • Der Influencer-Post als Verteilkanal. Ein Startup-Ideen-Kanal mit 712.496 Followern erklärt ein Infrastrukturprodukt über Geschäftsideen. Das ist wirksamer als jede Benchmark-Tabelle, verschiebt aber die Wahrnehmung: Jev wird als Baukasten für Firmen gelesen, nicht als Entscheidungsschicht für Software.
  • Zweiter Zugangsweg, zweite Preisangabe. Die Waitlist-Story stammt aus der Ankündigung, der Gateway-Zugang ist jünger. Beide Preise ($0,042 bzw. $0,04) bezeichnen dasselbe, nur mit unterschiedlicher Rundung — ein Detail, das bei Kostenrechnung über Milliarden Tokens dann doch zählt.

Quellenkritik

  • ⚠️ „1.700 E-Mails für 18 Cent" steht im Post ohne Token-Aufschlüsselung, Datensatz oder Messung. Die Größenordnung passt zur TypeSafe-Preislogik ($0,042/MTok), die Zahl selbst ist aber zweit- bis dritthändig (externe Angabe: 4,2 Mio. Input- + 500k Output-Token).
  • ⚠️ „94 % sicher" ist ein Illustrationswert für Kalibrierung, kein Messergebnis.
  • ⚠️ 193,6×/444,6× übernimmt Vercel ausdrücklich als TypeSafe-Angabe („TypeSafe reports"), nicht als eigene Messung.
  • ⚠️ Interessenlage des Posts: Isenberg verdient an Startups und Aufmerksamkeit; der Post hat Funnel-Struktur („at the end I'll tell you how") und endet in einem Podcast-Verweis. Er ist Verteilung, nicht Prüfung — die einzige unabhängige Messung bleibt der Every-Einzeltest.
  • Lokal verifiziert: Gateway-Modellseite und Changelog liefern beide HTTP 200 mit auswertbarem Inhalt; Modell-ID, Preisangabe, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort.

Offene Punkte

  • Kein Nachweis, dass der Gateway-Preis dem Direkt-API-Preis entspricht (oder ob Vercel einen Aufschlag nimmt) — auf beiden Seiten nicht ausgewiesen.
  • Keine Angaben zu Rate Limits, SLA und Regionen für Jev auf dem Gateway.
  • Ob die Episode (../../people/ryan-vogel.md als Gast) eigene Messungen enthält, ist nicht geprüft; das Video-Transkript wurde nicht ausgewertet.
  • Offen, wie viele Fragen pro Request praktisch parallel möglich sind — die Kostenrechnung hängt daran.

Verwandte Wiki-Seiten

Quellen