knowledge-base/wiki/concepts/llm/jev-vercel-ai-gateway.md
Hector d649f2511f ingest(other): herman-briefing zu jev per stt + token-aufschluesselung
- raw: briefing-transcript (grok-stt de, 8.677 zeichen) inkl. zahlen-deckungstabelle
- wiki: jev-vercel-ai-gateway (abschnitt episodeninhalt: 4,2m input/500k output/18 cent; 200ms als verdichtung; clipping 17 highlights/1,1m token/3s; flug zrh-lhr 7,1s)
- index 223. update + log
2026-09-19 00:40:27 +02:00

110 lines
11 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
created: 2026-09-18
updated: 2026-09-18
sources: [xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md, blog/2026-09-16_vercel-jev-ai-gateway.md, other/2026-09-18_herman-briefing-jev-transcript.md]
tags: [concept, llm, jev, typesafe-ai, vercel, ai-gateway, ai-sdk, distribution, system-one-models, evaluation-models, structured-outputs]
---
# Jev auf dem Vercel AI Gateway — Verteilung statt Waitlist
> **Quelle:** Greg Isenberg ([[../../people/greg-isenberg.md|@gregisenberg]]), X-Post vom 18.09.2026 (`raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`) + Vercel-Changelog und -Modellseite vom 16.09.2026, lokal gelesen (`raw/blog/2026-09-16_vercel-jev-ai-gateway.md`). Anlass: geteilt von Pit Weber in OME Topic „JEV", 18.09.2026. Modell und Testlage selbst: [[system-one-models-jev.md]].
## Kernidee
Jev ist nicht mehr nur über TypeSafes eigene Waitlist erreichbar. Seit 16.09.2026 läuft das Modell im **[[../../institutions/vercel.md|Vercel]] AI Gateway** — also in der Routing- und Abrechnungsschicht eines Fremdanbieters. Damit ist die Ankündigungsphase des Modells beendet und die **Verteilungsphase** beginnt: nicht „wie gut ist Jev", sondern „wie kommt es in Code".
Das ist der eigentliche Neuigkeitswert des Isenberg-Posts. Seine Beschreibung des Modells („it sorts, it doesn't write back") ist korrekt, aber die substanzielle Information steckt in zwei Nebensätzen: *live on the Vercel AI Gateway* und *skip the waitlist*.
## Technischer Zugang (lokal verifiziert, 18.09.2026)
| Feld | Wert |
|------|------|
| Modell-ID | `typesafe-ai/jev` |
| Zugang | Vercel AI Gateway, AI SDK **7.0.105+** (`experimental evaluate` API) |
| Frage-Typen | **Choice** (Option wählen), **Score** (Rubrik bewerten), **Boolean** (Wahrscheinlichkeit für „true") |
| Eingabe | ein gemeinsames `state` (String, Objekt oder Array) + Map benannter `questions` |
| Ausgabe | typisierte Antworten mit Wahrscheinlichkeiten; Question-IDs und Choice-Keys bleiben erhalten; getrennte Confidence für Choice und Score unter `result.providerMetadata.typesafe.confidence` |
| Latenz-/Kostenangaben | 70500 ms, $0,042/MTok Input, Output $0 (TypeSafe-Angabe, siehe [[system-one-models-jev.md]]) |
| Preis auf der Gateway-Seite | **$0,04 / 1 Mio. Input-Token** — gerundete Anzeige, zwei Nachkommastellen |
| Datenschutz-Optionen | **Zero Data Retention** und **No Training**, pro Request über `providerOptions.gateway` |
| Abrechnung | Auswertungen erscheinen in Logs/Custom Reporting und zählen gegen Gateway-Budgets |
Beispiel der Anbieterseite: ein Support-Fall wird in drei Fragen zerlegt — Queue, Priority, Refund-Review; unsichere Fälle gehen ins manuelle Review. Der Satz, der die ganze Produktkategorie zusammenfasst, steht im Vercel-Changelog: „automate clear cases while routing uncertain ones to review".
Der Gateway-Auftritt kostet TypeSafe nichts an Kontrolle, aber er verschiebt die Bezahl- und Log-Schicht zu Vercel. Wer Jev über den Gateway ruft, hat Vercel im Datenpfad — mit ZDR als Option, nicht als Default.
## Die sieben Geschäftsideen des Posts — was daran Jev ist
Isenberg listet Anwendungen, die sich alle als Frage an ein Entscheidungsmodell formulieren lassen. Die Grenze verläuft nicht zwischen den Ideen, sondern innerhalb jeder Idee: Jev **sortiert**, es **arbeitet nicht**.
| # | Idee des Posts | Einordnung |
|---|----------------|------------|
| 1 | „Instant Quotes" unter einer Sekunde (Dachdecker, Umzüge, Versicherung, Legal Intake) | Entspricht einer Score-/Choice-Frage über Formulardaten; der eigentliche Aufwand bleibt das Preiswerk und die Haftung, nicht die Klassifikation |
| 2 | Lead Scoring als Produkt — echte Anfragen aufs Handy des Inhabers | Klassischer Fall, deckt sich mit TypeSafes eigenem Muster |
| 3 | Support-Triage ohne Support-Team | Deckt sich mit dem dokumentierten **Intent-Routing**-Muster von TypeSafe (`docs.typesafe.ai/patterns/intent-routing`) |
| 4 | Clipping: bester Moment aus einem Transcript in Sekunden bewertet | Als **Score**-Frage plausibel; „bester Moment" ist eine Rubrik, kein Text |
| 5 | Bewerbungs-/Antragsstapel (Grants, Permits, Claims, Kredite) | Reichweitenstärkster Fall und der mit dem größten Fehlerpreis — hier zählt Kalibrierung, nicht Tempo |
| 6 | Marketplace-Matching statt Rückruf | Plausibel als Klassifikation gegen ein Verzeichnis |
| 7 | „Browser agents that actually move FAST" | **Teilweise am Produkt vorbei:** Jev beschleunigt die Entscheidung, nicht das Browsen. Der Flaschenhals dieser Idee liegt in der Browser-Schicht, nicht im Entscheidungsmodell |
Die Formel des Posts — „find an expensive queue and put Jev at the front of it" — ist eine brauchbare Heuristik, aber sie beschreibt nur die halbe Arbeit. Vor jede Warteschlange gehört ein Gate, hinter jede Entscheidung eine Eskalation. Genau dafür liefert das Gateway die Confidence-Werte, und genau deshalb ist die Kalibrierung die entscheidende Eigenschaft (siehe [[system-one-models-jev.md|Merksatz: Type-Safety ist keine Wahrheitsgarantie]]).
## Episodeninhalt (Briefing-Transkript, 18.09.2026)
Die Episode selbst wurde erst über ein **deutsches Audio-Briefing** (09:42) zugänglich, das Kai in OME Topic „JEV" postete; das Briefing liegt als STT-Transkript vor (`raw/other/2026-09-18_herman-briefing-jev-transcript.md`). Es ist die Zusammenfassung eines Dritten — nicht das Originalvideo —, liefert aber erstmals die **Token-Aufschlüsselung** zur bekannten Zahl:
| Angabe im Briefing | Bewertung |
|--------------------|-----------|
| 1.700 E-Mails · **4,2 Mio. Input-Token · 500k Output-Token · 18 US-Cent** | ✅ deckt sich mit der Messung aus dem Quellvideo; die Aufschlüsselung fehlte bisher. Gegenrechnung: 4,2 Mio. × $0,042 = **$0,176** — die 18 Cent sind plausibel, die „~$0,16" aus einer automatisch erzeugten Videobeschreibung ist eine Rundungs-/Verschleifvariante |
| rund **200 ms** pro Anfrage | ⚠️ Briefing-Angabe; TypeSafe nennt eine Spanne von **70500 ms** — die 200 ms sind eine Verdichtung, kein Messwert |
| **17 Highlights aus 1,1 Mio. Token in ~3 s** (Clipping-Test) | ⚠️ nur im Briefing; im X-Post nicht genannt |
| **Flug Zürich → London buchen in 7,1 s**; herkömmliche Agenten 13 min | ⚠️ nur im Briefing, ohne Messaufbau |
| Lead-Score 01, „Lead mit 98 % Qualität" | ⚠️ illustrativer Anwendungsfall |
| Zugang über „Vessel Gateway" | ✅ gemeint ist der **Vercel AI Gateway** (STT-Fehler), Zugang lokal verifiziert |
| „etwa 1/1.000 Cent pro Test" (Begleittext) | im Briefing-Wortlaut **nicht** gefunden, nicht bestätigt |
**Die eigentliche These des Briefings** ist der Schluss: Wenn jede Alltagsentscheidung in Millisekunden fällt, verschiebt sich menschliche Arbeit „zu 100 % auf das Design der Aufgabenstruktur" — man sichtet keine Informationen mehr, sondern definiert das **Schema**. Das ist die klarste Formulierung des Produktversprechens: nicht Antworten, sondern **Kategorien-Design**.
## Einordnung: Distribution als eigene Produktphase
- **Gateway statt SDK-Wettbewerb.** TypeSafe verkauft kein Harness, sondern ein Modell — und verteilt es über die Schicht, die andere Harnesses ohnehin schon benutzen. Das ist der schnellste Weg in fremden Code, ohne eigene Developer-Relations-Maschine.
- **Wiederverwendung einer bestehenden Bezahlgrenze.** Budgets, Logs, ZDR-Schalter: Der Gateway bringt Kostenkontrolle und Compliance-Rahmen mit. Für die Freigrenze „Checks sind so billig, dass man sie laufend macht" (siehe [[../agents/agent-budget-breaker.md|Kostendeckel]]) ist das die passende Infrastruktur.
- **Der Influencer-Post als Verteilkanal.** Ein Startup-Ideen-Kanal mit 712.496 Followern erklärt ein Infrastrukturprodukt über Geschäftsideen. Das ist wirksamer als jede Benchmark-Tabelle, verschiebt aber die Wahrnehmung: Jev wird als Baukasten für Firmen gelesen, nicht als Entscheidungsschicht für Software.
- **Zweiter Zugangsweg, zweite Preisangabe.** Die Waitlist-Story stammt aus der Ankündigung, der Gateway-Zugang ist jünger. Beide Preise ($0,042 bzw. $0,04) bezeichnen dasselbe, nur mit unterschiedlicher Rundung — ein Detail, das bei Kostenrechnung über Milliarden Tokens dann doch zählt.
## Quellenkritik
- ⚠️ **„1.700 E-Mails für 18 Cent"** steht im Post ohne Token-Aufschlüsselung, Datensatz oder Messung. Die Größenordnung passt zur TypeSafe-Preislogik ($0,042/MTok), die Zahl selbst ist aber zweit- bis dritthändig (Briefing-Transkript nennt 4,2 Mio. Input- + 500k Output-Token; 4,2 Mio. × $0,042 = $0,176).
- ⚠️ **„94 % sicher"** ist ein Illustrationswert für Kalibrierung, kein Messergebnis.
- ⚠️ **193,6×/444,6×** übernimmt Vercel ausdrücklich als TypeSafe-Angabe („TypeSafe reports"), nicht als eigene Messung.
- ⚠️ **Interessenlage des Posts:** Isenberg verdient an Startups und Aufmerksamkeit; der Post hat Funnel-Struktur („at the end I'll tell you how") und endet in einem Podcast-Verweis. Er ist Verteilung, nicht Prüfung — die einzige unabhängige Messung bleibt der Every-Einzeltest.
-**Lokal verifiziert:** Gateway-Modellseite und Changelog liefern beide HTTP 200 mit auswertbarem Inhalt; Modell-ID, Preisangabe, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort.
## Offene Punkte
- Kein Nachweis, dass der Gateway-Preis dem Direkt-API-Preis entspricht (oder ob Vercel einen Aufschlag nimmt) — auf beiden Seiten nicht ausgewiesen.
- Keine Angaben zu Rate Limits, SLA und Regionen für Jev auf dem Gateway.
- Ob die Episode ([[../../people/ryan-vogel.md|Ryan Vogel]] als Gast) eigene Messungen enthält, ist nicht geprüft; das Video-Transkript wurde nicht ausgewertet.
- Offen, wie viele Fragen pro Request praktisch parallel möglich sind — die Kostenrechnung hängt daran.
## Verwandte Wiki-Seiten
- [[system-one-models-jev.md]] — Modell, RLCD, Testlage, Zahlenkritik
- [[../../institutions/typesafe-ai.md]] — Anbieter, Team, Manifesto
- [[../../institutions/vercel.md]] — Gateway-Betreiber
- [[../../people/greg-isenberg.md]] — Autor des Posts
- [[../../people/ryan-vogel.md]] — Gast der Episode
- [[../../people/matthew-berman.md]] — bündelte die Demo-Welle zum selben Thema
- [[jev-praxis-demos.md]] — Demo-Welle und Belastbarkeit
- [[llm-model-catalog.md]] — Modellkatalog
- [[harness-vs-standalone-chat-llm.md]] — Gate vs. Generierung
- [[../agents/agent-budget-breaker.md]] — Kostendeckel für unbewachte Schleifen
- [[../agents/ai-agents-2026.md]] — Agent-Use-Cases
## Quellen
- [X-Post @gregisenberg](https://x.com/gregisenberg/status/2101018750916948237) (18.09.2026, 18:41 UTC; 29.661 Views / 415 Likes bei Abruf 21:31 UTC)
- [YouTube: „Jev is HERE. How to use it"](https://www.youtube.com/watch?v=4mTLpuQpB80) (Kanal Greg Isenberg; Beschreibung lokal nicht auswertbar)
- [Vercel AI Gateway — Jev](https://vercel.com/ai-gateway/models/jev) (modell-ID, Preis, Beispielcode)
- [Vercel Changelog: TypeSafe AI's Jev now available on AI Gateway](https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway) (16.09.2026, Taneja/Chen/Zheng)
- Raw: `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`, `raw/blog/2026-09-16_vercel-jev-ai-gateway.md`