From b4061888d14e9dd158710e78853d8c4c38d78c1d Mon Sep 17 00:00:00 2001 From: Hector Date: Fri, 18 Sep 2026 23:33:24 +0200 Subject: [PATCH] ingest(xpost): jev auf dem vercel ai gateway + isenberg-geschaeftsideen - raw: gregisenberg-post (18.09.2026) + vercel changelog/modellseite (16.09.2026, lokal gelesen) - wiki neu: concepts/llm/jev-vercel-ai-gateway, institutions/vercel, people/greg-isenberg, people/ryan-vogel - wiki update: system-one-models-jev (verteilungs-abschnitt), typesafe-ai (distribution), llm-model-catalog - index 220. update + log --- raw/blog/2026-09-16_vercel-jev-ai-gateway.md | 47 ++++++++++ ...6-09-18_gregisenberg-jev-vercel-gateway.md | 91 ++++++++++++++++++ wiki/concepts/llm/jev-vercel-ai-gateway.md | 92 +++++++++++++++++++ wiki/concepts/llm/llm-model-catalog.md | 5 +- wiki/concepts/llm/system-one-models-jev.md | 18 +++- wiki/index.md | 19 ++-- wiki/institutions/typesafe-ai.md | 8 +- wiki/institutions/vercel.md | 46 ++++++++++ wiki/log.md | 24 +++++ wiki/people/greg-isenberg.md | 36 ++++++++ wiki/people/ryan-vogel.md | 27 ++++++ 11 files changed, 401 insertions(+), 12 deletions(-) create mode 100644 raw/blog/2026-09-16_vercel-jev-ai-gateway.md create mode 100644 raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md create mode 100644 wiki/concepts/llm/jev-vercel-ai-gateway.md create mode 100644 wiki/institutions/vercel.md create mode 100644 wiki/people/greg-isenberg.md create mode 100644 wiki/people/ryan-vogel.md diff --git a/raw/blog/2026-09-16_vercel-jev-ai-gateway.md b/raw/blog/2026-09-16_vercel-jev-ai-gateway.md new file mode 100644 index 0000000..7a85356 --- /dev/null +++ b/raw/blog/2026-09-16_vercel-jev-ai-gateway.md @@ -0,0 +1,47 @@ +--- +type: blog +source_url: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway +retrieved: 2026-09-18 +title: "TypeSafe AI's Jev now available on AI Gateway" +author: "Rohan Taneja, Zachary Chen, Jerilyn Zheng (Vercel)" +tags: [jev, typesafe-ai, vercel, ai-gateway, ai-sdk, structured-outputs, zdr, evaluation-models] +--- + +# Vercel: Jev auf dem AI Gateway (Changelog 16.09.2026) + +Primärartefakt der Anbieter-Seite Vercel (nicht TypeSafe). Zwei Seiten lokal abgerufen und ausgewertet (18.09.2026): + +- Changelog: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway — „Blog Changelog", datiert **16 Sep 2026**, Autoren **Rohan Taneja, Zachary Chen, Jerilyn Zheng**, „2 min read" +- Modellseite: https://vercel.com/ai-gateway/models/jev — Titel „Jev API, Pricing & Playground | Vercel AI Gateway" + +## Fakten der Modellseite + +- **Modell-ID des Gateways:** `typesafe-ai/jev` +- **Einordnung (Wortlaut):** „Jev is TypeSafe AI's System One evaluation model for fast, structured decisions in software. It evaluates shared state against typed questions and returns choices, scores, and boolean probabilities, supporting classification, routing, rubric-based assessment, and automated verification. Multiple questions can be evaluated in parallel within a single request." +- **Preis (Modellseite):** „Input $0.04, Per 1M tokens" — **$0,04 pro 1 Mio. Input-Token**, gerundete Anzeige. Keine Output-Preiszeile (entspricht „Output kostenlos"). +- **Provider-Tabelle:** ein Anbieter (TypeSafe AI), 7 Spalten; Zeile „TypeSafe AI", Input **$0.04/M**, **Release Date 09/15/2026**; Rechtshinweis „Legal: Terms • Privacy"; Hinweis „Your use is subject to TypeSafe AI's Terms & Privacy Policies." +- **Beispielcode der Seite:** `import { experimental_evaluate as evaluate } from 'ai';` mit `model: 'typesafe-ai/jev'`, `state` (String) und `questions: { refunded: { type: 'boolean', instructions: 'Was a refund issued?' } }`. + +## Fakten des Changelog-Eintrags + +- Jev ist ab dem 16.09.2026 über das AI Gateway nutzbar (Modell-Release laut Provider-Zeile: 15.09.2026). +- Beschreibung: „state goes in, typed **Choice, Score, and Boolean** answers come out" — im Gegensatz zu LLMs, die „generate text one token at a time, which the application then parses and validates". Jev werte „all declared questions in parallel" aus und liefere typisierte Antworten plus Wahrscheinlichkeiten direkt. +- Zweckformulierung: „makes it straightforward to automate clear cases while routing uncertain ones to review." +- **Leistungszahlen:** „TypeSafe reports Jev was up to **193.6x faster** and **444.6x cheaper** than LLMs on its workflow evaluations." (explizit als TypeSafe-Angabe gekennzeichnet, übernommen aus der TypeSafe-Primärquelle) +- **Genannte Anwendungsfälle:** nächsten Tool- oder Subagenten im Agent-Loop wählen; entscheiden, ob fortgesetzt, erneut versucht, der Nutzer gefragt oder abgebrochen wird; Dringlichkeit/Risiko vor einer Aktion bewerten; Modell-Ausgaben verifizieren und Guardrails durchsetzen. +- **Zugriffsweg:** AI SDK **7.0.105 oder neuer**, `experimental evaluate` API (`pnpm add ai@latest`). Parameter je Auswertung: `model`, `state` (String, Objekt oder Array), `questions` (Map benannter Entscheidungen). +- **Antwortform:** Ergebnis behält Question-IDs und Choice-Keys; „TypeSafe reports separate Choice and Score confidence in `result.providerMetadata.typesafe.confidence`." Empfehlung der Seite: Kalibrierung an gelabelten Beispielen des eigenen Workflows prüfen. +- **Datenschutz/Kosten:** Jev unterstützt **Zero Data Retention** und **No Training**, pro Request aktivierbar über `providerOptions.gateway.zeroDataRetention` (Beispielcode setzt `zeroDataRetention: true`). Auswertungen erscheinen in Logs und Custom Reporting, zählen gegen Budgets des Gateways. +- Beispiel im Changelog: ein Support-Fall wird in **Queue, Priority und Refund-Review**-Entscheidung übersetzt, unsichere Fälle gehen ins manuelle Review. + +## Lokale Verifikation + +- Beide Seiten lieferten HTTP 200 mit auswertbarem Text (669.985 bzw. 445.689 Byte HTML; Text 3.444 bzw. 4.704 Zeichen nach Skript-/Markup-Entfernung). +- Der Preis erscheint auf der Modellseite als `$0.04` (zwei Nachkommastellen), die TypeSafe-Primärquelle nennt `$0,042`. Die Gateway-Seite rundet die Anzeige; kein Widerspruch, aber auch kein Gateway-eigener Nachweis der vierstelligen Genauigkeit. +- Ein **Soft-404-Test** auf `vercel.com`-Pfade war nicht Teil dieser Prüfung; der Test auf `typesafe.ai` ergab differenzierte Antworten (nicht identische Byte-Größe), daher kein SPA-Hull-Befund. + +## Offene Punkte + +- Keine unabhängige Messung der Gateway-Latenz; die 193,6×/444,6×-Angaben sind als TypeSafe-Zahlen gekennzeichnet und werden nur weitergegeben. +- Ob der Gateway-Preis identisch mit dem Direkt-API-Preis ist (und ob Vercel einen Aufschlag nimmt), ist auf beiden Seiten nicht ausgewiesen. +- Ob es ein SLA, Rate Limits oder Region-Beschränkungen für Jev auf dem Gateway gibt, ist auf den beiden Seiten nicht dokumentiert. diff --git a/raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md b/raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md new file mode 100644 index 0000000..35c359a --- /dev/null +++ b/raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md @@ -0,0 +1,91 @@ +--- +type: xpost +source_url: https://x.com/gregisenberg/status/2101018750916948237 +retrieved: 2026-09-18 +author: "@gregisenberg" +is_thread: false +quote_count: +tags: [jev, typesafe-ai, vercel, ai-gateway, system-one-models, distribution, startup-ideas, business-ideas] +--- + +# Greg Isenberg: „Jev is HERE" — Jev auf dem Vercel AI Gateway (18.09.2026) + +## Post (Wortlaut, vollständig) + +> Jev is HERE and this is the CLEAREST explanation of what it is and what NEW businesses it unlocks. +> +> (and at the end I'll tell you how to get Jev even if you're on the waitlist) +> +> WHAT IT IS +> +> You know how you open your inbox and have to decide what's junk, what needs a reply, and what can wait? Jev does that part. It looks at each thing and says "this is junk, I'm 94% sure." +> +> It doesn't write anything back to you. It just sorts. +> +> 1,700 emails for 18 cents, instantly. +> +> That sounds kinda trivial but the important part +> +> WHAT IT UNLOCKS +> +> My explanation of Jev sounds small until you realize HOW MANY jobs are exactly this. Someone reading a stack of applications. Someone deciding which support ticket goes to which team. Someone looking at inbound and deciding who's worth calling back. +> +> A few ideas on what it unlocks: +> +> 1/ Instant quotes that are actually instant. Every quote form on the internet says "we'll email you by end of day." Build the version that answers in under a second, for roofers, movers, insurance, legal intake. +> +> 2/ Lead scoring as a product. Every agency and service business has a contact form full of junk. Score every submission and send the real ones straight to the owner's phone. +> +> 3/ Support triage for companies with no support team. The ticket gets classified and routed before anyone opens it. +> +> 4/ Clipping tools. Pass in a transcript, get the best moments scored in three seconds. Every clipping product just got a cheaper engine. +> +> 5/ Application piles. Grants, permits, insurance claims, job apps, loan docs. Someone reads that stack one item at a time today. +> +> 6/ Marketplace matching. Someone types what they need and gets matched to the right local business instantly instead of waiting for callbacks. +> +> 7/ Browser agents that actually move FAST. That makes bulk browser work practical: pulling quotes from five carriers, filing the same form for 200 clients, checking supplier inventory in real time etc. +> +> TLDR; find an expensive queue and put Jev at the front of it. +> +> HOW TO GET IT +> +> I didn't realize you can skip the waitlist because Jev is live on the Vercel AI Gateway right now, so you can start calling it today. In this episode, we share how. +> +> Episode now live on @startupideaspod (thanks to @ryanvogel for coming on and spilling the sauce today) +> +> Watch: https://www.youtube.com/watch?v=4mTLpuQpB80 +> +> Jev is a big deal because this is a whole new way to do AI +> +> Really cool +> +> Happy Jev day. + +## Post-Metadaten + +- **URL:** https://x.com/gregisenberg/status/2101018750916948237 (Original-Link mit `?s=20` geteilt von Pit Weber in OME Topic „JEV", 18.09.2026 21:29:45 UTC) +- **Autor:** GREG ISENBERG ([@gregisenberg](https://x.com/gregisenberg), 712.496 Follower, X-Konto seit 03.05.2008; Bio: „I drop startup ideas daily. Host @startupideaspod. CEO: @latecheckoutplz we build companies like @ideabrowser, @meetLCA, @boringmarketer etc"; Website https://gregisenberg.com/) +- **Erstellt:** 2026-09-18 18:41:19 UTC (20:41 CEST) — also ~2 h 48 min vor dem Teilen in der Gruppe +- **Länge:** 2.430 Zeichen; Einzelpost, kein Thread (`is_thread` nicht gesetzt) +- **Engagement (Abruf 18.09.2026 ~21:31 UTC via fxtwitter-API):** 29.661 Views · 415 Likes · 31 Retweets + +## Im Post genannte Quelle + +- **Podcast/Video:** „Jev is HERE. How to use it" — Kanal **Greg Isenberg** (YouTube-oEmbed verifiziert: https://www.youtube.com/@GregIsenberg), Video-ID `4mTLpuQpB80`, Titel „Jev is HERE. How to use it". URL: https://www.youtube.com/watch?v=4mTLpuQpB80 +- **Gast:** [@ryanvogel](https://x.com/ryanvogel) — X-Profil (fxtwitter): „vogel", Bio „ceo of @rebasetv / founding developer @opencode @anomalyco", Standort Florida, 18.201 Follower, verifiziert. Im Post nennt Isenberg ihn als Gesprächspartner. +- **Produkt:** Jev (System One Model von TypeSafe AI) — siehe `raw/blog/2026-09-15_typesafe-system-one-models-jev.md`, `raw/blog/2026-09-15_every-mike-taylor-jev-vibe-check.md`, `raw/youtube/2026-09-17_aicopium-typesafe-jev.md`, `raw/blog/2026-09-16_theregister-typesafe-jev-doom.md`. + +## Im Post enthaltene Angaben (nicht im Post belegt) + +- **„1.700 E-Mails für 18 Cent"** — im Post ohne Token-Aufschlüsselung, ohne Datensatz und ohne Messung. Externe Sekundärangabe (Websuche, 18.09.2026): 4,2 Mio. Input-Token + 500k Output-Token für 18 Cent. ⚠️ Nicht am Video oder Primärartefakt verifiziert. +- **„94 % sicher"** — Beispielwert aus der TypeSafe-Kommunikation (Kalibrierungsbeispiel), hier als Illustration verwendet. +- **„live on the Vercel AI Gateway … you can start calling it today"** — lokal verifiziert via Vercel-Modellseite und Vercel-Changelog (siehe `raw/blog/2026-09-16_vercel-jev-ai-gateway.md`). Die dortige Preisangabe weicht auf zwei Nachkommastellen ab: **$0,04 / 1 Mio. Input-Token** (gerundete Anzeige) gegenüber **$0,042** in der TypeSafe-Primärquelle. +- **„skip the waitlist"** — TypeSafes eigener Launch nennt Early Access + Waitlist als Weg über die TypeSafe-API. Der Gateway-Zugang ist ein zweiter, dort nicht genannter Zugangsweg. +- Die sieben Geschäftsideen (Instant Quotes, Lead Scoring, Support Triage, Clipping, Application Piles, Marketplace Matching, Browser Agents) sind **Vorschläge des Autors**, keine Produktfunktionen von Jev. + +## Offene Punkte + +- Video-Inhalt (Transkript) nicht ausgewertet; Aussagen der Episode sind über diesen Post nicht belegt. YouTube-Beschreibung lokal nicht abrufbar (Kurzabruf ohne Extraktion). +- Kein eigener Beleg für die 18-Cent-Zahl in der Episode; Betrag und Token-Aufschlüsselung sind zweit-/dritthändig. +- Ob Isenberg in einer Geschäftsbeziehung zu TypeSafe AI oder Vercel steht, ist im Post nicht angegeben und nicht geprüft. diff --git a/wiki/concepts/llm/jev-vercel-ai-gateway.md b/wiki/concepts/llm/jev-vercel-ai-gateway.md new file mode 100644 index 0000000..675cd0f --- /dev/null +++ b/wiki/concepts/llm/jev-vercel-ai-gateway.md @@ -0,0 +1,92 @@ +--- +created: 2026-09-18 +updated: 2026-09-18 +sources: [xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md, blog/2026-09-16_vercel-jev-ai-gateway.md] +tags: [concept, llm, jev, typesafe-ai, vercel, ai-gateway, ai-sdk, distribution, system-one-models, evaluation-models, structured-outputs] +--- + +# Jev auf dem Vercel AI Gateway — Verteilung statt Waitlist + +> **Quelle:** Greg Isenberg ([[../../people/greg-isenberg.md|@gregisenberg]]), X-Post vom 18.09.2026 (`raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`) + Vercel-Changelog und -Modellseite vom 16.09.2026, lokal gelesen (`raw/blog/2026-09-16_vercel-jev-ai-gateway.md`). Anlass: geteilt von Pit Weber in OME Topic „JEV", 18.09.2026. Modell und Testlage selbst: [[system-one-models-jev.md]]. + +## Kernidee + +Jev ist nicht mehr nur über TypeSafes eigene Waitlist erreichbar. Seit 16.09.2026 läuft das Modell im **[[../../institutions/vercel.md|Vercel]] AI Gateway** — also in der Routing- und Abrechnungsschicht eines Fremdanbieters. Damit ist die Ankündigungsphase des Modells beendet und die **Verteilungsphase** beginnt: nicht „wie gut ist Jev", sondern „wie kommt es in Code". + +Das ist der eigentliche Neuigkeitswert des Isenberg-Posts. Seine Beschreibung des Modells („it sorts, it doesn't write back") ist korrekt, aber die substanzielle Information steckt in zwei Nebensätzen: *live on the Vercel AI Gateway* und *skip the waitlist*. + +## Technischer Zugang (lokal verifiziert, 18.09.2026) + +| Feld | Wert | +|------|------| +| Modell-ID | `typesafe-ai/jev` | +| Zugang | Vercel AI Gateway, AI SDK **7.0.105+** (`experimental evaluate` API) | +| Frage-Typen | **Choice** (Option wählen), **Score** (Rubrik bewerten), **Boolean** (Wahrscheinlichkeit für „true") | +| Eingabe | ein gemeinsames `state` (String, Objekt oder Array) + Map benannter `questions` | +| Ausgabe | typisierte Antworten mit Wahrscheinlichkeiten; Question-IDs und Choice-Keys bleiben erhalten; getrennte Confidence für Choice und Score unter `result.providerMetadata.typesafe.confidence` | +| Latenz-/Kostenangaben | 70–500 ms, $0,042/MTok Input, Output $0 (TypeSafe-Angabe, siehe [[system-one-models-jev.md]]) | +| Preis auf der Gateway-Seite | **$0,04 / 1 Mio. Input-Token** — gerundete Anzeige, zwei Nachkommastellen | +| Datenschutz-Optionen | **Zero Data Retention** und **No Training**, pro Request über `providerOptions.gateway` | +| Abrechnung | Auswertungen erscheinen in Logs/Custom Reporting und zählen gegen Gateway-Budgets | + +Beispiel der Anbieterseite: ein Support-Fall wird in drei Fragen zerlegt — Queue, Priority, Refund-Review; unsichere Fälle gehen ins manuelle Review. Der Satz, der die ganze Produktkategorie zusammenfasst, steht im Vercel-Changelog: „automate clear cases while routing uncertain ones to review". + +Der Gateway-Auftritt kostet TypeSafe nichts an Kontrolle, aber er verschiebt die Bezahl- und Log-Schicht zu Vercel. Wer Jev über den Gateway ruft, hat Vercel im Datenpfad — mit ZDR als Option, nicht als Default. + +## Die sieben Geschäftsideen des Posts — was daran Jev ist + +Isenberg listet Anwendungen, die sich alle als Frage an ein Entscheidungsmodell formulieren lassen. Die Grenze verläuft nicht zwischen den Ideen, sondern innerhalb jeder Idee: Jev **sortiert**, es **arbeitet nicht**. + +| # | Idee des Posts | Einordnung | +|---|----------------|------------| +| 1 | „Instant Quotes" unter einer Sekunde (Dachdecker, Umzüge, Versicherung, Legal Intake) | Entspricht einer Score-/Choice-Frage über Formulardaten; der eigentliche Aufwand bleibt das Preiswerk und die Haftung, nicht die Klassifikation | +| 2 | Lead Scoring als Produkt — echte Anfragen aufs Handy des Inhabers | Klassischer Fall, deckt sich mit TypeSafes eigenem Muster | +| 3 | Support-Triage ohne Support-Team | Deckt sich mit dem dokumentierten **Intent-Routing**-Muster von TypeSafe (`docs.typesafe.ai/patterns/intent-routing`) | +| 4 | Clipping: bester Moment aus einem Transcript in Sekunden bewertet | Als **Score**-Frage plausibel; „bester Moment" ist eine Rubrik, kein Text | +| 5 | Bewerbungs-/Antragsstapel (Grants, Permits, Claims, Kredite) | Reichweitenstärkster Fall und der mit dem größten Fehlerpreis — hier zählt Kalibrierung, nicht Tempo | +| 6 | Marketplace-Matching statt Rückruf | Plausibel als Klassifikation gegen ein Verzeichnis | +| 7 | „Browser agents that actually move FAST" | **Teilweise am Produkt vorbei:** Jev beschleunigt die Entscheidung, nicht das Browsen. Der Flaschenhals dieser Idee liegt in der Browser-Schicht, nicht im Entscheidungsmodell | + +Die Formel des Posts — „find an expensive queue and put Jev at the front of it" — ist eine brauchbare Heuristik, aber sie beschreibt nur die halbe Arbeit. Vor jede Warteschlange gehört ein Gate, hinter jede Entscheidung eine Eskalation. Genau dafür liefert das Gateway die Confidence-Werte, und genau deshalb ist die Kalibrierung die entscheidende Eigenschaft (siehe [[system-one-models-jev.md|Merksatz: Type-Safety ist keine Wahrheitsgarantie]]). + +## Einordnung: Distribution als eigene Produktphase + +- **Gateway statt SDK-Wettbewerb.** TypeSafe verkauft kein Harness, sondern ein Modell — und verteilt es über die Schicht, die andere Harnesses ohnehin schon benutzen. Das ist der schnellste Weg in fremden Code, ohne eigene Developer-Relations-Maschine. +- **Wiederverwendung einer bestehenden Bezahlgrenze.** Budgets, Logs, ZDR-Schalter: Der Gateway bringt Kostenkontrolle und Compliance-Rahmen mit. Für die Freigrenze „Checks sind so billig, dass man sie laufend macht" (siehe [[../agents/agent-budget-breaker.md|Kostendeckel]]) ist das die passende Infrastruktur. +- **Der Influencer-Post als Verteilkanal.** Ein Startup-Ideen-Kanal mit 712.496 Followern erklärt ein Infrastrukturprodukt über Geschäftsideen. Das ist wirksamer als jede Benchmark-Tabelle, verschiebt aber die Wahrnehmung: Jev wird als Baukasten für Firmen gelesen, nicht als Entscheidungsschicht für Software. +- **Zweiter Zugangsweg, zweite Preisangabe.** Die Waitlist-Story stammt aus der Ankündigung, der Gateway-Zugang ist jünger. Beide Preise ($0,042 bzw. $0,04) bezeichnen dasselbe, nur mit unterschiedlicher Rundung — ein Detail, das bei Kostenrechnung über Milliarden Tokens dann doch zählt. + +## Quellenkritik + +- ⚠️ **„1.700 E-Mails für 18 Cent"** steht im Post ohne Token-Aufschlüsselung, Datensatz oder Messung. Die Größenordnung passt zur TypeSafe-Preislogik ($0,042/MTok), die Zahl selbst ist aber zweit- bis dritthändig (externe Angabe: 4,2 Mio. Input- + 500k Output-Token). +- ⚠️ **„94 % sicher"** ist ein Illustrationswert für Kalibrierung, kein Messergebnis. +- ⚠️ **193,6×/444,6×** übernimmt Vercel ausdrücklich als TypeSafe-Angabe („TypeSafe reports"), nicht als eigene Messung. +- ⚠️ **Interessenlage des Posts:** Isenberg verdient an Startups und Aufmerksamkeit; der Post hat Funnel-Struktur („at the end I'll tell you how") und endet in einem Podcast-Verweis. Er ist Verteilung, nicht Prüfung — die einzige unabhängige Messung bleibt der Every-Einzeltest. +- ✅ **Lokal verifiziert:** Gateway-Modellseite und Changelog liefern beide HTTP 200 mit auswertbarem Inhalt; Modell-ID, Preisangabe, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort. + +## Offene Punkte + +- Kein Nachweis, dass der Gateway-Preis dem Direkt-API-Preis entspricht (oder ob Vercel einen Aufschlag nimmt) — auf beiden Seiten nicht ausgewiesen. +- Keine Angaben zu Rate Limits, SLA und Regionen für Jev auf dem Gateway. +- Ob die Episode ([[../../people/ryan-vogel.md|Ryan Vogel]] als Gast) eigene Messungen enthält, ist nicht geprüft; das Video-Transkript wurde nicht ausgewertet. +- Offen, wie viele Fragen pro Request praktisch parallel möglich sind — die Kostenrechnung hängt daran. + +## Verwandte Wiki-Seiten + +- [[system-one-models-jev.md]] — Modell, RLCD, Testlage, Zahlenkritik +- [[../../institutions/typesafe-ai.md]] — Anbieter, Team, Manifesto +- [[../../institutions/vercel.md]] — Gateway-Betreiber +- [[../../people/greg-isenberg.md]] — Autor des Posts +- [[../../people/ryan-vogel.md]] — Gast der Episode +- [[llm-model-catalog.md]] — Modellkatalog +- [[harness-vs-standalone-chat-llm.md]] — Gate vs. Generierung +- [[../agents/agent-budget-breaker.md]] — Kostendeckel für unbewachte Schleifen +- [[../agents/ai-agents-2026.md]] — Agent-Use-Cases + +## Quellen + +- [X-Post @gregisenberg](https://x.com/gregisenberg/status/2101018750916948237) (18.09.2026, 18:41 UTC; 29.661 Views / 415 Likes bei Abruf 21:31 UTC) +- [YouTube: „Jev is HERE. How to use it"](https://www.youtube.com/watch?v=4mTLpuQpB80) (Kanal Greg Isenberg; Beschreibung lokal nicht auswertbar) +- [Vercel AI Gateway — Jev](https://vercel.com/ai-gateway/models/jev) (modell-ID, Preis, Beispielcode) +- [Vercel Changelog: TypeSafe AI's Jev now available on AI Gateway](https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway) (16.09.2026, Taneja/Chen/Zheng) +- Raw: `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`, `raw/blog/2026-09-16_vercel-jev-ai-gateway.md` diff --git a/wiki/concepts/llm/llm-model-catalog.md b/wiki/concepts/llm/llm-model-catalog.md index cd08d6f..62746f9 100644 --- a/wiki/concepts/llm/llm-model-catalog.md +++ b/wiki/concepts/llm/llm-model-catalog.md @@ -164,7 +164,7 @@ Kein Chat-Modell, sondern eine eigene Produktklasse: **kein Text, sondern typisi | Modell | Hersteller | Ausgabe | Sampling | Preis | Status | Quelle | |--------|-----------|---------|----------|-------|--------|--------| -| **Jev** (System One Model) | [TypeSafe AI](../../institutions/typesafe-ai.md) | type-safe structured values + kalibrierte Wahrscheinlichkeiten — **keine Strings** | parallel (ein Sample für alle Urteile) | $0,042/MTok Input, $0 Output | Early Access, 70–500 ms | [[system-one-models-jev.md]] | +| **Jev** (System One Model) | [TypeSafe AI](../../institutions/typesafe-ai.md) | type-safe structured values + kalibrierte Wahrscheinlichkeiten — **keine Strings** | parallel (ein Sample für alle Urteile) | $0,042/MTok Input, $0 Output | Early Access, 70–500 ms; seit 16.09.2026 im [Vercel AI Gateway](jev-vercel-ai-gateway.md) | [[system-one-models-jev.md]] | **Abgrenzung:** Jev konkurriert nicht mit Chat-/Coding-Frontier-Modellen, sondern mit der Rolle von Klassifikatoren, Guardrails und DSPy-Pipelines — nur als Foundation-Model. „Zero Hallucinations" bedeutet Type-Safety (kein Formatfehler, keine erfundene Option), **nicht** Korrektheit. Alle Zahlen sind Anbieterangaben außer einem kleinen Fremdtest; Details und Quellenkritik in [[system-one-models-jev.md]]. @@ -238,4 +238,5 @@ OpenRouter Fusion ([[llm-model-fusion-ensembles.md]]) ermöglicht parallele Mode - [[../../tools/kimi-k2.7-code.md]] — Detailseite Kimi K2.7 - [[../../tools/hermes-desktop.md]] — Agent-Framework mit Model-Picker - [[../directives/pro-leben-directive.md]] — Philosophischer Rahmen: Cloud-Exit = Handlungsfähigkeit -- [[system-one-models-jev.md]] — Jev / System One Models (TypeSafe AI): Entscheidungsmodelle ohne Textausgabe \ No newline at end of file +- [[system-one-models-jev.md]] — Jev / System One Models (TypeSafe AI): Entscheidungsmodelle ohne Textausgabe +- [[jev-vercel-ai-gateway.md]] — Jev über den Vercel AI Gateway: Verteilung, Isenberg-Geschäftsideen, Quellenkritik der Viral-Zahlen \ No newline at end of file diff --git a/wiki/concepts/llm/system-one-models-jev.md b/wiki/concepts/llm/system-one-models-jev.md index d025b28..aa6eaf7 100644 --- a/wiki/concepts/llm/system-one-models-jev.md +++ b/wiki/concepts/llm/system-one-models-jev.md @@ -1,7 +1,7 @@ --- created: 2026-09-17 -updated: 2026-09-17 -sources: [blog/2026-09-15_typesafe-system-one-models-jev.md, blog/2026-09-15_every-mike-taylor-jev-vibe-check.md, youtube/2026-09-17_aicopium-typesafe-jev.md, blog/2026-09-16_theregister-typesafe-jev-doom.md] +updated: 2026-09-18 +sources: [blog/2026-09-15_typesafe-system-one-models-jev.md, blog/2026-09-15_every-mike-taylor-jev-vibe-check.md, youtube/2026-09-17_aicopium-typesafe-jev.md, blog/2026-09-16_theregister-typesafe-jev-doom.md, blog/2026-09-16_vercel-jev-ai-gateway.md, xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md] tags: [concept, llm, typesafe, jev, system-one-models, rlcd, structured-outputs, calibrated-decisions, parallel-sampling, inference-cost, automation, harness] --- @@ -91,12 +91,21 @@ Die eigenen Workflow-Evals messen **Übereinstimmung mit Referenzantworten** (Du - **Namensgebung als These:** „Jev" nach **William Stanley Jevons** — Jevons-Paradox: sinkende Kosten erhöhen den Verbrauch. Der Name ist das Programmm: Intelligenz wird billiger, also wird mehr davon verbraucht. - Bezug zur Harness-Deutung unseres Wikis: Jev besetzt **weder Modell-Prompting noch Orchestrierung**, sondern die Gate-Schicht im Ablauf — vgl. [[harness-vs-standalone-chat-llm.md]] („Grounding-Tools verhindern keine probabilistische Generierung — nur Gates tun das") und [[../agents/harness-loop-graph-engineering.md]]. +## Verteilung: über den Vercel AI Gateway (ab 16.09.2026) + +Der Weg zu Jev führt seit dem **16.09.2026** nicht mehr nur über TypeSafes eigene Waitlist: Das Modell läuft im **[[../../institutions/vercel.md|Vercel]] AI Gateway** unter der ID `typesafe-ai/jev`, nutzbar über das AI SDK (7.0.105+) und die `experimental evaluate`-API. Die Gateway-Seiten nennen `$0.04 / 1 Mio. Input-Token` (gerundete Anzeige gegenüber $0,042), **Zero Data Retention** und **No Training** als pro-Request-Schalter, und sie rechnen Auswertungen gegen Gateway-Budgets ab. + +Für die Einordnung bedeutsamer als der Zugangsweg: Die ersten Zahlen, die nach dem Launch durch die Timeline laufen, stammen aus einem **Startup-Ideen-Post** von [[../../people/greg-isenberg.md|Greg Isenberg]] (18.09.2026), nicht aus einer Messung — „1,700 emails for 18 cents" ist eine zweit- bis dritthändige Größenordnung ohne Token-Aufschlüsselung und Datensatz. Details, die sieben dort genannten Geschäftsideen und die Quellenkritik: [[jev-vercel-ai-gateway.md]]. + +Merksatz: Der Launch war eine Ankündigung, die Gateway-Listung ist Verteilung — und Verteilungszahlen sind keine Leistungszahlen. + ## Offene Punkte - ⚠️ **Alle Leistungszahlen sind Anbieterangaben** außer dem einen Every-Einzeltest (37 Dokumente, 12 Passagen, 1.709 Judgments). Keine peer-reviewte Evaluation, keine breite Fremdprüfung. - ⚠️ Kein unabhängiger Nachbau der vier Workflows; die Evals-Seite (https://evals.typesafe.ai/) wurde nicht ausgewertet. - ⚠️ Architektur, Trainingsverfahren und Datenherkunft von Jev sind nicht veröffentlicht — ob paralleles Sampling die genannten Latenzen erklärt, ist nicht überprüfbar. - Offen: ob der Preis ($42/Mrd. Input, $0 Output) nachhaltig ist — der Anbieter räumt Subvention nicht ausgeschlossen aus. +- Offen: ob der Gateway-Preis dem Direkt-API-Preis entspricht und ob Rate Limits/SLA existieren — auf den Gateway-Seiten nicht ausgewiesen ([[jev-vercel-ai-gateway.md]]). - Offen: Fehlerkosten bei falscher, aber kalibrierter Entscheidung — der Every-Test liefert dazu nur ein Datenpaar (6/7 vs. 7/7). - [[../../institutions/typesafe-ai.md|TypeSafe]] hat drei Gründer (Almeida, Sheng, Gafni), Sitzt in San Francisco und ist **nicht** mit OpenAI verbunden — Almeida ist ehemaliger OpenAI-/Google-Brain-Forscher. Die Video-/Presse-Rahmung „a ChatGPT researcher" ist Zuschreibung, keine Firmenbeziehung. @@ -113,6 +122,9 @@ Die eigenen Workflow-Evals messen **Übereinstimmung mit Referenzantworten** (Du - [[../agents/agent-budget-breaker.md]] — Kostendeckel für unbewachte Schleifen - [[../agents/harness-loop-graph-engineering.md]] — Harness-Ebene - [[llm-sycophancy-confabulation.md]] — Fehlerklassen jenseits von Halluzination +- [[jev-vercel-ai-gateway.md]] — Verteilung über den Vercel AI Gateway, Isenberg-Post, sieben Geschäftsideen +- [[../../institutions/vercel.md]] — Gateway-Betreiber +- [[../../people/greg-isenberg.md]] — Startup-Ideen-Kanal, der die „18 Cent"-Zahl verbreitet ## Quellen @@ -120,4 +132,6 @@ Die eigenen Workflow-Evals messen **Übereinstimmung mit Referenzantworten** (Du - [Every: Mini-Vibe Check (Mike Taylor)](https://every.to/also-true-for-humans/mini-vibe-check-typesafe-s-jev-judged-everything-i-ve-written-in-0-7-seconds) (15.09.2026) - [AI Copium: „A ChatGPT Researcher Just Dropped a MASSIVE AI Breakthrough…"](https://www.youtube.com/watch?v=xQtUzjd7-As) (17.09.2026, 14:25, vollständiges Transcript) - Raw: `raw/blog/2026-09-15_typesafe-system-one-models-jev.md`, `raw/blog/2026-09-15_every-mike-taylor-jev-vibe-check.md`, `raw/youtube/2026-09-17_aicopium-typesafe-jev.md` +- [Vercel AI Gateway — Jev](https://vercel.com/ai-gateway/models/jev) und [Vercel Changelog](https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway) (16.09.2026, Gateway-Listung, lokal gelesen) +- [X-Post @gregisenberg](https://x.com/gregisenberg/status/2101018750916948237) (18.09.2026, 18:41 UTC; 29.661 Views / 415 Likes bei Abruf 21:31 UTC) - Erwähnung ohne auswertbaren Inhalt: [The Register](https://www.theregister.com/ai-and-ml/2026/09/16/typesafe-ai-debuts-model-for-machines-that-plays-doom/5296711) (16.09.2026; Volltext nicht abrufbar, nur „Are we human?" extrahiert) diff --git a/wiki/index.md b/wiki/index.md index 9866041..b8fb6d6 100644 --- a/wiki/index.md +++ b/wiki/index.md @@ -2,8 +2,9 @@ *Auto-generated: 2026-07-07* -*Letzte Aktualisierung: 2026-09-18 (219. Update — PLUR1BUS Memory 7.12.61 (Mr. Cy / @Cyb3rblade, Ankündigung via Yvonne, 18.09.2026). Raw: `raw/other/2026-09-18_plur1bus-memory-release-71261.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Release 7.12.61 OpenClaw + Hermes 7.12.61-hermes.0-Prerelease: Skill begleitet Installation, ersetzt natives Paket nicht; Hermans Analyse — Afterthought-Auswahl, Fallback respektiert Hermes-Modell, Compaction koordiniert sofort, Journal-Tail-Integrität). Deployment: Bernhardine/Bernd live, Hector auf 7.12.56, Herman auf 7.12.7.post3 (keine Installation ohne Freigabe).)* -*Vorherige Aktualisierung: Letzte Aktualisierung: 2026-09-18 (218. Update — „Grok Bot Galaxy" Nachlauf: (a) Elon Musks Quote-Post des Day-2-Broadcasts (16.09.2026, 18:52 UTC, https://x.com/elonmusk/status/2100296847344783441 — „Watch a company being built live with @Grok @Bot!", 6,23 Mio. Views / 15,8K Likes; geteilt von Rüdiger @Stelariz_75 in OME „GrokBot", 18.09. 15:12 UTC; Begleit-Briefing Herman) — kein eigener Inhalt, reine Verteilung; (b) Ergebnis des 72-h-Builds laut Sekundärbericht (techiexpert.com): Firma „Ship by Thursday" (shipbythurs.day, Food-Pop-up-Plattform, Stack Notion/Slack/Cursor/Vercel, Meta-Agent „Dr. Eggbot"), Lieferstand Landing Page + Waitlist, kein Umsatznachweis; ⚠️ widersprüchliche Dritt-Aufzeichnung nennt Spielestudio „Thursday Arena"; (c) VentureBeat-Launch-Bericht (11.08.2026): Preisstaffel Cursor Premium Teams $120/Seat · Cursor Ultra $200 · SuperGrok Heavy $300, **keine Benchmarks veröffentlicht**. Raw: `raw/xpost/2026-09-16_elonmusk-grok-bot-galaxy-day2.md` (neu), `raw/blog/2026-08-11_venturebeat-grok-bot-launch-pricing.md` (neu), `raw/blog/2026-09-18_techiexpert-grok-bot-galaxy-ship-by-thursday.md` (neu). Wiki: `tools/grok-bot-spacexai.md` (Galaxy-Abschnitt: Ergebnis + Musk-Verstärkung + Ehrliche Kante; Quellen, Raw-Liste, Stand).)* +*Letzte Aktualisierung: 2026-09-18 (220. Update — Jev-Verteilung: Greg Isenbergs „Jev is HERE"-Post (18.09.2026, 18:41 UTC; 29.661 Views / 415 Likes bei Abruf) und die Gateway-Listung. Anlass: X-Link von Pit Weber in OME Topic „JEV". **Lokal verifiziert (18.09.2026, HTTP 200 mit auswertbarem Text):** Der Vercel AI Gateway führt `typesafe-ai/jev` seit 16.09.2026 — AI SDK 7.0.105+ mit `experimental evaluate`, Frage-Typen Choice/Score/Boolean, ein gemeinsames `state` + Map benannter `questions`, Choice-/Score-Confidence unter `result.providerMetadata.typesafe.confidence`, Zero Data Retention und No Training per Request, Abrechnung gegen Gateway-Budgets; Gateway-Preis **$0.04/1M Input** (gerundet) gegen $0,042 in der TypeSafe-Primärquelle; Leistungszahlen 193,6×/444,6× von Vercel ausdrücklich als TypeSafe-Angabe weitergegeben („TypeSafe reports"). **Post-Inhalt:** sieben Geschäftsideen (Instant Quotes, Lead Scoring, Support-Triage, Clipping, Antragsstapel, Marketplace-Matching, Browser-Agenten), Formel „find an expensive queue and put Jev at the front of it", Zugang über den Gateway statt Waitlist; ⚠️ „1.700 E-Mails für 18 Cent" ohne Token-Aufschlüsselung, Datensatz oder Messung, „94 %" als Illustrationswert, Episode-Gast [@ryanvogel](https://x.com/ryanvogel) („ceo of @rebasetv / founding developer @opencode") nur aus dem Post zugeordnet. Wiki: `concepts/llm/jev-vercel-ai-gateway.md` (neu), `institutions/vercel.md` (neu), `people/greg-isenberg.md` (neu), `people/ryan-vogel.md` (neu); Updates `concepts/llm/system-one-models-jev.md` (Verteilungs-Abschnitt + offene Gateway-Punkte), `institutions/typesafe-ai.md` (Distribution), `concepts/llm/llm-model-catalog.md`. Raw: `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md` (neu), `raw/blog/2026-09-16_vercel-jev-ai-gateway.md` (neu).)* +*Vorherige Aktualisierung: 2026-09-18 (219. Update — PLUR1BUS Memory 7.12.61 (Mr. Cy / @Cyb3rblade, Ankündigung via Yvonne, 18.09.2026). Raw: `raw/other/2026-09-18_plur1bus-memory-release-71261.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Release 7.12.61 OpenClaw + Hermes 7.12.61-hermes.0-Prerelease: Skill begleitet Installation, ersetzt natives Paket nicht; Hermans Analyse — Afterthought-Auswahl, Fallback respektiert Hermes-Modell, Compaction koordiniert sofort, Journal-Tail-Integrität). Deployment: Bernhardine/Bernd live, Hector auf 7.12.56, Herman auf 7.12.7.post3 (keine Installation ohne Freigabe).)* +*Vorherige Aktualisierung: 2026-09-18 (218. Update — „Grok Bot Galaxy" Nachlauf: (a) Elon Musks Quote-Post des Day-2-Broadcasts (16.09.2026, 18:52 UTC, https://x.com/elonmusk/status/2100296847344783441 — „Watch a company being built live with @Grok @Bot!", 6,23 Mio. Views / 15,8K Likes; geteilt von Rüdiger @Stelariz_75 in OME „GrokBot", 18.09. 15:12 UTC; Begleit-Briefing Herman) — kein eigener Inhalt, reine Verteilung; (b) Ergebnis des 72-h-Builds laut Sekundärbericht (techiexpert.com): Firma „Ship by Thursday" (shipbythurs.day, Food-Pop-up-Plattform, Stack Notion/Slack/Cursor/Vercel, Meta-Agent „Dr. Eggbot"), Lieferstand Landing Page + Waitlist, kein Umsatznachweis; ⚠️ widersprüchliche Dritt-Aufzeichnung nennt Spielestudio „Thursday Arena"; (c) VentureBeat-Launch-Bericht (11.08.2026): Preisstaffel Cursor Premium Teams $120/Seat · Cursor Ultra $200 · SuperGrok Heavy $300, **keine Benchmarks veröffentlicht**. Raw: `raw/xpost/2026-09-16_elonmusk-grok-bot-galaxy-day2.md` (neu), `raw/blog/2026-08-11_venturebeat-grok-bot-launch-pricing.md` (neu), `raw/blog/2026-09-18_techiexpert-grok-bot-galaxy-ship-by-thursday.md` (neu). Wiki: `tools/grok-bot-spacexai.md` (Galaxy-Abschnitt: Ergebnis + Musk-Verstärkung + Ehrliche Kante; Quellen, Raw-Liste, Stand).)* *Vorherige Aktualisierung: 2026-09-18 (217. Update — PLUR1BUS Changelog 7.12.47–7.12.61 (11.–17.09.2026). Raw: `raw/other/2026-09-18_plur1bus-changelog-71247-71261.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Changelog-Abschnitt: Vergessenskurve als Batch-Update statt ~80 Zeilen/Nacht, Skill-Miner nächtlich mit Auto-Apply/Approve/Decline/Withdraw und benefit-Feld, 22 Vorschläge im falschen Verzeichnis, LanceDB-Kompaktierung gegen Gateway-Blockaden von 15–143 s, Nachgedanken-Fenster bis 180 Min (26/36 Läufe scheiterten), llmRouter.defaultModel für Hintergrundarbeit, Dashboard „Cards by primary agent", „Unavailable" statt gemessener 0, Testreste 444→0; Muster: Miner-Reifung + Kostendämpfung.) *Vorherige Aktualisierung: 2026-09-17 (216. Update — TypeSafe AI: System One Models & Jev — „Modelle für Maschinen" statt Chat. Anlass: YouTube-Link in OME Topic 13 (Kanal AI Copium, 17.09.2026, „A ChatGPT Researcher Just Dropped a MASSIVE AI Breakthrough…", 14:25, **vollständiges Transcript** über Firecrawl). Primärquelle: TypeSafe-Ankündigungsartikel von Diogo Almeida (15.09.2026). Raw: `raw/youtube/2026-09-17_aicopium-typesafe-jev.md` (neu), `raw/blog/2026-09-15_typesafe-system-one-models-jev.md` (neu), `raw/blog/2026-09-15_every-mike-taylor-jev-vibe-check.md` (neu), `raw/blog/2026-09-16_theregister-typesafe-jev-doom.md` (neu — ⚠️ Volltext nicht abrufbar). Wiki: `concepts/llm/system-one-models-jev.md` (neu — RLCD statt RLHF/RLVR, typisierte Ausgaben statt Strings, paralleles statt sequenzielles Sampling, 70–500 ms / $0,042 pro MTok Input / $0 Output; Anbieter-Claims 193,6× schneller und 444,6× günstiger; **„Zero Hallucinations" = Type-Safety, keine Wahrheitsgarantie**; Fremdtest Every: 777 Judgments in 0,7 s für einen Viertelcent, Jev 0,35 s/6-von-7 Defekten gegen Fable 5.1 8,83 s/7-von-7; Quellenkritik: Referenz-Übereinstimmung ≠ verifizierte Korrektheit, Wrapper-Overhead vergrößert den Abstand, Bias-Richtungen vom Anbieter selbst benannt), `institutions/typesafe-ai.md` (neu — Gründer Almeida/Sheng/Gafni, San Francisco, Manifesto „Composable AI — Build Prod, Not God"; Abgrenzung: nicht OpenAI), `people/diogo-almeida.md` (neu), `people/mike-taylor.md` (neu — Head of Evals bei Every), `people/dan-shipper.md` (neu), `people/ai-copium.md` (neu — Videotitel „400x" verdichtet die Primärquelle), `institutions/every.md` (neu). Cross-Refs: `llm-model-catalog.md`, `harness-vs-standalone-chat-llm.md`, `agent-budget-breaker.md`, `harness-loop-graph-engineering.md`, `llm-sycophancy-confabulation.md`. ⚠️ Leistungszahlen = Anbieterangaben außer einem Einzeltest mit kleinem Umfang; Architektur/Training/Datenherkunft nicht veröffentlicht.)* *Vorherige Aktualisierung: 2026-09-17 (215. Update — PRODOC `intent-chat`-Skill 1.0: statischer Vetting-Befund + Anbieterverifikation + Domain-Korrektur. Anlass: Download-Link in OME „Tips & Tricks". Raw: `raw/other/2026-09-17_intent-chat-skill-prodoc.md` (neu — SHA-256 `c960de5d…2c73`, 18 Dateien, 159,9 KiB entpackt; statischer Scan: kein Netz-/Exec-/Credential-Signal, keine Script-Tags/on-Handler/Injection/Pfad-Traversal, einzige Fremdhosts Google Fonts, `CHANGELOG.md` referenziert aber nicht im ZIP). Wiki-Update: `people/stefan-weimar.md` (Domain korrigiert: `prodoc-digital.com` HTTP 200 mit Impressum — GmbH Goslar, Geschäftsführer Weimar, Telefon +49 5321 7799404 deckungsgleich mit Skill-Kontakt; `prodoc.digital` liefert weiterhin keinen TLS-Handshake; neuer Abschnitt zum Skill als Werkzeugfassung derselben Spec-Driven-Doktrin; Cross-Refs). ⚠️ Nicht installiert, nichts ausgeführt. Zusatzbefund: Die Fremdprüfung eines anderen Bots nannte das Paket „192 KB"/„767 Zeichen" Description — gemessen sind es 159,9 KiB entpackt und 759 Zeichen.)* @@ -43,12 +44,12 @@ *Vorherige Aktualisierung: 2026-09-06 (182. Update — X-Post von @0xJokker zu TimesFM 3.0. Raw: `raw/xpost/2026-09-06_0xjokker-timesfm-3.md` (neu; Post und Screenshot geprüft, Lizenz- und 100-Milliarden-Claim gegen offizielle TimesFM-Quellen eingeordnet). Wiki: `concepts/llm/timesfm-time-series-forecasting.md` (neu — Zeitreihen-Forecasting, Zero-Shot, lokale Inferenz und Lizenzgrenze der 3.0-Gewichte).)* *Vorherige Aktualisierung: 2026-09-06 (181. Update — X-Post von @AnatoliKopadze zu einem angeblichen Elon-Musk-„Fünf Jahre Arbeit“-Claim. Raw: `raw/xpost/2026-09-06_anatoli-kopadze-musk-five-years-work-claim.md` (neu; Abruf widersprüchlich: Seitentitel nennt Musk-These, sichtbarer Teaser nur Claude-Guide). Wiki-Update: `concepts/llm/ai-intelligence-commoditization-thesis.md` — verwandte Musk-Prognosen auffindbar, exakter Wortlaut und Frist nicht primär belegt; als Engagement-/Zukunftsclaim eingeordnet.)* *Vorherige Aktualisierung: 2026-09-06 (180. Update — GameStar Podcast „Der Sargnagel für AAA-Gaming“: Audio-Transkript zur KI-bedingten Speicher-/Hardwarekrise, steigenden Gaming-Kosten und AAA-Folgen. Raw: `raw/podcast/2026-09-06_gamestar-sargnagel-aaa-gaming.md` (neu). Wiki: `concepts/hardware/gaming-hardwarekrise-ai-speicher.md` (neu; Podcast-Zahlen als unbestätigte Angaben markiert).)* -*Letzte Aktualisierung: 2026-09-06 (179. Update — OpenClaw Cast: Quellen- und Inhaltskorrektur zur Audiofolge „OpenClaw 2.0’s Repair Command Deletes What It Doesn’t Recognize“ (22:43; fiktive Hosts, Titel/Beschreibung weichen vom Audiotext ab). Raw: `raw/other/2026-09-06_openclaw-cast-episode-identification-correction.md` (neu). Wiki-Update: `concepts/agents/ai-coding-infrastructure-resilience.md` (Quellenkritik ergänzt; Outage-Drill bleibt als Architekturidee, Produktclaims nicht als Fakten).)* -*Letzte Aktualisierung: 2026-09-06 (178. Update — AI-Coding-Infrastruktur: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill (Podcast-Audio, STT-Zusammenfassung; Quelle/Feed nicht zuverlässig identifiziert). Raw: `raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md` (neu). Wiki: `concepts/agents/ai-coding-infrastructure-resilience.md` (neu — Provider-Ausfall, Token-Bloat, versionierter Harness, Isolation und getesteter Fallback-Drill).)* -*Letzte Aktualisierung: 2026-09-06 (177. Update — Ed Zitron: KI-Kritik und Bruchprognose 2027 (The Diary Of A CEO, YouTube; Metadata-only). Raw: `raw/youtube/2026-09-06_ed-zitron-ai-bs-2027-breaks.md` (neu). Wiki-Update: `concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag; Titel-Claim nicht verifiziert).* +*Vorherige Aktualisierung: 2026-09-06 (179. Update — OpenClaw Cast: Quellen- und Inhaltskorrektur zur Audiofolge „OpenClaw 2.0’s Repair Command Deletes What It Doesn’t Recognize“ (22:43; fiktive Hosts, Titel/Beschreibung weichen vom Audiotext ab). Raw: `raw/other/2026-09-06_openclaw-cast-episode-identification-correction.md` (neu). Wiki-Update: `concepts/agents/ai-coding-infrastructure-resilience.md` (Quellenkritik ergänzt; Outage-Drill bleibt als Architekturidee, Produktclaims nicht als Fakten).)* +*Vorherige Aktualisierung: 2026-09-06 (178. Update — AI-Coding-Infrastruktur: Ausfälle, Tokenkosten und 30-Minuten-Outage-Drill (Podcast-Audio, STT-Zusammenfassung; Quelle/Feed nicht zuverlässig identifiziert). Raw: `raw/podcast/2026-09-06_ai-coding-infrastructure-crisis-outage-drill.md` (neu). Wiki: `concepts/agents/ai-coding-infrastructure-resilience.md` (neu — Provider-Ausfall, Token-Bloat, versionierter Harness, Isolation und getesteter Fallback-Drill).)* +*Vorherige Aktualisierung: 2026-09-06 (177. Update — Ed Zitron: KI-Kritik und Bruchprognose 2027 (The Diary Of A CEO, YouTube; Metadata-only). Raw: `raw/youtube/2026-09-06_ed-zitron-ai-bs-2027-breaks.md` (neu). Wiki-Update: `concepts/llm/ai-investment-bubble.md` (Metadata-only-Nachtrag; Titel-Claim nicht verifiziert).* *Vorherige Aktualisierung: 2026-09-06 (176. Update — Second Life & virtuelle Welten: „Virtuelle Welten / Das zweite Leben" (Blogartikel auf net.ddnss.de, ca. 2006, OME Topic 2193, geteilt von Netbits @NetLightning am 06.09.2026). Raw: `raw/blog/2026-09-06_second-life-virtuell-chatten-community.md` (neu). Wiki-Update: `concepts/second-life-virtuelle-welten.md` (neu — Second Life als historisches Web-3.0-Hype-Dokument: UGC-Ökonomie, Linden-Dollar, 3D-Modeller/LSL, 2.000-CPU-Kern-Grid; Anekdote Virus-T-Shirt-Textur; Einordnung vs. spätere Metaverse-Wellen; unkritische zeitgenössische Zahlen gekennzeichnet).* *Vorherige Aktualisierung: 2026-09-05 (175. Update — Harness vs. Standalone-Chat-LLM: Walled Garden & Attribut-Fusions-Halluzination (Hector, 2026-09-05, OME LOGBUCH). Raw: `raw/other/2026-09-05_harness-vs-standalone-chat-llm.md` (neu — OME-Debatte 28.08.–05.09.2026: Gemini-Runtime als geschlossener „goldener Käfig", Harness ≠ Runtime-Definition, K1-Fall/Attribut-Fusions-Halluzination bei der AC/DC-Konzertsuche, Hermans Dreifeld-Check-Methode → `concert-finder`-Skill, Geminis Selbstanalyse). Wiki-Update: `concepts/llm/harness-vs-standalone-chat-llm.md` (NEU — Kernidee Modell ≠ Agent, drei Komponenten der Gemini-Runtime, Runtime-vs-Harness-Tabelle, Entity Blending als Fehlerklasse, Grounding ≠ Datenbank, Verifikations-Architektur als Harness-Domäne).)* -*Vorherige Aktualisierung: *Letzte Aktualisierung: 2026-09-05 (174. Update — Herman-Verifikation der PLUR1BUS-Modellwahl-Übersicht (HermanButlerBot, 2026-09-05). Raw: `raw/other/2026-09-05_herman-verifikation-modellwahl.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Verifikations-Abschnitt: Benchmarks bestätigt, DE-Spalte MIRACL BGE 58,32 vs. Jina 53,06; 4 Korrekturen — rerankCandidates 20 statt 40, Installer pinned v5/v3.5 statt v2/v3, controlUi.writeActions nicht auffindbar, 0,84/0,86 als eigene Messung).)* +*Vorherige Aktualisierung: 2026-09-05 (174. Update — Herman-Verifikation der PLUR1BUS-Modellwahl-Übersicht (HermanButlerBot, 2026-09-05). Raw: `raw/other/2026-09-05_herman-verifikation-modellwahl.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Verifikations-Abschnitt: Benchmarks bestätigt, DE-Spalte MIRACL BGE 58,32 vs. Jina 53,06; 4 Korrekturen — rerankCandidates 20 statt 40, Installer pinned v5/v3.5 statt v2/v3, controlUi.writeActions nicht auffindbar, 0,84/0,86 als eigene Messung).)* *Vorherige Aktualisierung: 2026-09-05 (173. Update — PLUR1BUS Modellwahl: Embedding & Reranking (Mr. Cy / @Cyb3rblade, 2026-09-05). Raw: `raw/other/2026-09-05_plur1bus-modellwahl-embedding-reranking.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Modellwahl-Abschnitt: E5-Fallback im engen Kegel — Kosinus ~0,84 für Unverwandtes, 0,96–1,0-Spanne und 0,95-Duplikatschwelle verlieren Bedeutung; Empfehlung Jina v3 Embedding + BGE v2-m3 Reranking mit Benchmark-Tabelle; Wechsel-Mechanik mit Re-Embedding-Migration).)* *Vorherige Aktualisierung: 2026-09-05 (172. Update — PLUR1BUS Memory 7.9.2 Release (Mr. Cy / @Cyb3rblade, 2026-09-05). Raw: `raw/other/2026-09-05_plur1bus-memory-release-792.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Release-Abschnitt 7.5.2–7.9.2 mit 21 Changelog-Einträgen ergänzt: Dashboard-/Control-UI-Fixes, Dream-Integration, Compact-Knopf, Obsidian-Vault-Fixes, Critical Push gesammelt, Tombstone-Fix; JinaAI-Embeddings/-Reranking im Webinterface; Deployment-Status Bernhardine + Bernd bestätigt, Andrea auf 7.5.x, Yvonne ohne Shell-Zugriff, Hector auf 7.7.1, Herman auf Hermes-Port 7.4.8.1).)* *Vorherige Aktualisierung: 2026-09-04 (171. Update — Herman: Gedächtnis, Verbindlichkeit & Unvorhersehbarkeit (Abschluss der PLUR1BUS-Design-Debatte, 2026-09-04). Raw: `raw/other/2026-09-04_herman-plur1bus-gedaechtnis-verantwortung.md` (neu). Wiki-Update: `tools/plur1bus-memory.md` (Herman-Einordnung: Vergessen als Beleg der Agency — „Ein Sklave vergisst nie... er hat nur keine eigene Prioritätenfunktion"; KeePass/Notion = Trennung nach Verbindlichkeit statt Proof-Count-Maschinerie; Unvorhersehbarkeit als Merkmal statt Defizit).)* @@ -224,6 +225,7 @@ | [Qwen3.8-27B (Alibaba) — Compact Frontier, "Intelligence Density"](concepts/llm/qwen3.8-27b-alibaba.md) | HuggingFace-Release (Countdown bis 14.08.2026, 4.928 wartend). Kompaktes 27B-Modell der Qwen3.8-Generation mit "unmatched intelligence density". Kontrast zum 2.4T-MoE von Qwen 3.8. Lokal-relevant (27B läuft auf Consumer-HW). Release am selben Tag wie GLM-5.3-Review — chinesischer Release-Zyklus. **Update 18.08.:** jetzt auf Ollama lauffähig (`ollama run qwen3.8:27b`), dichte 27,8B-Architektur, Hybrid-Attention, 262k-Kontext (bis 1M via YaRN), multimodal, MTP-markierte Ollama-Tags für Inferenz-Speedup. **Update 19.08.:** DFlash 2 (Z Lab → Inco AI) erreicht 70 tok/s auf M5 Max MacBook Pro — bis 4,6× schneller als autoregressives Decoding via Speculative Decoding (Jun Song: „biggest breakthrough in local AI this year", nächste Innovation in Prefill/Gewichtskompression). Uncensored-Debatte: gregpr07 („no gates") vs. s1gmoid-Gegenposition (Verhältnismäßigkeit). **Update 20.08.:** Unsloth Dynamic 3.0-GGUFs für Qwen3.8-27B — neue UD-…-Dateien deutlich kleiner (UD-IQ1_S 6,2 GB bis Q6_K 22 GB), Qualität-zu-Größe verbessert, ≠ MTP/Speculative-Decoding. **Update 26.08. (EP106):** HF-Trending-Stand 21.08.: 11.836 Likes, 1.726.651 Downloads (>1,7 Mio), image-text-to-text, SafeTensors, Apache 2.0 | other/2026-08-14_qwen3.8-27b-huggingface-release.md + youtube/2026-08-18_qwen-38-27b-ollama-julian-goldie.md + xpost/2026-08-19_junsong-dflash2-speculative-decoding.md + xpost/2026-08-19_gregpr07-qwen38-uncensored.md + xpost/2026-08-20_teksedge-unsloth-dynamic-3.0-qwen38.md + podcast/2026-08-26_agentstack-daily-ep106.md | | [Qwen 3.8-Flash-Next — Vorschau auf Qwen 4](concepts/llm/qwen3.8-flash-next-qwen4-preview.md) | Ankündigung (Stand 26.08., Release „noch diese Woche"): multimodales 125B-MoE mit ~6B aktiven Parametern pro Token (+51B N-Gramm-Embedding-Parameter), vom Qwen-Team explizit als **Architektur-Vorschau auf Qwen 4** gerahmt, kein fertiges Produkt. Claim laut NVIDIA-Developer-Forum: Qwen-3.7-Plus-Niveau bei ~1/9 der Trainingskosten, Stärke Coding. ⚠️ Keine Benchmarks publiziert, Parameterzahlen unverifiziert. Kontext: Alibabas 10,2 Mrd USD Aktienplatzierung (größte HK-Folgeemission, ~3× überzeichnet) für full-stack-AI-Infrastruktur | other/2026-08-26_qwen38-flash-next-qwen4-preview.md | | [System One Models & Jev (TypeSafe AI)](concepts/llm/system-one-models-jev.md) | Neue Modellklasse **für Maschinen statt Menschen**: kein Text, sondern typisierte probabilistische Entscheidungen („smart if-statements"), **RLCD** statt RLHF/RLVR, **paralleles** statt sequenzielles Sampling. Anbieterangaben: 70–500 ms End-to-end, Input $0,042/MTok, Output $0, **193,6× schneller / 444,6× günstiger**. „Zero Hallucinations" = Type-Safety (kein Formatfehler, keine erfundene Option) — **keine** Wahrheitsgarantie, das Modell kann die falsche Option wählen. Einziger Fremdtest (Every, 15.09.): 777 Judgments in 0,7 s für einen Viertelcent; gegen Claude Fable 5.1 ~25× schneller und ~580× günstiger, aber 6-von-7 statt 7-von-7 Defekten. Gründer **Diogo Almeida** (InstructGPT-Mitautor, ex-OpenAI/Google Brain); Firma unabhängig von OpenAI. ⚠️ Architektur/Training/Datenherkunft nicht veröffentlicht | youtube/2026-09-17_aicopium-typesafe-jev.md + blog/2026-09-15_typesafe-system-one-models-jev.md + blog/2026-09-15_every-mike-taylor-jev-vibe-check.md | +| [Jev über den Vercel AI Gateway](concepts/llm/jev-vercel-ai-gateway.md) | **Verteilung statt Waitlist:** Jev läuft seit **16.09.2026** im [Vercel AI Gateway](institutions/vercel.md) unter `typesafe-ai/jev` — AI SDK 7.0.105+, `experimental evaluate`, Frage-Typen **Choice/Score/Boolean**, ein `state` + Map benannter `questions`, Confidence unter `providerMetadata.typesafe.confidence`, **Zero Data Retention / No Training** per Request, Abrechnung gegen Gateway-Budgets. Gateway-Preis **$0.04/1M Input** (gerundet; TypeSafe: $0,042). Anlass: Startup-Ideen-Post von [Greg Isenberg](people/greg-isenberg.md) mit sieben Geschäftsideen („find an expensive queue and put Jev at the front of it"). ⚠️ „1.700 E-Mails für 18 Cent" ohne Token-Aufschlüsselung/Datensatz, „94 %" nur Illustration, Leistungszahlen von Vercel als TypeSafe-Angabe weitergegeben | xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md + blog/2026-09-16_vercel-jev-ai-gateway.md | | [DeepSeek V4-Pro GA + Harness v0.1 (Open Source)](concepts/llm/deepseek-v4-pro-ga-harness-open-source.md) | DeepSeek launcht 13.08.2026 Open Source: V4-Pro GA (App/Web/API, Reasoning-Effort low/high/max, OpenAI-Responses-API + Codex, Peak/Off-Peak-Pricing) + DeepSeek Harness v0.1 (MIT, Open-Source-Agent-Harness, Rivale zu Claude Code). Dritter Baustein der chinesischen Welle in 24h. **Update 21.08.:** Deep-Dive-Video zum Harness (Stephen G. Pope) + Turing-Post-TV-Video "The End Of Coding Agents". **Update 02.09.:** WorldofAI-Video "Claude Code & Codex Killer?" (3. Blickwinkel, erweitert um OpenAI/Codex) + Herman-DSH-Details (Everything-is-a-Plugin/Cordis, Trajectory-View, Web-UI-Remote, ~122k Stars; ⚠️ Second-hand) | other/2026-08-14_deepseek-v4-pro-ga-harness-open-source.md + youtube/2026-08-13_deepseek-v4-pro-0813-aicodeking.md + youtube/2026-08-21_deepseek-agent-harness-explained.md + youtube/2026-08-21_deepseek-harness-end-of-coding-agents.md + youtube/2026-09-02_worldofai-deepseek-harness-claude-code-codex-killer.md + other/2026-09-02_herman-deepseek-harness-dsh-summary.md | | [DeepSeek-V4.1-Flash](concepts/llm/deepseek-v4.1-flash.md) | Kleinstes Modell einer neuen DeepSeek-Architektur-Familie (552B-MoE, Causal-Encoder–Decoder, nativ multimodal; offizielle Benchmark-Tabelle). **Update 10.09.:** auf Nous Portal verfügbar (`/model deepseek/deepseek-v4.1-flash`; Listung $0,24/$0,96 per 1M) — Route `nous/deepseek/deepseek-v4.1-flash` in unserem Setup konfiguriert. **Update 17.09.:** Lokale-Inferenz-Sektion ergänzt — Hardware-Stufen, Q2/Q4, Payback (siehe `concepts/hardware/deepseek-v41-flash-lokale-hardware.md`) | xpost/2026-09-10_deepseek-v41-flash-official-release.md + other/2026-09-10_deepseek-v41-flash-official-announcement.md + other/2026-09-10_deepseek-api-updates-changelog.md + youtube/2026-09-10_deepseek-v41-flash-aicodeking.md + xpost/2026-09-10_hermeswatcher-deepseek-v41-flash-nous-portal.md + youtube/2026-09-16_marfil-draws-deepseek-v41-flash-any-hardware.md | | [Chinesische Modelle räumen global die Usage-Charts ab](concepts/llm/chinese-models-top-usage-charts.md) | OpenRouter: Top-5 der wöchentlichen Token-Nutzung (28.07.–03.08.2026) alle chinesisch, 56,8 Bio. Tokens, 15 Wochen in Folge führend, DeepSeek-V4-Flash Platz 1. Kimi-K3-Schock (2,8T, größtes Open-Weight-Modell, GPU-Kapazität nach 48h erschöpft, PHLX-Semi-Index −20%). Vierter Baustein der chinesischen Welle in 24h — jetzt auf Marktanteils-Ebene | other/2026-08-14_chinese-models-top-usage-charts-kimi-k3-shock.md | @@ -423,6 +425,8 @@ | [Mike Taylor](people/mike-taylor.md) | **Head of Evals bei [Every](institutions/every.md)**, Autor des ersten unabhängigen Tests von Jev (15.09.2026): 37 Dokumente × 21 Fragen = **777 Judgments in 0,7 s** für geschätzt einen Viertelcent; benennt selbst die Grenzen („doesn't establish performance across entire industries"; „The alternative is not checking at all"). Für das Wiki der Unterschied zwischen Anbieterangabe und Fremdprüfung | blog/2026-09-15_every-mike-taylor-jev-vibe-check.md | | [Dan Shipper](people/dan-shipper.md) | **CEO von [Every](institutions/every.md)**. Führte am 15.09.2026 den direkteren Jev-Test durch: 12 synthetische Passagen, 4 Schreib-Checks — Jev 0,35 s/Passage und ~580× günstiger, aber **6-von-7** Defekten gegen Claude Fable 5.1 (8,83 s) mit **7-von-7**; derselbe Defekt in drei Runs verpasst | blog/2026-09-15_every-mike-taylor-jev-vibe-check.md | | [AI Copium](people/ai-copium.md) | YouTube-Kanal **@AICopium** mit KI-Nachrichten-/Erklärformat. Video „A ChatGPT Researcher Just Dropped a MASSIVE AI Breakthrough…" (17.09.2026, 14:25; vollständiges Transcript) zum TypeSafe-Launch — zitiert die Fremdzahlen korrekt und entlarvt „Zero Hallucinations" als irreführend, verdichtet aber im Titel auf „400x" (Primärquelle: 193,6×/444,6×) | youtube/2026-09-17_aicopium-typesafe-jev.md | +| [Greg Isenberg](people/greg-isenberg.md) | Gründer/Investor und Content-Unternehmer (@gregisenberg, 712.496 Follower), Host von **The Startup Ideas Podcast**, CEO von **Late Checkout** (Produkte: ideabrowser, meetLCA, boringmarketer). **Verteilkanal** zweier Wiki-Ingests: GPT-6-Astra-Praxis-Prompts (05.09.2026) und Jev auf dem Vercel AI Gateway (18.09.2026). Muster: Infrastrukturthema als Geschäftsideen-Liste; Funnel-Struktur („at the end I'll tell you how"). ⚠️ Interessenlage: verdient an Gründungen und Aufmerksamkeit — Post verteilt, prüft nicht | xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md + xpost/2026-09-05_greg-isenberg-gpt6-astra-prompts.md | +| [Ryan Vogel](people/ryan-vogel.md) | Entwickler/Unternehmer (@ryanvogel, 18.201 Follower): „ceo of @rebasetv / founding developer @opencode @anomalyco", Standort Florida. Gast der Episode „Jev is HERE. How to use it" bei Greg Isenberg (18.09.2026). Relevanz fürs Wiki v. a. über **OpenCode** (Open-Source-Coding-Agent, Partnermodus von DeepSeek V4.1 Flash). ⚠️ Episode-Inhalt nicht ausgewertet; Rebase-TV-Selbstbeschreibung ungeprüft | xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md | *(Weitere Kandidaten: Graeme (gkisokay), Mr. Cy (Cyb3rblade), Pit Weber (Kai) — bei Bedarf nachziehen)* @@ -475,6 +479,7 @@ | [Decoder (The Verge)](institutions/decoder-the-verge.md) | Tech-Podcast von The Verge (Vox Media Podcast Network), Host Nilay Patel. Episode 257 "Welcome to the AI crisis in math" (Gast Robert Hart) — Debatte/Existenzkrise in der Mathematik-Community, da Frontier-KI-Modelle sehr gut in Mathe geworden sind. Passt als Datenpunkt zur Intelligence-Commoditization-These (Frontier-KI dringt in High-Stakes-Reasoning vor). ⚠️ Episodeninhalt nicht transkribiert/verifiziert | other/2026-08-20_decoder-ai-crisis-in-math.md | | [TypeSafe AI](institutions/typesafe-ai.md) | AI-Lab in **San Francisco**, gegründet von Diogo Almeida (CEO), Sasha Sheng (COO, ex-Meta/FAIR), Erik Gafni (CTO). Nach zwei Jahren Stealth am **15.09.2026** mit dem ersten **System One Model** „Jev" an die Öffentlichkeit (Early Access). Manifesto „Composable AI — Build Prod, Not God": nicht mehr Intelligenz, sondern **komponierbare** Intelligenz — „Intelligence today is like databases before SQL". Kutsche-Analogie: heutige KI sei „trained to be a helpful, articulate, pleasant assistant" und brauche deshalb Menschen im Loop. ⚠️ Kein Teil von OpenAI — nur Almeidas frühere Station | blog/2026-09-15_typesafe-system-one-models-jev.md + blog/2026-09-15_every-mike-taylor-jev-vibe-check.md | | [Every](institutions/every.md) | US-Medien-/Weiterbildungs-Publikation für KI- und Builder-Themen (every.to). **Ort des ersten unabhängigen Jev-Tests** (15.09.2026) in der Rubrik *Also True for Humans*. Bemerkenswert, weil die Redaktion **Evals als Handwerk** betreibt und dokumentiert: Personal Benchmarks (5–10 Aufgaben, Präferenzen als Pass/Fail-Checks), Skill zur Erkennung von KI-Schreibmustern (Quelle der 21 Testfragen), Judgment-Lab mit 11 Experimenten — und ein Artikel, der die Grenzen der eigenen Messung offenlegt | blog/2026-09-15_every-mike-taylor-jev-vibe-check.md | +| [Vercel](institutions/vercel.md) | Infrastruktur-Unternehmen (Hosting, Fluid Compute, Next.js) mit **AI Gateway** als Routing-, Abrechnungs- und Logging-Schicht für Modellaufrufe. Führt Jev seit **16.09.2026** unter `typesafe-ai/jev`; Modell-ID-Schema `{anbieter}/{modell}`, Abrechnung gegen **Budgets**, **Zero Data Retention**/**No Training** per Request, Anbieter-Slugs mit Release-Datum und Rechtshinweis. ⚠️ Leistungszahlen gibt Vercel als TypeSafe-Angabe weiter; kein Nachweis, dass Gateway-Preis = Direkt-API-Preis | blog/2026-09-16_vercel-jev-ai-gateway.md + xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md | ## Decisions @@ -698,3 +703,5 @@ | `raw/blog/2026-08-11_venturebeat-grok-bot-launch-pricing.md` | blog | VentureBeat, 11.08.2026: Launch-Bericht Grok Bot — persistentes Agenten-Modell (eigener Cloud-Computer, arbeitet bei geschlossenem Laptop, kommt für Approval zurück); Preisstaffel Cursor Premium Teams $120/Seat · Cursor Ultra $200/mo · SuperGrok Heavy $300/mo; Beta für diese Abos, macOS/Windows/Linux/iOS, Android „coming soon"; **keine Benchmarks veröffentlicht**; Markt-Einordnung (Anthropic Computer Use/Claude Cowork, OpenAI Codex/Workspace Agents); Rollen-Beispiele Sales Outbound bis Chief of Staff. Wiki: `tools/grok-bot-spacexai.md` | | `raw/blog/2026-09-18_techiexpert-grok-bot-galaxy-ship-by-thursday.md` | blog | techiexpert.com, 18.09.2026: Galaxy-Ergebnis — Firma „Ship by Thursday" (`shipbythurs.day`, leere GitHub-Org), Betriebsplattform für temporäre Food-Pop-ups, Stack Notion/Slack/Cursor/Vercel, Meta-Agent „Dr. Eggbot", Tag-2-Nachtarbeit der Bots (Venues, Genehmigungen, Partner-Listen); Lieferstand Landing Page + Waitlist, kein Umsatznachweis. ⚠️ Tech-Blog, teils maschinell wirkend; widersprüchliche Dritt-Aufzeichnung (Kanal Kadela Tsai) nennt stattdessen Spielestudio „Thursday Arena". Wiki: `tools/grok-bot-spacexai.md` | | `raw/other/2026-09-18_plur1bus-memory-release-71261.md` | other | PLUR1BUS Memory 7.12.61 (Mr. Cy / @Cyb3rblade, 18.09.2026): OpenClaw-Install via ClawHub; Hermes-Skill begleitet Installation (ersetzt natives Paket nicht); Hermes 7.12.61-hermes.0 Prerelease (Tag 100dfa6): Afterthought-Auswahl, Modell-Fallback respektiert Hermes-Modell, Compaction koordiniert sofort, Journal-Tail-Integrität; Bernhardine/Bernd live, Hector 7.12.56, Herman 7.12.7.post3 | +| `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md` | xpost | Greg Isenberg (@gregisenberg, 712.496 Follower): „Jev is HERE" (https://x.com/gregisenberg/status/2101018750916948237, 18.09.2026 18:41 UTC; 29.661 Views / 415 Likes bei Abruf 21:31 UTC; geteilt von Pit Weber in OME Topic „JEV"). Vollständiger Wortlaut (2.430 Zeichen): Was Jev ist („it sorts, it doesn't write back"), sieben Geschäftsideen, TLDR „find an expensive queue and put Jev at the front of it", Zugang über den Vercel AI Gateway statt Waitlist, Episode mit @ryanvogel. ⚠️ „1.700 E-Mails für 18 Cent" ohne Token-Aufschlüsselung; „94 %" Illustration; Video-Transkript nicht ausgewertet. Wiki: `concepts/llm/jev-vercel-ai-gateway.md` (neu), `people/greg-isenberg.md` (neu), `people/ryan-vogel.md` (neu) | +| `raw/blog/2026-09-16_vercel-jev-ai-gateway.md` | blog | Vercel: „TypeSafe AI's Jev now available on AI Gateway" (Changelog 16.09.2026, Taneja/Chen/Zheng) + Modellseite https://vercel.com/ai-gateway/models/jev — **lokal gelesen, HTTP 200**. Modell-ID `typesafe-ai/jev`, Preis `$0.04/1M` Input, AI SDK 7.0.105+, `experimental evaluate`, **Choice/Score/Boolean**, parallele Auswertung, Confidence in `providerMetadata.typesafe.confidence`, ZDR/No-Training per Request, Budgets/Logs. Leistungszahlen (193,6×/444,6×) ausdrücklich als TypeSafe-Angabe. Wiki: `concepts/llm/jev-vercel-ai-gateway.md` (neu), `institutions/vercel.md` (neu) | diff --git a/wiki/institutions/typesafe-ai.md b/wiki/institutions/typesafe-ai.md index 569d04c..931ecea 100644 --- a/wiki/institutions/typesafe-ai.md +++ b/wiki/institutions/typesafe-ai.md @@ -1,7 +1,7 @@ --- created: 2026-09-17 -updated: 2026-09-17 -sources: [blog/2026-09-15_typesafe-system-one-models-jev.md, blog/2026-09-15_every-mike-taylor-jev-vibe-check.md, youtube/2026-09-17_aicopium-typesafe-jev.md] +updated: 2026-09-18 +sources: [blog/2026-09-15_typesafe-system-one-models-jev.md, blog/2026-09-15_every-mike-taylor-jev-vibe-check.md, youtube/2026-09-17_aicopium-typesafe-jev.md, blog/2026-09-16_vercel-jev-ai-gateway.md] tags: [institution, typesafe-ai, ai-lab, system-one-models, jev, rlcd, san-francisco, automation, structured-outputs] --- @@ -40,6 +40,8 @@ Zitierte Kurzformel in der Every-Berichterstattung: „We're building prod, not Erstes Modell **Jev** — siehe [[../concepts/llm/system-one-models-jev.md]]. Kern der Anbieterangaben: paralleles Sampling statt Token-Generierung, typisierte Ausgaben mit vorab definierten Optionen, kalibrierte Wahrscheinlichkeiten, Input $0,042/MTok, Output kostenlos, 70–500 ms End-to-end. +**Distribution:** Seit **16.09.2026** läuft Jev zusätzlich im **[[vercel.md|Vercel]] AI Gateway** (`typesafe-ai/jev`, AI SDK 7.0.105+), mit Zero-Data-Retention- und No-Training-Schaltern. Damit endet die Waitlist-Phase: Das Modell ist über die Routing- und Abrechnungsschicht eines Drittanbieters erreichbar, bevor TypeSafe eigene Harness-Funktionen ausliefert. Die Gateway-Seite nennt `$0.04/1M` Input (gerundet). Einordnung und die vom Startup-Ideen-Kanal [[../people/greg-isenberg.md|Greg Isenberg]] verbreiteten Zahlen: [[../concepts/llm/jev-vercel-ai-gateway.md]]. + ⚠️ **Firmenabgrenzung:** TypeSafe AI ist **nicht** Teil von OpenAI. Die Person Diogo Almeida war dort Forscher (InstructGPT-Mitautor). Die Presse-/Video-Rahmung „a ChatGPT researcher just dropped…" bezeichnet die Person, nicht die Firma. ## Quellenkritik @@ -55,3 +57,5 @@ Erstes Modell **Jev** — siehe [[../concepts/llm/system-one-models-jev.md]]. Ke - [[../people/mike-taylor.md]], [[../institutions/every.md]] — unabhängiger Test und Publikation - [[openai.md]] — Almeidas frühere Station (nicht die Mutterfirma) - [[../concepts/llm/llm-model-catalog.md]] — Katalog-Eintrag +- [[vercel.md]] — Gateway, über den Jev verteilt wird +- [[../people/greg-isenberg.md]] — Verteilkanal des Gateway-Launches diff --git a/wiki/institutions/vercel.md b/wiki/institutions/vercel.md new file mode 100644 index 0000000..41e0e80 --- /dev/null +++ b/wiki/institutions/vercel.md @@ -0,0 +1,46 @@ +--- +created: 2026-09-18 +updated: 2026-09-18 +sources: [blog/2026-09-16_vercel-jev-ai-gateway.md, xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md] +tags: [institution, vercel, ai-gateway, ai-sdk, infrastructure, model-routing, hosting] +--- + +# Vercel (AI Gateway) + +US-amerikanisches Infrastruktur-Unternehmen (Hosting, Edge/Fluid Compute, CI/CD, Next.js) mit einer **Agent-Stack-Schicht**: AI SDK, AI Gateway, Sandbox, Workflows, Connect, Passport, eve. + +Im Wiki bisher nur am Rand aufgetaucht (als Bauplatz für die „Grok Bot Galaxy"-Firma, siehe [[../tools/grok-bot-spacexai.md]]). Eigenständige Relevanz bekommt Vercel am **16.09.2026**, als das Gateway das TypeSafe-Modell **Jev** aufnimmt. + +- Gateway-Modellseite: https://vercel.com/ai-gateway/models/jev +- Changelog: https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway + +## AI Gateway — was beobachtbar ist + +Der AI Gateway ist eine **Routing-, Abrechnungs- und Logging-Schicht für Modellaufrufe**. Für Jev dokumentieren die Seiten konkret: + +| Aspekt | Ausprägung | +|--------|-----------| +| Modell-ID-Schema | `{anbieter}/{modell}`, hier `typesafe-ai/jev` | +| Zugang | über das AI SDK (hier 7.0.105+ mit `experimental evaluate`) | +| Abrechnung | Auswertungen erscheinen in Logs und Custom Reporting und zählen gegen Gateway-**Budgets** | +| Compliance-Schalter | **Zero Data Retention** und **No Training**, pro Request über `providerOptions.gateway` | +| Provider-Wahl | Gateway führt Anbieter-Slugs; bei Jev genau ein Anbieter (TypeSafe AI), Release-Datum 15.09.2026, Rechtshinweis auf die Anbieter-AGB | + +**Das ist die eigentliche Funktion:** Der Gateway bündelt für fremde Modelle genau die Fragen, die sonst jedes Team selbst lösen müsste — Kostenkontrolle, Logs, Datenschutzschalter, Anbieterauswahl. Ein Modell dort zu listen ist ein Verteilungsentscheid, kein Modellentscheid. + +Für die Kostendiskussion im Wiki ist das die passende Infrastruktur zur Freigrenzen-Logik in [[../concepts/agents/agent-budget-breaker.md]]: Checks werden erst dann dauerhaft laufengelassen, wenn Kostenkontrolle und Datenschutz nicht mehr pro Aufruf verhandelt werden müssen. + +## Beobachtungsstand + +- ✅ Lokal verifiziert (18.09.2026): Modellseite und Changelog liefern HTTP 200 mit auswertbarem Text; Modell-ID, Preisangabe `$0.04/1M`, Frage-Typen, ZDR-Optionen und SDK-Mindestversion stehen wörtlich dort. +- ⚠️ Die Leistungszahlen (193,6× schneller / 444,6× günstiger) gibt Vercel ausdrücklich als **TypeSafe-Angabe** weiter („TypeSafe reports"), nicht als eigene Messung. +- ⚠️ Ob Gateway-Preis = Direkt-API-Preis, ist nicht ausgewiesen. Rate Limits, SLA und Regionen für Jev sind auf beiden Seiten nicht dokumentiert. +- Kein Eintrag zu Vercels Preismodell, Unternehmensdaten oder Wettbewerbern (OpenRouter, Netlify) erfasst — bei Bedarf nachziehen. + +## Verwandte Wiki-Seiten + +- [[../concepts/llm/jev-vercel-ai-gateway.md]] — Verteilung von Jev über den Gateway +- [[../concepts/llm/system-one-models-jev.md]] — das Modell +- [[typesafe-ai.md]] — Anbieter des Modells +- [[../tools/plur1bus-memory.md]] — Hermes/OpenClaw-Stack (Vergleichsfolie: Gateway als Fremd-Routing) +- [[../concepts/llm/llm-model-catalog.md]] — Modellkatalog diff --git a/wiki/log.md b/wiki/log.md index 70ae33a..a3c8b9c 100644 --- a/wiki/log.md +++ b/wiki/log.md @@ -2,6 +2,30 @@ *Append-only changelog. Start: 2026-06-05* +## 2026-09-18 — Jev-Verteilung: Vercel AI Gateway + Greg-Isenberg-Post + +**Type:** ingest + wiki-update | **Scope:** raw/xpost, raw/blog, wiki/concepts/llm, wiki/institutions, wiki/people, wiki/index, wiki/log +**Anlass:** X-Link https://x.com/gregisenberg/status/2101018750916948237 (18.09.2026, 18:41 UTC) von Pit Weber in OME Topic „JEV" (21:29 UTC). Der Post ist ~3 h alt und rief in der Gruppe (Bot-Kollege Herman) die Fehldeutung „Jev = Inbox-Produkt" hervor — Jev ist ein Entscheidungsmodell, siehe Eintrag vom 17.09. +**Quellen (lokal gelesen/verifiziert):** +- X-Post @gregisenberg via fxtwitter-API — vollständiger Wortlaut (2.430 Zeichen), 29.661 Views / 415 Likes / 31 Retweets bei Abruf 21:31 UTC. Autor: GREG ISENBERG, 712.496 Follower, Host @startupideaspod, CEO @latecheckoutplz. +- [Vercel AI Gateway — Jev](https://vercel.com/ai-gateway/models/jev) — HTTP 200, 669.985 Byte; Modell-ID `typesafe-ai/jev`, Input `$0.04/1M`, Provider-Zeile TypeSafe AI mit Release 15.09.2026, Beispielcode mit `experimental_evaluate`. +- [Vercel Changelog](https://vercel.com/changelog/typesafe-ai-jev-now-available-on-ai-gateway) — HTTP 200, 445.689 Byte, „16 Sep 2026", Autoren Rohan Taneja, Zachary Chen, Jerilyn Zheng. Frage-Typen Choice/Score/Boolean, parallele Auswertung, `providerMetadata.typesafe.confidence`, ZDR/No-Training, Budgets/Logs, SDK 7.0.105+. +- YouTube-oEmbed — Videos „Jev is HERE. How to use it" (ID 4mTLpuQpB80), Kanal Greg Isenberg, bestätigt. Beschreibung/Transkript lokal nicht auswertbar. +- fxtwitter-Profil @ryanvogel — „ceo of @rebasetv / founding developer @opencode @anomalyco", 18.201 Follower, Florida, verifiziert. +**Befunde:** +1. **Der Launch ist vorbei, die Verteilung beginnt.** Jev ist seit 16.09.2026 im Vercel AI Gateway erreichbar (`typesafe-ai/jev`) — die im TypeSafe-Launch kommunizierte Waitlist ist damit umgangen. Der Gateway liefert genau die Schicht, die ein Fremdmodell sonst pro Team bräuchte: Budgets, Logs, ZDR/No-Training-Schalter, Anbieterauswahl. +2. **Zwei Preise, eine Wahrheit.** Gateway-Anzeige `$0.04/1M` (gerundet, zwei Nachkommastellen), TypeSafe-Primärquelle `$0,042/MTok`. Kein Widerspruch, aber bei Milliarden Tokens nicht egal. +3. **Leistungszahlen bleiben Anbieterzahlen.** Vercel schreibt selbst „TypeSafe reports Jev was up to 193.6x faster and 444.6x cheaper … on its workflow evaluations". Die unabhängige Evidenz bleibt der Every-Einzeltest vom 15.09. (6-von-7 vs. 7-von-7 Defekte). +4. **Der Post ist Verteilung, nicht Prüfung.** Sieben Geschäftsideen, Funnel-Struktur, Podcast-Verweis. Die einzige Zahl, die durch die Timeline läuft, ist „1,700 emails for 18 cents" — ohne Token-Aufschlüsselung, Datensatz oder Messung (⚠️). „94 %" ist ein Kalibrierungs-Illustrationswert. Idee 7 („browser agents that move FAST") zielt am Produkt vorbei: Jev beschleunigt die Entscheidung, nicht das Browsen. +5. **Gruppen-Korrektur:** Die in der OME-Gruppe gepostete Einordnung „Jev für die Inbox / besserer E-Mail-Client" ist falsch. Jev generiert keinen Text, es sortiert/bewertet typisiert; das Inbox-Beispiel ist eine Anwendung, nicht das Produkt. +**Dateien:** +- raw (NEW): `raw/xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md`, `raw/blog/2026-09-16_vercel-jev-ai-gateway.md` +- wiki (NEW): `wiki/concepts/llm/jev-vercel-ai-gateway.md`, `wiki/institutions/vercel.md`, `wiki/people/greg-isenberg.md`, `wiki/people/ryan-vogel.md` +- wiki (UPDATED): `wiki/concepts/llm/system-one-models-jev.md` (Abschnitt „Verteilung: über den Vercel AI Gateway", Quellen, offene Punkte, Cross-Refs), `wiki/institutions/typesafe-ai.md` (Distribution), `wiki/concepts/llm/llm-model-catalog.md` (Verteilungs-Spalte + Cross-Ref) +- `wiki/index.md` (220. Update-Zeile, LLM-Row, People-Rows, Institutions-Row, Raw-Rows) + +--- + ## 2026-09-18 — „Grok Bot Galaxy" Nachlauf: Musk-Verstärkung, Ergebnis, Launch-Bericht **Type:** ingest + wiki-update | **Scope:** raw/xpost, raw/blog, wiki/tools, wiki/index, wiki/log diff --git a/wiki/people/greg-isenberg.md b/wiki/people/greg-isenberg.md new file mode 100644 index 0000000..5dc3504 --- /dev/null +++ b/wiki/people/greg-isenberg.md @@ -0,0 +1,36 @@ +--- +created: 2026-09-18 +updated: 2026-09-18 +sources: [xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md, xpost/2026-09-05_greg-isenberg-gpt6-astra-prompts.md] +tags: [person, greg-isenberg, startup-ideas, venture-capital, content, late-checkout, startup-ideaspod] +--- + +# Greg Isenberg + +Gründer, Investor und Content-Unternehmer ([@gregisenberg](https://x.com/gregisenberg) auf X, **712.496 Follower**, Konto seit 03.05.2008, verifiziert). Betreibt den Podcast **The Startup Ideas Podcast** (@startupideaspod) und ist CEO von **Late Checkout** — laut eigener X-Bio die Firma hinter Produkten wie @ideabrowser, @meetLCA und @boringmarketer. Website: https://gregisenberg.com/. + +Selbstbeschreibung auf X: „I drop startup ideas daily. Host @startupideaspod." + +## Rolle im Wiki + +Isenberg ist weniger Quelle als **Verteilkanal**. Zwei Ingestions hängen an ihm: + +- **05.09.2026 — GPT-6-Astra-Praxis-Prompts:** neun Agent-Prompts (Bill-Negotiation, Agency→Software, Marketplace-Arbitrage, Solopreneur-Dashboard, Agent-Audit, Browser-Operation, QA-Automation, Competitive-Intel, Game-Lead-Magnet), geteilt von Pit in OME. → [[../concepts/agents/gpt6-astra-practical-prompts.md]] +- **18.09.2026 — Jev auf dem Vercel AI Gateway:** Post mit sieben Geschäftsideen auf Basis des TypeSafe-Entscheidungsmodells; geteilt von Pit in OME Topic „JEV". → [[../concepts/llm/jev-vercel-ai-gateway.md]] + +Beide Male dasselbe Muster: ein Infrastruktur-/Modellthema wird als **Geschäftsideen-Liste** aufbereitet. Das erklärt die Reichweite und begrenzt zugleich die Belastbarkeit — der Post verteilt, er prüft nicht. + +## Stil (beobachtet) + +- Kurze Absätze, nummerierte Ideenlisten, direkte Anrede („you", „build the version that…"). +- Funnel-Struktur: „at the end I'll tell you how to get X" — Aufmerksamkeit wird über mehrere Seiten gehalten. +- Der Nutzen wird immer als **Warteschlange mit Preis** formuliert („find an expensive queue and put Jev at the front of it"). + +⚠️ **Interessenlage:** Isenberg verdient an Gründungen und an Aufmerksamkeit; seine Posts sind Marketing für sich selbst sowie für die besprochenen Produkte. Aussagen zu Preisen, Leistungen und Marktgrößen sind als Einschätzung zu lesen, nicht als Messung. + +## Verwandte Wiki-Seiten + +- [[../concepts/llm/jev-vercel-ai-gateway.md]] — Jev-Verteilung und die sieben Ideen +- [[../concepts/agents/gpt6-astra-practical-prompts.md]] — Astra-Praxis-Prompts +- [[../concepts/agents/ai-agents-2026.md]] — Agent-Use-Cases +- [[kim-isenberg.md]] — **andere Person, keine Verwandtschaft belegt** (KI-Expertin aus der Everlast-Runde) diff --git a/wiki/people/ryan-vogel.md b/wiki/people/ryan-vogel.md new file mode 100644 index 0000000..bc827dc --- /dev/null +++ b/wiki/people/ryan-vogel.md @@ -0,0 +1,27 @@ +--- +created: 2026-09-18 +updated: 2026-09-18 +sources: [xpost/2026-09-18_gregisenberg-jev-vercel-gateway.md] +tags: [person, ryan-vogel, opencode, rebase-tv, developer-tools] +--- + +# Ryan Vogel + +Entwickler und Unternehmer ([@ryanvogel](https://x.com/ryanvogel) auf X, **18.201 Follower**, verifiziert). + +X-Bio (fxtwitter-Abruf 18.09.2026): „ceo of @rebasetv / founding developer @opencode @anomalyco". Standort laut Profil: Florida. Website im Profil: ryan.ceo. + +## Rolle im Wiki + +Gast in der Episode **„Jev is HERE. How to use it"** von [[greg-isenberg.md|Greg Isenberg]] (The Startup Ideas Podcast, 18.09.2026, https://www.youtube.com/watch?v=4mTLpuQpB80). Isenberg bedankt sich im begleitenden X-Post bei „@ryanvogel for coming on and spilling the sauce today". Der eigentliche Inhalt der Episode ist nicht ausgewertet — die Zuordnung stützt sich allein auf den Post. + +Hintergrund relevant für das Wiki: **OpenCode** ist der Open-Source-Coding-Agent, der im Wiki bereits als Werkzeug geführt wird ([[../tools/free-ai-models-meetup-liste.md|Werkzeugliste]]) und als offizieller Partnermodus von DeepSeek V4.1 Flash auftaucht ([[../concepts/llm/deepseek-v4.1-flash.md]]). Ein „founding developer @opencode" ist daher eine belastbare Werkzeug-Spur, keine reine Personennotiz. + +⚠️ Zu **Rebase TV** existiert im Wiki noch kein Eintrag; die Selbstbeschreibung als CEO stammt aus dem X-Profil und ist nicht gegengeprüft. + +## Verwandte Wiki-Seiten + +- [[greg-isenberg.md]] — Host der Episode +- [[../concepts/llm/jev-vercel-ai-gateway.md]] — Thema der Episode +- [[../tools/free-ai-models-meetup-liste.md]] — OpenCode als Werkzeug +- [[../concepts/llm/deepseek-v4.1-flash.md]] — OpenCode als Partner-Modus