{
  "version": 1,
  "type": "tool",
  "canonicalUrl": "https://tools.utildesk.de/tools/jev/",
  "markdownUrl": "https://tools.utildesk.de/markdown/tools/jev.md",
  "data": {
    "slug": "jev",
    "title": "JEV by TypeSafe AI",
    "url": "https://tools.utildesk.de/tools/jev/",
    "category": "AI Infrastructure",
    "priceModel": "Nutzungsbasiert",
    "tags": [
      "ai",
      "api",
      "classification",
      "structured-output"
    ],
    "description": "Jev von TypeSafe bewertet enge Textfragen als typisierte Entscheidungen mit Wahrscheinlichkeiten; Qualität, Sprachabdeckung und Eskalationsregeln müssen Teams selbst prüfen.",
    "officialUrl": "https://typesafe.ai/",
    "affiliateUrl": null,
    "inLanguage": "de-DE",
    "tier": "C",
    "editorialStatus": "curated",
    "featureList": [
      "OpenAI API: Für Teams, die neben strukturierten Daten auch Textgenerierung, Tool-Aufrufe oder multimodale Eingaben brauchen.",
      "Anthropic API: Eine generative API für Dokumentenarbeit, längere Textanalyse und erklärende Antworten.",
      "Cohere: Interessant, wenn Embeddings, Suche und Reranking Teil des Problems sind; es ist kein gleichartiger Ersatz für jede Entscheidung.",
      "Pydantic AI: Ein Python-Framework für typisierte Agenten-Workflows, das ein Inferenzmodell orchestriert statt selbst eines bereitzustellen."
    ],
    "wordCount": 1081,
    "contentMarkdown": "# JEV by TypeSafe AI\r\n\r\nJev von TypeSafe ist für Software gedacht, die aus Text eine eng umrissene Entscheidung ableiten muss: etwa das passende Team-Postfach (Queue) oder eine grobe Dringlichkeitsstufe. Statt einen Text zu verfassen, liefert das Modell typisierte Antworten samt Wahrscheinlichkeiten. Das kann nachgelagerte Logik vereinfachen, macht die Entscheidung aber weder automatisch richtig noch für Deutsch bereits verlässlich.\r\n\r\n<figure class=\"tool-editorial-figure\">\r\n  <img src=\"/images/tools/jev-editorial.webp\" alt=\"Ein künstlerisches Sortieratelier: mehrdeutige Fälle werden an einen Menschen weitergereicht, während klare Entscheidungen in getrennte Fächer sortiert werden\" loading=\"lazy\" decoding=\"async\" />\r\n</figure>\r\n\r\n## Was Jev macht und für wen\r\n\r\nJev, von TypeSafe als [System-One-Modell](https://docs.typesafe.ai/introduction.md) bezeichnet, beantwortet strukturierte Fragen zu einem bereitgestellten Zustand. Eine Anwendung kann zum Beispiel fragen, welches von vier Teams zuständig ist, wie dringend ein Vorgang wirkt und welcher Schweregrad zu einer vorher definierten Skala passt. Die Antwort ist ein Wert, den Code prüfen und verwenden kann; Jev schreibt dabei nicht die Nachricht für den Kunden.\r\n\r\nDas ist interessant für Entwicklerteams, die ähnliche, uneinheitlich formulierte Eingaben vorsortieren. Jev ist kein Helpdesk, Chatbot oder Ersatz für Geschäftsregeln. TypeSafe kündigte es am 15. September 2026 als [Early Access](https://typesafe.ai/blog/introducing-system-one-models-and-jev) an; ein begrenzter Pilot mit eigener Qualitätsevaluation gehört daher zum Produktionsplan.\r\n\r\n## Die drei Fragetypen\r\n\r\n[`Choice`](https://docs.typesafe.ai/primitives/choice.md) wählt aus benannten Möglichkeiten und liefert eine Wahrscheinlichkeitsverteilung sowie einen Confidence-Wert. [`Score`](https://docs.typesafe.ai/primitives/score.md) ordnet eine Eingabe einer beschriebenen Skala zu und liefert ebenfalls Verteilung und Confidence. [`Noul`](https://docs.typesafe.ai/primitives/noul.md) beantwortet eine Ja-Nein-Frage mit einem Wert von 0 bis 1: Er steht für die Wahrscheinlichkeit, dass die Antwort „ja“ lautet. Noul hat keinen zusätzlichen Confidence-Wert.\r\n\r\nWahrscheinlichkeit und Confidence sind nicht austauschbar: Die Wahrscheinlichkeit gilt für eine Option, Confidence fasst zusammen, wie deutlich die Verteilung ausfällt. Keiner der Werte beweist sachliche Richtigkeit; Schwellen und Folgen einer Fehlentscheidung legt die Anwendung fest ([TypeSafe zu Confidence](https://docs.typesafe.ai/confidence.md)).\r\n\r\n## Ein möglicher Ablauf für Support-Nachrichten\r\n\r\nPilot-Beispiel: „Meine Bestellung wurde zweimal berechnet. Könnt ihr die zweite Abbuchung prüfen?“ Die Anwendung entfernt Namen und Bestellnummern und sendet den verbleibenden Text als Eingabekontext (`state`). `Choice` kann als Ziel das Team-Postfach für Abrechnung vorschlagen; eine unabhängige `Noul`-Frage bewertet, ob eine Reaktion am selben Tag nötig scheint, und `Score` ordnet den Schweregrad anhand einer beschriebenen Skala ein.\r\n\r\nDer Anwendungscode prüft die Vorschläge und legt fest, ob ein risikoarmer Fall in dieses Team-Postfach gelangt. Bei uneinheitlichen Antworten, unklarer Dringlichkeit oder einem unbekannten Fall prüft ein Mensch die Nachricht. Solange ein deutscher Testdatensatz keine akzeptable Rate falscher automatischer Weiterleitungen zeigt, bleibt die Weiterleitung manuell.\r\n\r\n## Integration und Betrieb\r\n\r\nTypeSafe dokumentiert das [Python-SDK](https://docs.typesafe.ai/sdk/python.md), das [JavaScript/TypeScript-SDK](https://docs.typesafe.ai/sdk/javascript.md) sowie einen [Quickstart](https://docs.typesafe.ai/introduction/quickstart.md) für `POST /v1/systemone`. Die Anwendung sendet Zustand und Fragen und verarbeitet die Antworten. Jev nimmt Text oder texttragendes JSON an, aber keine Bilder, Audio- oder Videoeingaben; diese müssen vorher umgewandelt werden.\r\n\r\nHalte Fragen eng und unabhängig; kombiniere umfassende Bewertungen im Anwendungscode. Exakte Datums- und Betragsrechnung, Richtlinien sowie Rechte gehören in deterministischen Code. Große Eingabekontexte können die Qualität verändern; TypeSafe dokumentiert diese Grenze für [Jev 1.13](https://docs.typesafe.ai/model-jaggedness/jev-1.13.md). Plane Schwellenwerte, Fehlerrouten, Protokollierung und Rückfallverhalten mit ein.\r\n\r\n## Qualität messen, bevor etwas automatisch läuft\r\n\r\nBeginne mit gelabelten Fällen und einer getrennten Testmenge. Für Deutsch gehören Umgangssprache, Tippfehler, kurze Antworten, mehrere Anliegen und Widersprüche hinein. Prüfe auch, ob Anweisungen im Nachrichtentext die Klassifikation beeinflussen; Eingabetext darf keine Berechtigung geben, Systemregeln zu umgehen.\r\n\r\nMiss Präzision und Fehlerraten pro Frage, falsche automatische Weiterleitungen und den Anteil ohne menschlichen Eingriff. Vergleiche Sprache und Falltyp. TypeSafe nennt Englisch als stärkste Sprache, dokumentiert aktuell `jev-1.13.0` und berechnet Eingabetokens mit $0.042 pro Million; Aliase können wechseln ([Modelle](https://docs.typesafe.ai/models.md)). Binde getestete Schwellen an eine feste Version und evaluiere Änderungen erneut.\r\n\r\n## Sicherheit, Datenschutz und Grenzen\r\n\r\nTypeSafe sagt, Kundenanfragen und Antworten nicht zum Training zu nutzen; die [Rechtsseiten](https://docs.typesafe.ai/legal.md) verlinken eine DPA und nennen ZDR für Unternehmenskunden. Die [Datenschutzerklärung](https://typesafe.ai/legal/privacy-policy) nennt die USA als Hosting-Standort. Prüfe vor personenbezogenen oder regulierten Daten Aufbewahrung, Unterauftragnehmer, Übermittlungen, Löschung und Vertrag. „Kein Training“ bedeutet nicht „keine Speicherung“.\r\n\r\nTypisierte Ausgabe verhindert weder Fehlinterpretationen noch Prompt Injection. Anonymisierung, minimale Datenfelder, begrenzte Aktionen und nachvollziehbare Eskalation bleiben Anwendungssache. Für rechtliche, finanzielle oder sicherheitsrelevante Folgen reicht ein Modellwert allein nicht als Freigabe.\r\n\r\n## Kosten und laufender Aufwand\r\n\r\nDie dokumentierte Preisangabe für Jev 1.13 beträgt 0,042 US-Dollar pro Million Eingabetokens; Ausgabetokens sind kostenlos. Hundert Millionen Eingabetokens entsprächen damit rechnerisch 4,20 US-Dollar an Modellkosten. Das ist kein Gesamtpreis: Zustand und Fragetexte verbrauchen Eingabetokens, hinzu kommen mögliche Wiederholungen, menschliche Prüfung, Anbindung, Monitoring und Pflege des gelabelten Datensatzes. Ein kurzer Pilot mit gemessener Tokenmenge liefert eine bessere Budgetbasis als die Anzahl der Antworten allein.\r\n\r\n## Redaktionelle Einschätzung\r\n\r\n**Redaktionelles Verdikt: Mit Vorbehalt.**\r\n\r\nWir sehen Jev mit Vorbehalt für Teams, die viele wiederkehrende Textentscheidungen in klar abgegrenzte Felder überführen müssen und die Antworten vor jeder Aktion durch eigene Regeln führen. Der praktische Wert hängt davon ab, ob ein eigener Datensatz für die betreffende Sprache und Fallklasse genügend sichere Automatisierung bei vertretbarer Fehlerquote zeigt.\r\n\r\nFür Kundentexte, Bildanalyse oder Erklärungen passt eher eine generative Modell-API; exakte Regeln und Rechnungen gehören in Code. Ohne bestandene deutsche Evaluation, Datenschutzfreigabe und manuellen Rückweg sollte Jev keine Fälle selbstständig weiterleiten.\r\n\r\n## Alternativen\r\n\r\n- [OpenAI API](/tools/openai-api/): Für Teams, die neben strukturierten Daten auch Textgenerierung, Tool-Aufrufe oder multimodale Eingaben brauchen.\r\n- [Anthropic API](/tools/anthropic-api/): Eine generative API für Dokumentenarbeit, längere Textanalyse und erklärende Antworten.\r\n- [Cohere](/tools/cohere/): Interessant, wenn Embeddings, Suche und Reranking Teil des Problems sind; es ist kein gleichartiger Ersatz für jede Entscheidung.\r\n- [Pydantic AI](/tools/pydantic-ai/): Ein Python-Framework für typisierte Agenten-Workflows, das ein Inferenzmodell orchestriert statt selbst eines bereitzustellen.\r\n\r\n## FAQ\r\n\r\n**Generiert Jev Antworten für einen Chatbot?**\r\n\r\nNein. Jev beantwortet definierte Fragen mit typisierten Werten. Für frei formulierte Chat-Antworten braucht die Anwendung ein anderes Modell.\r\n\r\n**Ist die Antwort durch ein festes Schema automatisch korrekt?**\r\n\r\nNein. Ein Schema begrenzt nur die Form, nicht die sachliche Richtigkeit. Evaluation und Eskalation müssen Fehlentscheidungen sichtbar machen.\r\n\r\n**Kann Jev deutsche Support-Nachrichten verarbeiten?**\r\n\r\nEnglisch ist laut Dokumentation die stärkste Sprache. Ein repräsentativer, separat gelabelter deutscher Testdatensatz sollte über den Einsatz entscheiden.\r\n\r\n**Was ist der Unterschied zwischen Confidence und Wahrscheinlichkeit?**\r\n\r\nChoice und Score liefern Wahrscheinlichkeiten und einen zusammenfassenden Confidence-Wert. Noul liefert nur die Ja-Wahrscheinlichkeit von 0 bis 1. Keiner der Werte beweist Wahrheit.\r\n\r\n**Kann ich sensible Nachrichten direkt senden?**\r\n\r\nErst nach Prüfung der eigenen Datenschutzanforderungen. TypeSafe verlinkt eine DPA, nennt ZDR für Unternehmenskunden und weist auf US-Hosting hin. Entferne unnötige Identifikatoren und kläre Aufbewahrung sowie Vertrag.\r\n\r\n**Was sollte bei niedriger Confidence passieren?**\r\n\r\nNicht raten lassen: nachfragen oder manuell prüfen. Lege Schwellen anhand gelabelter Beispiele und der Fehlerfolgen fest.\r\n\r\n**Wie viel kostet die API im Betrieb?**\r\n\r\nBerechnet werden Eingabetokens; Ausgabetokens sind kostenlos. Miss auch Wiederholungen, Integration und menschliche Prüfung in einem datenschutzgerecht vorbereiteten Pilot.\r\n\r\n**Sollte ich `jev-latest` oder eine feste Version verwenden?**\r\n\r\nEin Alias ist zum Erkunden bequem. Sobald Schwellen davon abhängen, pinne die getestete Version und evaluiere jeden Wechsel erneut.\n"
  }
}