Jev AI Dev · 開発者ガイド

System One AIモデルとは? 開発者のためのJevガイド。

System Oneは、非構造化なアプリケーション状態を型付きの回答と確率に変換する、TypeSafeのAIモデルクラスです。Jevはその最初の実装であり、アプリケーションコード内で使う限定的な判断コンポーネントです。

入力
テキスト、JSON、テキスト配列
出力
Choice、Score、Noul
制御フロー
コード側で管理

本ページは独立した開発者向けガイドです。製品仕様と性能に関する記述はTypeSafeの資料に基づきます。本番導入前に、ご自身のデータでJevを検証してください。

System Onestate → decisions
state

「二重請求されました。今日中に解決してほしいです。」

choice請求担当0.96
noul緊急0.88
score不満度1.7 / 2
if (confidence < threshold) → review
モデルクラス

System Oneモデルは、アプリケーションコード向けの判断プリミティブです。

System Oneモデルは入力の意味を読み取りますが、会話を続けたり文章を作ったりはしません。質問と許可する回答形式を先に宣言すると、プログラムが検査して扱える範囲内の判断を返します。

01

状態を理解する

チケット、Agentの実行履歴、商品レコード、ゲーム状態など、自然言語や構造化テキストを解釈します。

02

契約の範囲に収める

呼び出し前に回答空間を定義します。モデルは選択肢を選ぶ、尺度上で評価する、または真偽命題を判定します。

03

不確実性を示す

各回答には確率が付きます。ChoiceとScoreは分布を要約したconfidenceも返し、明確な結果と曖昧な結果を区別できます。

04

コードと組み合わせる

しきい値、ポリシーチェック、副作用、再試行、フォールバック、人による確認は通常のコードが担います。

Jevのワークフロー

開発者がJevをアプリケーションコードに組み込む方法。

Jevは1回のモデル呼び出しを複数の判断シグナルに変えます。開発者にとって有用な単位は会話ターンではなく、モデルとアプリケーションの間の小さな型付き契約です。

入力

1. 状態を組み立てる

判断に必要な情報を送ります。Jevは現在、文字列、JSONオブジェクト、テキスト配列など、テキスト形式の入力を受け付けます。

顧客メッセージ + アカウント情報
契約

2. 質問を定義する

質問に名前を付け、primitiveを選び、許可する選択肢や尺度を記述します。複数の独立した質問を1回のリクエストに含められます。

担当部署 · 緊急度 · 不満度
モデル

3. Jevが評価する

各質問に型付き回答と確率を返します。ChoiceとScoreには別途confidenceも含まれます。

請求担当 · 0.93 · 高confidence
アプリ

4. コードが方針を適用する

モデル出力を決定的な検査と組み合わせます。低リスクで明確なら実行し、曖昧または高影響なら人や推論モデルへ渡します。

振り分け · 再質問 · 確認 · 停止

3つの回答形式

Choicebilling

どのチームが対応すべきか?

定義済みの選択肢から1つを選び、各選択肢の確率を返します。

Score1.43 / 2

問題の深刻度は?

説明付きの順序尺度上に入力を配置します。結果は2段階の間になることもあります。

Noul0.95

返金を求めているか?

真偽命題を評価し、「はい」である確率を返します。

背景にある考え

TypeSafeがソフトウェア向けモデルインターフェースを設計した理由。

生成モデルは人向けの柔軟な文字列生成に優れます。TypeSafeは、ソフトウェアにはコードに組み込め、繰り返し実行でき、不確実性を示し、制御フローを可視化できる、より限定的な知能が必要だと考えています。

01

文字列は柔軟だが開放的

生成結果は文章、コード、JSON、拒否、または不正な形式になり得ます。実行前に解析、検証、復旧が必要です。

02

自動化には境界が必要

バックグラウンドで使う場合、プログラムは結果候補と、それぞれが許可する操作を事前に把握する必要があります。

03

不確実性で処理を変える

確率分布があれば、明確なケースを自動処理し、曖昧なケースを安全な経路に回せます。

04

小さな判断を合成する

複雑な処理を焦点の定まった意味判断に分け、1つの巨大なプロンプトに隠さず決定的なロジックで組み合わせます。

適用領域

System One AIが開発ワークフローに適する場面。

頻繁に発生し、乱雑な入力の理解が必要で、アプリケーションが既に実行方法を知る少数のアクションにつながるタスクが有力です。

01

サポート業務

チケットを分類し、意図・緊急度・顧客感情を判定し、不確実なケースを確認へ回します。

請求、技術、アカウント、それとも別件か?
02

Agent制御

モデルやツールの選択、検索の要否、結果の完全性、実行予定のツール呼び出しを判断します。

Agentは続行、再試行、エスカレーションのどれを選ぶか?
03

ランキングと関連性

候補と検索、プロフィール、ポリシー、文脈との一致度を評価し、ビジネスルールと組み合わせます。

この候補は依頼にどれほど関連するか?
04

安全性と検証

明示的な基準でメッセージ、生成結果、履歴、コード変更を評価し、高リスクの結果は決定的なゲートで止めます。

定めたルールに違反しているか?
05

リアルタイム操作

ゲーム、シミュレーション、UI、デバイス自動化で許可された行動を選び、長い文章生成を避けます。

現在の状態で最適な許可済み行動は?
06

データ処理

大量のレコードをカテゴリ、スコア、フラグ、特徴量に変換し、後段の集計や確認に使います。

このレコードのカテゴリとリスク水準は?

適している

選択肢が既知で、入力の意味が複雑、判断が反復され、遅延が重要で、各結果に明確な処理やフォールバックを用意できる場合。

適していない

独創的な文章やコード、深い多段推論、広い調査、説明、多モーダル入力、または結果候補を事前定義できないタスク。

System Oneと生成LLM

System Oneと生成LLMはAIスタックで異なる役割を持ちます。

どちらも言語を理解でき、LLMも構造化出力で形式を制約できます。根本的な違いはモデルが何を生成するよう設計され、周囲のソフトウェアがどう使うかです。

比較項目Jev / System One一般的な生成LLM
主な仕事定義済みの結果を評価続きを生成、または回答
ネイティブ出力型付きの選択、スコア、「はい」の確率文章、コード、JSONなどのtoken列
回答空間呼び出し前に宣言schemaで最終形式を制約しても本質的に開放
不確実性各回答に確率、ChoiceとScoreにはconfidencetoken確率や自己申告confidenceはあり得るが、通常はタスク較正済みの判断シグナルではない
サンプリングTypeSafeによれば質問と出力を並列評価通常はtokenごとに順次生成
得意分野高頻度の意味分岐、採点、ルーティング、検査文章、対話、コーディング、統合、開放的推論
主な失敗型は正しいが意味判断が誤る誤り、形式不正、根拠不足、タスク逸脱
システム内の役割可視なコード内の限定判断コンポーネント柔軟な生成・推論器。より大きなオーケストレーションを伴うことが多い

Jev以外のSystem Oneを検討する開発者向けに、Projectsページと同じコミュニティモジュールを掲載します。独自学習モデルと既存の重みを使うJev風インターフェースを分けています。

System One

Jevに着想を得たコミュニティのSystem Oneプロジェクト

Jevに着想を得た、または同様の構造化された判断手法を探るコミュニティ製のモデルとインターフェース実験です。TypeSafeによるJevの公式版ではなく、上のGitHubプロジェクトランキングには含めていません。

コミュニティモデルQwen3.5-9B

Bespoke Nimble

Jevに着想を得たLoRAアダプターと学習レシピ。選択式と真偽判定に対応し、テキストをローカルで処理します。

GitHub
コミュニティモデルQwen3-0.6B

NanoJev

判断用ヘッドを備えた小型モデル。学習コードと、行動選択を試せるゲームのデモを公開しています。

GitHub
コミュニティモデルQwen3.5-2B

decider

定型質問ごとの確率分布を一度の処理で返すファインチューニングモデル。現行版は英語のみ対応です。

GitHub
コミュニティモデルModernBERT 151M

Verdict

小型エンコーダーを使う判断モデル。重みとブラウザで動くWebGPUデモを公開しています。

GitHub
コミュニティモデルQwen3.5-0.8B

Dohnuts

重み・学習コード・評価結果を公開する0.8Bのマルチモーダル判断モデル。テキストと画像を1回の順伝播で扱えます。重みは非商用研究向けです。

GitHub
API実装の試みDiffusionGemma 26B-A4B

OpenJev

既存のDiffusionGemmaモデルを使い、Jevに似たAPIで構造化された質問に回答します。新しいモデルの重みは公開していません。

GitHub
API実装の試みOpen-model logits

Simple Jev

既存のオープンモデルで候補を採点し、Jevに似たインターフェースを提供します。新しいモデルの重みは公開していません。

GitHub
API実装の試みSpark-X2.5-4B

Rizzo Flow

Spark-X2.5の回答ロジットを使う、ローカル動作のJev互換サーバー。複数の質問で状態のプリフィルを共有し、プレイグラウンドとベンチマークも備えます。

GitHub
API実装の試みAny causal LLM

AnyJev

因果言語モデルを学習なしで定型判断モデルに変換するツールキット。選択肢順序の偏り補正、任意のキャリブレーション、再現可能な評価に対応します。

GitHub
API実装の試みQwen3.5 / DeBERTa

local-jev

QwenまたはDeBERTaを使うオフラインのJev互換サーバー。公式SDKとの互換性を確認し、JevBenchの結果も公開しています。

GitHub

いずれもコミュニティによる独立した取り組みで、Jevの公式版ではありません。

一次情報

主張を原文で確認する。

このJev AI DevガイドはTypeSafeの枠組みを独自に整理したものです。API仕様、製品主張、評価方法、更新は公式資料で確認してください。

概念ではなく形を試す

アプリケーションが既に行う1つの判断から始める。

候補回答を定義し、代表例を集め、不確実な結果の扱いを決め、Jevを既存ルールやモデルと比較してください。影響の大きい判断を直接自動化しないでください。

PlaygroundでJevを試す Jevプロジェクトを見る