本文へ移動

開発元のAIモデル

数値表
モデル・推論設定解決率費用/試行(USD)時間(分)

Jev 1.13

文章やJSONを読み、候補の選択・段階評価・真偽の確率を返すTypeSafe AIの非生成モデルです。自由文の生成には対応しません。 64kは要求全体の上限。stateと最長のquestionの合計は32kまで。公式APIの固定IDはjev-1.13.0。OpenRouter評価の応答IDとの同一チェックポイントは未確認です。Jevの初公開日は2026/09/15ですが、1.13の公開日とは区別しています。

TypeSafe AI

Terminal-Bench 4.0

Terminal-Benchは、AIエージェントがターミナルを使って作業を完了する能力を測るベンチマークです。4.0の解決率を0〜100%で示し、数値が高いほど多くの作業を完了できたことを表します。
モデル・実行構成%
Jev 1.13default この評価の公表値は未収録

Terminal-Bench 4.0:実行コスト

Terminal-Bench 4.0で報告された、330試行の評価にかかった合計費用です。単位は米ドル(USD)で、数値が小さいほど低コストです。APIのトークン単価や月額料金とは異なります。
モデル・実行構成330試行の合計・USD
Jev 1.13default この評価の公表値は未収録

TB4 平均試行時間

Terminal-Bench 4.0で、1試行を終えるまでにかかった平均時間です。単位は秒で、数値が小さいほど短時間で試行を終えています。応答を返し始めるまでの待ち時間とは異なります。
モデル・実行構成秒
Jev 1.13default この評価の公表値は未収録

ECI総合スコア

epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。

Epoch AIが公開するGeneral ECIです。高いほど総合性能が高いことを示します。正答率や100点満点の点数ではありません。同じ取得版の値で比較し、未収録モデルを別モデルの値で代用しません。
モデル・実行構成ECI参考API料金(USD)入力10,000・出力1,000トークン
Jev 1.13default この評価の公表値は未収録 0.000420TypeSafe AI / 入力10,000・出力1,000トークン。キャッシュ・バッチ割引・追加推論量・ツール費を含まない参考料金。ECI測定やタスク完了の実費ではありません。TypeSafe API: USD per 1M input tokens, including questions and options; structured output free. Not free-text generation. 質問と候補も入力トークンに含まれます。出力無料は構造化した判断結果の料金で、自由文の生成料金ではありません。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(料金確認日 2026-09-27)docs.typesafe.ai / docs.typesafe.ai

SMS迷惑判定:正答率

正解ラベルと一致した件数を500件で割った割合です。SMSは2分類、Banking77は77分類です。汎用知識やコード生成の能力は測っていません。
モデル・実行構成%
Jev 1.13default 98.0

SMS迷惑判定:処理時間 p50

500要求の処理時間を小さい順に並べた中央値です。ネットワーク・提供環境・出力形式を含みます。最初の応答までの時間(TTFT)ではありません。
モデル・実行構成ms
Jev 1.13default 365.8

SMS迷惑判定:処理時間 p95

500要求を昇順に並べ、floor(0.95 × (n − 1))番目を採った公開実装のp95です。遅い側の処理時間を示します。
モデル・実行構成ms
Jev 1.13default 468.7

SMS迷惑判定:1,000件の費用

評価時の費用合計を件数で割り、1,000倍した金額です。APIの100万トークン単価や自社運用の費用とは異なります。
モデル・実行構成1,000件あたり・USD
Jev 1.13default 0.012977

Banking77問い合わせ分類:正答率

正解ラベルと一致した件数を500件で割った割合です。SMSは2分類、Banking77は77分類です。汎用知識やコード生成の能力は測っていません。
モデル・実行構成%
Jev 1.13default 81.8

Banking77問い合わせ分類:処理時間 p50

500要求の処理時間を小さい順に並べた中央値です。ネットワーク・提供環境・出力形式を含みます。最初の応答までの時間(TTFT)ではありません。
モデル・実行構成ms
Jev 1.13default 372.5

Banking77問い合わせ分類:処理時間 p95

500要求を昇順に並べ、floor(0.95 × (n − 1))番目を採った公開実装のp95です。遅い側の処理時間を示します。
モデル・実行構成ms
Jev 1.13default 487.0

Banking77問い合わせ分類:1,000件の費用

評価時の費用合計を件数で割り、1,000倍した金額です。APIの100万トークン単価や自社運用の費用とは異なります。
モデル・実行構成1,000件あたり・USD
Jev 1.13default 0.070913

T-Rex:60秒生存率

5シードのうち60秒間生存した割合です。物理プランナーとshieldの介入を含む結果で、モデル単体の正確さや他用途への性能を示しません。
モデル・実行構成%
Jev 1.13default 100.0

T-Rex:処理時間 p50の中央値

APIのJevとローカルRTX 4090のCLMは実行条件が異なります。通信・実行環境を含むシステムの時間で、モデル単体の速度比較には使えません。
モデル・実行構成ms
Jev 1.13default 149.8

AutomationBench 1.0.6:スコア

OpenAIが自社モデルを研究環境またはAPIで評価したAutomationBench 1.0.6のスコアです。全目標を達成したタスクの割合とは異なります。
モデル・実行構成%
Jev 1.13default この評価の公表値は未収録

AutomationBench 1.0.6:1タスクの費用

OpenAIがAutomationBench 1.0.6で公表した1タスクあたりの費用です。APIの100万トークン単価とは異なります。
モデル・実行構成1タスクあたり・USD
Jev 1.13default この評価の公表値は未収録

API料金

実行構成種別・単価適用条件・出典
Jev 1.13 / TypeSafe AI standard APIinput: 0.042 USD / 1M tokensTypeSafe API: USD per 1M input tokens, including questions and options; structured output free. Not free-text generation. 質問と候補も入力トークンに含まれます。出力無料は構造化した判断結果の料金で、自由文の生成料金ではありません。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) docs.typesafe.ai
Jev 1.13 / TypeSafe AI standard APIoutput: 0 USD / 1M tokensTypeSafe API: USD per 1M input tokens, including questions and options; structured output free. Not free-text generation. 質問と候補も入力トークンに含まれます。出力無料は構造化した判断結果の料金で、自由文の生成料金ではありません。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) docs.typesafe.ai