本文へ移動

開発元のAIモデル

数値表
モデル・推論設定解決率費用/試行(USD)時間(分)
GPT-6 Astra (max)58.29.900546.6
GPT-6 Astra (xhigh)57.97.122836.8
GPT-6 Astra (high)57.96.877035.2
GPT-6 Astra (medium)54.25.802431.4
GPT-6 Astra (low)50.64.719128.1
GPT-5.6 Sol (max)37.37.702139.8
GPT-5.6 Terra (max)21.55.253141.9
GPT-5.6 Luna (max)17.31.050568.1
GPT-6 Sol (low)9.10.49003.3
GPT-6 Sol (medium)18.71.12005.6
GPT-6 Sol (high)26.31.60007.8
GPT-6 Sol (xhigh)30.31.910010.3
GPT-6 Sol (max)43.94.000018.0
GPT-6 Luna (low)0.00.01000.4
GPT-6 Luna (medium)2.50.07004.2
GPT-6 Luna (high)4.50.12008.0
GPT-6 Luna (xhigh)8.10.200011.0
GPT-6 Luna (max)12.60.240014.1

GPT-6 Luna

ここでは、同一のSMS・問い合わせ分類を行ったOpenRouter経由のminimal設定を収録しています。 評価記録の要求モデルはopenai/gpt-6-luna。公開日・コンテキスト長など、評価記録から確認できない仕様は掲載していません。

OpenAI

GPT-6.1 Sol

OpenAIの推論モデル。テキスト・画像を入力し、テキストを出力します。コンテキストは1,050,000トークン、最大出力は128,000トークン。推論設定はlow・medium(既定)・high・xhigh・maxに対応します。

OpenAI / 公式情報

Terminal-Bench 4.0

Terminal-Benchは、AIエージェントがターミナルを使って作業を完了する能力を測るベンチマークです。4.0の解決率を0〜100%で示し、数値が高いほど多くの作業を完了できたことを表します。
モデル・実行構成%
GPT-6 Astramax 58.1895% CI half-width ±2.79 percentage points
GPT-6 Astraxhigh 57.8895% CI half-width ±2.72 percentage points
GPT-6 Astrahigh 57.8895% CI half-width ±2.97 percentage points
GPT-6 Astramedium 54.2495% CI half-width ±2.66 percentage points
GPT-6 Astralow 50.6195% CI half-width ±2.75 percentage points
GPT-5.6 Solmax 37.2795% CI half-width ±3.78 percentage points
GPT-5.6 Terramax 21.5295% CI half-width ±3.25 percentage points
GPT-5.6 Lunamax 17.2795% CI half-width ±2.85 percentage points
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

Terminal-Bench 4.0:実行コスト

Terminal-Bench 4.0で報告された、330試行の評価にかかった合計費用です。単位は米ドル(USD)で、数値が小さいほど低コストです。APIのトークン単価や月額料金とは異なります。
モデル・実行構成330試行の合計・USD
GPT-5.6 Lunamax 346.67
GPT-6 Astralow 1,557.30
GPT-5.6 Terramax 1,733.52
GPT-6 Astramedium 1,914.80
GPT-6 Astrahigh 2,269.42
GPT-6 Astraxhigh 2,350.51
GPT-5.6 Solmax 2,541.70
GPT-6 Astramax 3,267.18
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

TB4 平均試行時間

Terminal-Bench 4.0で、1試行を終えるまでにかかった平均時間です。単位は秒で、数値が小さいほど短時間で試行を終えています。応答を返し始めるまでの待ち時間とは異なります。
モデル・実行構成秒
GPT-6 Astralow 1,683.70
GPT-6 Astramedium 1,885.90
GPT-6 Astrahigh 2,113.70
GPT-6 Astraxhigh 2,208.50
GPT-5.6 Solmax 2,388.40
GPT-5.6 Terramax 2,514.60
GPT-6 Astramax 2,796.30
GPT-5.6 Lunamax 4,088.30
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

ECI総合スコア

epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。 / epoch.ai / Epoch AI, Epoch Capabilities Index / 取得日 2026-09-28 / CC BY 4.0 / 完成済みGeneral ECIを抽出。点数は変更せず表示時に丸める。標準API料金との組合せはDotMargin。

Epoch AIが公開するGeneral ECIです。高いほど総合性能が高いことを示します。正答率や100点満点の点数ではありません。同じ取得版の値で比較し、未収録モデルを別モデルの値で代用しません。
モデル・実行構成ECI参考API料金(USD)入力10,000・出力1,000トークン
GPT-6 Astra 166.60 0.150000OpenAI / 入力10,000・出力1,000トークン。キャッシュ・バッチ割引・追加推論量・ツール費を含まない参考料金。ECI測定やタスク完了の実費ではありません。Standard API, input up to 272000 tokens モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(料金確認日 2026-09-27)developers.openai.com / developers.openai.com
GPT-5.6 Sol 161.99 未収録対応する標準入力・出力料金は未収録
GPT-5.6 Terra 159.31 未収録対応する標準入力・出力料金は未収録
GPT-5.6 Luna 156.32 未収録対応する標準入力・出力料金は未収録
GPT-6 Lunaminimal この評価の公表値は未収録 0.001500OpenAI / 入力10,000・出力1,000トークン。キャッシュ・バッチ割引・追加推論量・ツール費を含まない参考料金。ECI測定やタスク完了の実費ではありません。OpenAI Standard API、入力272,000トークン以下。キャッシュ入力は読取料金。キャッシュ書込、長文脈・地域加算、Batch・Flex・Fast料金、ツール料金を除く。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(料金確認日 2026-09-29)developers.openai.com / developers.openai.com
GPT-6 Sollow この評価の公表値は未収録 0.030000OpenAI / 入力10,000・出力1,000トークン。キャッシュ・バッチ割引・追加推論量・ツール費を含まない参考料金。ECI測定やタスク完了の実費ではありません。Standard API up to 272000 input tokens; cache writes and long-context/region/fast premiums are separate モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(料金確認日 2026-09-27)developers.openai.com / developers.openai.com
GPT-6.1 Solmedium この評価の公表値は未収録 0.030000OpenAI / 入力10,000・出力1,000トークン。キャッシュ・バッチ割引・追加推論量・ツール費を含まない参考料金。ECI測定やタスク完了の実費ではありません。Standard API、入力272,000トークン以下、100万トークンあたりUSD。272,000を超える場合はリクエスト全体の入力・キャッシュ料金が2倍、出力が1.5倍。キャッシュ書込は別料金2.50ドル。Fastは標準の2倍、Batch/Flexは標準の50%、地域処理は対象地域で10%加算。性能評価の実行費用ではない。Ultrafastは対象外。(料金確認日 2026-09-29T21:56:13Z)OpenAI GPT-6.1 Sol API仕様・料金 / OpenAI API Changelog: GPT-6.1 Sol公開日

SMS迷惑判定:正答率

正解ラベルと一致した件数を500件で割った割合です。SMSは2分類、Banking77は77分類です。汎用知識やコード生成の能力は測っていません。
モデル・実行構成%
GPT-6 Lunaminimal 96.6
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

SMS迷惑判定:処理時間 p50

500要求の処理時間を小さい順に並べた中央値です。ネットワーク・提供環境・出力形式を含みます。最初の応答までの時間(TTFT)ではありません。
モデル・実行構成ms
GPT-6 Lunaminimal 1,653.9
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

SMS迷惑判定:処理時間 p95

500要求を昇順に並べ、floor(0.95 × (n − 1))番目を採った公開実装のp95です。遅い側の処理時間を示します。
モデル・実行構成ms
GPT-6 Lunaminimal 2,939.8
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

SMS迷惑判定:1,000件の費用

評価時の費用合計を件数で割り、1,000倍した金額です。APIの100万トークン単価や自社運用の費用とは異なります。
モデル・実行構成1,000件あたり・USD
GPT-6 Lunaminimal 0.028861
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

Banking77問い合わせ分類:正答率

正解ラベルと一致した件数を500件で割った割合です。SMSは2分類、Banking77は77分類です。汎用知識やコード生成の能力は測っていません。
モデル・実行構成%
GPT-6 Lunaminimal 85.2
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

Banking77問い合わせ分類:処理時間 p50

500要求の処理時間を小さい順に並べた中央値です。ネットワーク・提供環境・出力形式を含みます。最初の応答までの時間(TTFT)ではありません。
モデル・実行構成ms
GPT-6 Lunaminimal 2,128.8
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

Banking77問い合わせ分類:処理時間 p95

500要求を昇順に並べ、floor(0.95 × (n − 1))番目を採った公開実装のp95です。遅い側の処理時間を示します。
モデル・実行構成ms
GPT-6 Lunaminimal 3,442.0
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

Banking77問い合わせ分類:1,000件の費用

評価時の費用合計を件数で割り、1,000倍した金額です。APIの100万トークン単価や自社運用の費用とは異なります。
モデル・実行構成1,000件あたり・USD
GPT-6 Lunaminimal 0.074039
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

T-Rex:60秒生存率

5シードのうち60秒間生存した割合です。物理プランナーとshieldの介入を含む結果で、モデル単体の正確さや他用途への性能を示しません。
モデル・実行構成%
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

T-Rex:処理時間 p50の中央値

APIのJevとローカルRTX 4090のCLMは実行条件が異なります。通信・実行環境を含むシステムの時間で、モデル単体の速度比較には使えません。
モデル・実行構成ms
GPT-6 Astramax この評価の公表値は未収録
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6 Sollow この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

AutomationBench 1.0.6:スコア

OpenAIが自社モデルを研究環境またはAPIで評価したAutomationBench 1.0.6のスコアです。全目標を達成したタスクの割合とは異なります。
モデル・実行構成%
GPT-6 Astramax 41.40
GPT-6 Astraxhigh 39.00
GPT-6 Astrahigh 37.10
GPT-6 Astramedium 34.10
GPT-6 Solxhigh 33.18
GPT-6 Solmax 31.96
GPT-6 Solhigh 31.20
GPT-6 Astralow 30.30
GPT-6 Solmedium 26.94
GPT-6 Sollow 21.16
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

AutomationBench 1.0.6:1タスクの費用

OpenAIがAutomationBench 1.0.6で公表した1タスクあたりの費用です。APIの100万トークン単価とは異なります。
モデル・実行構成1タスクあたり・USD
GPT-6 Sollow 0.1861
GPT-6 Solmedium 0.2098
GPT-6 Solhigh 0.2368
GPT-6 Solxhigh 0.2746
GPT-6 Solmax 0.3406
GPT-6 Astralow 1.0800
GPT-6 Astramedium 1.2700
GPT-6 Astrahigh 1.4400
GPT-6 Astraxhigh 1.5000
GPT-6 Astramax 1.7300
GPT-5.6 Solmax この評価の公表値は未収録
GPT-5.6 Terramax この評価の公表値は未収録
GPT-5.6 Lunamax この評価の公表値は未収録
GPT-6 Lunaminimal この評価の公表値は未収録
GPT-6.1 Solmedium この評価の公表値は未収録

API料金

実行構成種別・単価適用条件・出典
GPT-6 Sol / OpenAI standard APIinput: 2 USD / 1M tokensStandard API up to 272000 input tokens; cache writes and long-context/region/fast premiums are separate モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6 Sol / OpenAI standard APIoutput: 10 USD / 1M tokensStandard API up to 272000 input tokens; cache writes and long-context/region/fast premiums are separate モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6 Sol / OpenAI standard APIcache: 0.2 USD / 1M tokensStandard API up to 272000 input tokens; cache writes and long-context/region/fast premiums are separate モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6 Luna / OpenAI standard APIinput: 0.1 USD / 1M tokensOpenAI Standard API、入力272,000トークン以下。キャッシュ入力は読取料金。キャッシュ書込、長文脈・地域加算、Batch・Flex・Fast料金、ツール料金を除く。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-29) developers.openai.com
GPT-6 Luna / OpenAI standard APIoutput: 0.5 USD / 1M tokensOpenAI Standard API、入力272,000トークン以下。キャッシュ入力は読取料金。キャッシュ書込、長文脈・地域加算、Batch・Flex・Fast料金、ツール料金を除く。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-29) developers.openai.com
GPT-6 Luna / OpenAI standard APIcache: 0.01 USD / 1M tokensOpenAI Standard API、入力272,000トークン以下。キャッシュ入力は読取料金。キャッシュ書込、長文脈・地域加算、Batch・Flex・Fast料金、ツール料金を除く。 モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-29) developers.openai.com
GPT-6 Astra / OpenAI standard APIinput: 10 USD / 1M tokensStandard API, input up to 272000 tokens モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6 Astra / OpenAI standard APIoutput: 50 USD / 1M tokensStandard API, input up to 272000 tokens モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6 Astra / OpenAI standard APIcache: 1 USD / 1M tokensStandard API, input up to 272000 tokens モデルに対応する標準APIの単価。性能評価に使用された構成・実行費用とは別。(確認日 2026-09-27) developers.openai.com
GPT-6.1 Sol / OpenAI standard APIinput: 2 USD / 1M tokensStandard API、入力272,000トークン以下、100万トークンあたりUSD。272,000を超える場合はリクエスト全体の入力・キャッシュ料金が2倍、出力が1.5倍。キャッシュ書込は別料金2.50ドル。Fastは標準の2倍、Batch/Flexは標準の50%、地域処理は対象地域で10%加算。性能評価の実行費用ではない。Ultrafastは対象外。(確認日 2026-09-29T21:56:13Z) OpenAI GPT-6.1 Sol API仕様・料金 / OpenAI API Changelog: GPT-6.1 Sol公開日
GPT-6.1 Sol / OpenAI standard APIoutput: 10 USD / 1M tokensStandard API、入力272,000トークン以下、100万トークンあたりUSD。272,000を超える場合はリクエスト全体の入力・キャッシュ料金が2倍、出力が1.5倍。キャッシュ書込は別料金2.50ドル。Fastは標準の2倍、Batch/Flexは標準の50%、地域処理は対象地域で10%加算。性能評価の実行費用ではない。Ultrafastは対象外。(確認日 2026-09-29T21:56:13Z) OpenAI GPT-6.1 Sol API仕様・料金 / OpenAI API Changelog: GPT-6.1 Sol公開日
GPT-6.1 Sol / OpenAI standard APIcache: 0.1 USD / 1M tokensStandard API、入力272,000トークン以下、100万トークンあたりUSD。272,000を超える場合はリクエスト全体の入力・キャッシュ料金が2倍、出力が1.5倍。キャッシュ書込は別料金2.50ドル。Fastは標準の2倍、Batch/Flexは標準の50%、地域処理は対象地域で10%加算。性能評価の実行費用ではない。Ultrafastは対象外。(確認日 2026-09-29T21:56:13Z) OpenAI GPT-6.1 Sol API仕様・料金 / OpenAI API Changelog: GPT-6.1 Sol公開日