AgentOptimizationOptions interface
最適化作業のためのノブとランモードの調整。
プロパティ
| evaluation_level | 評価の細かさ。 無効/省略はアイテムごとに1ターン分の意味です。 会話ごとのマルチターンシミュレーションスコアリングのために「会話」に設定してください。 |
| eval_model | 評価に用いられるモデル展開。 デフォルトはサーバー設定(通常は「gpt-4o」)です。 |
| max_candidates | 生成すべき最適化候補の最大数。 >= 1 である必要があります。 既定値: 5。 |
| max_stalls | 早期停止前の連続反射ミニバッチ拒否回数の最大。 「ストール」は、最適化モデルがプロンプト変更を提案し、それを小さな部分集合で評価してもスコアが改善されず、完全な検証セット評価が発動しない場合に発生します。 ミニバッチが通過し、そのフルバリデーションスコアが現在の最高値を上回るとカウンターはリセットされます。 停止を引き起こすのは連続したミニバッチ失敗が |
| optimization_config | ターゲット属性ごとの設定オーバーライド。 エージェント向けのスキル、ツール、system_prompt、モデル最適化のためのモデルスペースを含みます。 |
| optimization_model | 最適化推論のためのモデル展開(gpt-5ファミリーであること)。 設定していないときはデフォルトの評価モデルに戻します。 |
プロパティの詳細
evaluation_level
評価の細かさ。 無効/省略はアイテムごとに1ターン分の意味です。 会話ごとのマルチターンシミュレーションスコアリングのために「会話」に設定してください。
evaluation_level?: EvaluationLevel
プロパティ値
eval_model
評価に用いられるモデル展開。 デフォルトはサーバー設定(通常は「gpt-4o」)です。
eval_model?: string
プロパティ値
string
max_candidates
生成すべき最適化候補の最大数。 >= 1 である必要があります。 既定値: 5。
max_candidates?: number
プロパティ値
number
max_stalls
早期停止前の連続反射ミニバッチ拒否回数の最大。 「ストール」は、最適化モデルがプロンプト変更を提案し、それを小さな部分集合で評価してもスコアが改善されず、完全な検証セット評価が発動しない場合に発生します。 ミニバッチが通過し、そのフルバリデーションスコアが現在の最高値を上回るとカウンターはリセットされます。 停止を引き起こすのは連続したミニバッチ失敗が max_stalls 回連続で続く場合だけです。 呼び出し元が値を指定しない場合、サービスはデフォルトで5になります。 設定時は >=1でなければなりません。
max_stalls?: number
プロパティ値
number
optimization_config
ターゲット属性ごとの設定オーバーライド。 エージェント向けのスキル、ツール、system_prompt、モデル最適化のためのモデルスペースを含みます。
optimization_config?: Record<string, any>
プロパティ値
Record<string, any>
optimization_model
最適化推論のためのモデル展開(gpt-5ファミリーであること)。 設定していないときはデフォルトの評価モデルに戻します。
optimization_model?: string
プロパティ値
string