diff --git a/Tuning-Performance/Normal/templates/agent_template_backend_day_zero/llm_profiles.yaml b/Tuning-Performance/Normal/templates/agent_template_backend_day_zero/llm_profiles.yaml new file mode 100644 index 0000000..29fda41 --- /dev/null +++ b/Tuning-Performance/Normal/templates/agent_template_backend_day_zero/llm_profiles.yaml @@ -0,0 +1,87 @@ +profiles: + default: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.2 + max_tokens: 2048 + supervisor: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 700 + route_continuity: + provider: oci_openai + model: openai.gpt-4.1-mini + temperature: 0 + max_tokens: 80 + timeout_seconds: 5 + router: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 500 + guardrail: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 600 + grl: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 700 + judge: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 800 + rag_rewriter: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 300 + rag_compressor: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 1200 + rag_generation: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.1 + max_tokens: 1800 + summary_memory: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.1 + max_tokens: 1200 + noc: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0 + max_tokens: 700 + billing_agent: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.2 + product_agent: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.2 + backoffice_agent: + provider: oci_openai + model: openai.gpt-4.1 + temperature: 0.2 + mcp_parameter_extraction: + provider: oci_openai + model: openai.gpt-4.1-mini + temperature: 0 + max_tokens: 80 + timeout_seconds: 5 + + transaction_parameter_extraction: + provider: oci_openai + model: openai.gpt-4.1-mini + temperature: 0 + max_tokens: 500 + timeout_seconds: 8 diff --git a/libs/agent_framework/config/llm_profiles.yaml b/libs/agent_framework/config/llm_profiles.yaml index 011dd12..9e00520 100644 --- a/libs/agent_framework/config/llm_profiles.yaml +++ b/libs/agent_framework/config/llm_profiles.yaml @@ -1,100 +1,80 @@ -# Optional file. If this file is absent, the backend keeps using .env exactly as before. -# If present, each inference point can override provider/model/params. -# Put this files in the same .env file folder profiles: default: provider: oci_openai model: openai.gpt-4.1 temperature: 0.2 max_tokens: 2048 - - # Workflow/routing supervisor: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 700 - - - # Lightweight semantic continuity classifier. Choose the smallest/fastest - # model approved for the environment. The framework references this profile - # through ROUTE_STICKINESS_LLM_PROFILE. route_continuity: provider: oci_openai model: openai.gpt-4.1-mini temperature: 0 max_tokens: 80 timeout_seconds: 5 - router: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 500 - - # Safety / evaluation guardrail: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 600 - grl: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 700 - judge: provider: oci_openai model: xopenai.gpt-4.1 temperature: 0 max_tokens: 800 - - # RAG rag_rewriter: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 300 - rag_compressor: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 1200 - rag_generation: provider: oci_openai model: openai.gpt-4.1 temperature: 0.1 max_tokens: 1800 - - # Memory / operations summary_memory: provider: oci_openai model: openai.gpt-4.1 temperature: 0.1 max_tokens: 1200 - noc: provider: oci_openai model: openai.gpt-4.1 temperature: 0 max_tokens: 700 - - # Agent-specific overrides billing_agent: provider: oci_openai model: openai.gpt-4.1 temperature: 0.2 - product_agent: provider: oci_openai model: openai.gpt-4.1 temperature: 0.2 - backoffice_agent: provider: oci_openai model: openai.gpt-4.1 temperature: 0.2 + transaction_parameter_extraction: + provider: oci_openai + model: openai.gpt-4.1-mini + temperature: 0 + max_tokens: 500 + timeout_seconds: 8