0
0
Fork 0
mirror of https://github.com/discourse/discourse.git synced 2026-08-06 13:08:40 +08:00
discourse/plugins/discourse-ai/config/eval-llms.yml
Natalie Tay b12015e490
DEV: Update models in config and the DE runner (#41082)
- Bumping the eval llm config to newer models, also update gpt urls to
the responses api
- update DE runner since we swapped out of strucutred outptus
2026-06-22 21:29:07 +08:00

149 lines
4.4 KiB
YAML
Vendored

llms:
gpt-5.5:
display_name: GPT-5.5
name: gpt-5.5
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
api_key_env: OPENAI_API_KEY
provider: open_ai
url: https://api.openai.com/v1/responses
max_prompt_tokens: 1050000
vision_enabled: true
gpt-5.5-thinking:
display_name: GPT-5.5 Thinking
name: gpt-5.5
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
api_key_env: OPENAI_API_KEY
provider: open_ai
url: https://api.openai.com/v1/responses
max_prompt_tokens: 1050000
vision_enabled: true
provider_params:
reasoning_effort: high
gpt-5.4:
display_name: GPT-5.4
name: gpt-5.4
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
api_key_env: OPENAI_API_KEY
provider: open_ai
url: https://api.openai.com/v1/responses
max_prompt_tokens: 400000
vision_enabled: true
gpt-5.4-nano:
display_name: GPT-5.4 Nano
name: gpt-5.4-nano
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
api_key_env: OPENAI_API_KEY
provider: open_ai
url: https://api.openai.com/v1/responses
max_prompt_tokens: 400000
vision_enabled: true
gpt-5.4-nano-thinking:
display_name: GPT-5.4 Nano Thinking
name: gpt-5.4-nano
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
api_key_env: OPENAI_API_KEY
provider: open_ai
url: https://api.openai.com/v1/responses
max_prompt_tokens: 400000
vision_enabled: true
provider_params:
reasoning_effort: low
claude-4.7-opus:
display_name: Claude 4.7 Opus
name: claude-opus-4-7
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
api_key_env: ANTHROPIC_API_KEY
provider: anthropic
url: https://api.anthropic.com/v1/messages
max_prompt_tokens: 1000000
vision_enabled: true
claude-4.7-opus-thinking:
display_name: Claude 4.7 Opus Thinking
name: claude-opus-4-7
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
api_key_env: ANTHROPIC_API_KEY
provider: anthropic
url: https://api.anthropic.com/v1/messages
max_prompt_tokens: 1000000
vision_enabled: true
provider_params:
disable_top_p: true
disable_temperature: true
enable_reasoning: true
reasoning_tokens: 2048
claude-4.6-sonnet:
display_name: Claude 4.6 Sonnet
name: claude-sonnet-4-6
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
api_key_env: ANTHROPIC_API_KEY
provider: anthropic
url: https://api.anthropic.com/v1/messages
max_prompt_tokens: 1000000
vision_enabled: true
claude-4.6-sonnet-thinking:
display_name: Claude 4.6 Sonnet Thinking
name: claude-sonnet-4-6
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
api_key_env: ANTHROPIC_API_KEY
provider: anthropic
url: https://api.anthropic.com/v1/messages
max_prompt_tokens: 1000000
vision_enabled: true
provider_params:
disable_top_p: true
disable_temperature: true
enable_reasoning: true
reasoning_tokens: 2048
claude-4.5-haiku:
display_name: Claude 4.5 Haiku
name: claude-haiku-4-5
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
api_key_env: ANTHROPIC_API_KEY
provider: anthropic
url: https://api.anthropic.com/v1/messages
max_prompt_tokens: 200000
vision_enabled: true
gemini-3.1-pro:
display_name: Gemini 3.1 Pro
name: gemini-3.1-pro
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
api_key_env: GEMINI_API_KEY
provider: google
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3.1-pro-preview
max_prompt_tokens: 1000000
vision_enabled: true
gemini-3-flash:
display_name: Gemini 3 Flash
name: gemini-3-flash
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
api_key_env: GEMINI_API_KEY
provider: google
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3-flash-preview
max_prompt_tokens: 1000000
vision_enabled: true
gemini-3-flash-thinking:
display_name: Gemini 3 Flash Thinking
name: gemini-3-flash
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
api_key_env: GEMINI_API_KEY
provider: google
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3-flash-preview
max_prompt_tokens: 1000000
vision_enabled: true
provider_params:
disable_top_p: true
disable_temperature: true
enable_thinking: true
thinking_tokens: 2048