mirror of
https://github.com/discourse/discourse.git
synced 2026-08-06 13:08:40 +08:00
- Bumping the eval llm config to newer models, also update gpt urls to the responses api - update DE runner since we swapped out of strucutred outptus
149 lines
4.4 KiB
YAML
Vendored
149 lines
4.4 KiB
YAML
Vendored
llms:
|
|
gpt-5.5:
|
|
display_name: GPT-5.5
|
|
name: gpt-5.5
|
|
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
|
|
api_key_env: OPENAI_API_KEY
|
|
provider: open_ai
|
|
url: https://api.openai.com/v1/responses
|
|
max_prompt_tokens: 1050000
|
|
vision_enabled: true
|
|
|
|
gpt-5.5-thinking:
|
|
display_name: GPT-5.5 Thinking
|
|
name: gpt-5.5
|
|
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
|
|
api_key_env: OPENAI_API_KEY
|
|
provider: open_ai
|
|
url: https://api.openai.com/v1/responses
|
|
max_prompt_tokens: 1050000
|
|
vision_enabled: true
|
|
provider_params:
|
|
reasoning_effort: high
|
|
|
|
gpt-5.4:
|
|
display_name: GPT-5.4
|
|
name: gpt-5.4
|
|
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
|
|
api_key_env: OPENAI_API_KEY
|
|
provider: open_ai
|
|
url: https://api.openai.com/v1/responses
|
|
max_prompt_tokens: 400000
|
|
vision_enabled: true
|
|
|
|
gpt-5.4-nano:
|
|
display_name: GPT-5.4 Nano
|
|
name: gpt-5.4-nano
|
|
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
|
|
api_key_env: OPENAI_API_KEY
|
|
provider: open_ai
|
|
url: https://api.openai.com/v1/responses
|
|
max_prompt_tokens: 400000
|
|
vision_enabled: true
|
|
|
|
gpt-5.4-nano-thinking:
|
|
display_name: GPT-5.4 Nano Thinking
|
|
name: gpt-5.4-nano
|
|
tokenizer: DiscourseAi::Tokenizer::OpenAiTokenizer
|
|
api_key_env: OPENAI_API_KEY
|
|
provider: open_ai
|
|
url: https://api.openai.com/v1/responses
|
|
max_prompt_tokens: 400000
|
|
vision_enabled: true
|
|
provider_params:
|
|
reasoning_effort: low
|
|
|
|
claude-4.7-opus:
|
|
display_name: Claude 4.7 Opus
|
|
name: claude-opus-4-7
|
|
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
|
|
api_key_env: ANTHROPIC_API_KEY
|
|
provider: anthropic
|
|
url: https://api.anthropic.com/v1/messages
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
|
|
claude-4.7-opus-thinking:
|
|
display_name: Claude 4.7 Opus Thinking
|
|
name: claude-opus-4-7
|
|
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
|
|
api_key_env: ANTHROPIC_API_KEY
|
|
provider: anthropic
|
|
url: https://api.anthropic.com/v1/messages
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
provider_params:
|
|
disable_top_p: true
|
|
disable_temperature: true
|
|
enable_reasoning: true
|
|
reasoning_tokens: 2048
|
|
|
|
claude-4.6-sonnet:
|
|
display_name: Claude 4.6 Sonnet
|
|
name: claude-sonnet-4-6
|
|
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
|
|
api_key_env: ANTHROPIC_API_KEY
|
|
provider: anthropic
|
|
url: https://api.anthropic.com/v1/messages
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
|
|
claude-4.6-sonnet-thinking:
|
|
display_name: Claude 4.6 Sonnet Thinking
|
|
name: claude-sonnet-4-6
|
|
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
|
|
api_key_env: ANTHROPIC_API_KEY
|
|
provider: anthropic
|
|
url: https://api.anthropic.com/v1/messages
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
provider_params:
|
|
disable_top_p: true
|
|
disable_temperature: true
|
|
enable_reasoning: true
|
|
reasoning_tokens: 2048
|
|
|
|
claude-4.5-haiku:
|
|
display_name: Claude 4.5 Haiku
|
|
name: claude-haiku-4-5
|
|
tokenizer: DiscourseAi::Tokenizer::AnthropicTokenizer
|
|
api_key_env: ANTHROPIC_API_KEY
|
|
provider: anthropic
|
|
url: https://api.anthropic.com/v1/messages
|
|
max_prompt_tokens: 200000
|
|
vision_enabled: true
|
|
|
|
gemini-3.1-pro:
|
|
display_name: Gemini 3.1 Pro
|
|
name: gemini-3.1-pro
|
|
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
|
|
api_key_env: GEMINI_API_KEY
|
|
provider: google
|
|
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3.1-pro-preview
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
|
|
gemini-3-flash:
|
|
display_name: Gemini 3 Flash
|
|
name: gemini-3-flash
|
|
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
|
|
api_key_env: GEMINI_API_KEY
|
|
provider: google
|
|
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3-flash-preview
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
|
|
gemini-3-flash-thinking:
|
|
display_name: Gemini 3 Flash Thinking
|
|
name: gemini-3-flash
|
|
tokenizer: DiscourseAi::Tokenizer::GeminiTokenizer
|
|
api_key_env: GEMINI_API_KEY
|
|
provider: google
|
|
url: https://generativelanguage.googleapis.com/v1beta/models/gemini-3-flash-preview
|
|
max_prompt_tokens: 1000000
|
|
vision_enabled: true
|
|
provider_params:
|
|
disable_top_p: true
|
|
disable_temperature: true
|
|
enable_thinking: true
|
|
thinking_tokens: 2048
|