Commit 8c1588bb authored by YaningGao's avatar YaningGao
Browse files

update cladue api

parent bdbada26
Loading
Loading
Loading
Loading
+1 −1
Original line number Diff line number Diff line
env1:
  env_name: frozenlake
  env_config:
    render_mode: text
    render_mode: vision
    prompt_format: free_think
    use_accuracy_reward: false
  train_size: 10000
+1 −1
Original line number Diff line number Diff line
@@ -5,7 +5,7 @@ server_max_workers: 48

# Inference parameters
batch_size: 32
max_steps: 10
max_steps: 3
split: "test"
debug: false

+44 −8
Original line number Diff line number Diff line
models:
  qwen_0.5b:
    provider: vllm
    model_name: Qwen/Qwen2.5-0.5B-Instruct
    max_tokens: 1024
    temperature: 0.7
    tensor_parallel_size: 1
    gpu_memory_utilization: 0.9
  # qwen_0.5b:
    # provider: vllm
    # model_name: Qwen/Qwen2.5-0.5B-Instruct
    # max_tokens: 1024
    # temperature: 0.7
    # tensor_parallel_size: 1
    # gpu_memory_utilization: 0.9

  # qwen_vl_3b:
  #   provider: vllm
@@ -14,3 +14,39 @@ models:
  #   temperature: 0.7
  #   tensor_parallel_size: 2
  #   gpu_memory_utilization: 0.9

  # gpt4o:
  #   provider: openai
  #   model_name: gpt-4o
  #   max_tokens: 1024
  #   temperature: 0.7
  #   presence_penalty: 0.0
  #   frequency_penalty: 0.0
  #   max_retries: 3
  #   timeout: 60

  # gpt4_vision:
  #   provider: openai
  #   model_name: gpt-4-vision-preview
  #   max_tokens: 1024
  #   temperature: 0.7
  #   presence_penalty: 0.0
  #   frequency_penalty: 0.0
  #   max_retries: 3
  #   timeout: 60

  claude_3_haiku:
    provider: claude
    model_name: claude-3-haiku-20240307
    max_tokens: 1024
    temperature: 0.7
  
  # # Batch processing configuration example
  # claude_3_haiku_batch:
  #   provider: claude
  #   model_name: claude-3-haiku-20240307
  #   max_tokens: 1024
  #   temperature: 0.7
  #   use_batch_api: true  # Use batch API for cost optimization
  #   batch_poll_interval: 10  # Poll every 10 seconds
  #   batch_max_wait_time: 7200  # Wait up to 2 hours
 No newline at end of file
+9 −0
Original line number Diff line number Diff line
# Use Openai API
```
export OPENAI_API_KEY=<sk-your_openai_api_key>
```

# Use Claude API
```
export ANTHROPIC_API_KEY=<your_claude_api_key>
```
 No newline at end of file
+5 −0
Original line number Diff line number Diff line
from .vllm import VLLMModelInterface, VLLMModelConfig
from .openai import OpenAIModelInterface, OpenAIModelConfig
from .claude import ClaudeModelInterface, ClaudeModelConfig

REGISTERED_MODEL = {
    "vllm": {
@@ -9,5 +10,9 @@ REGISTERED_MODEL = {
    "openai": {
        "model_cls": OpenAIModelInterface,
        "config_cls": OpenAIModelConfig
    },
    "claude": {
        "model_cls": ClaudeModelInterface,
        "config_cls": ClaudeModelConfig
    }
}
 No newline at end of file
Loading