Files
chat/config.yaml
Hanzo Dev 94f232abe1 fix: rebrand models to Zen, configure publishable key architecture
- Remove deepseek-r1-distill-70b and qwen3-32b from model lists
- Add zen3-nano, zen, zen4-coder-flash to Zen model catalog
- Reorder models by size (nano -> mini -> zen -> pro -> frontier)
- Replace OPENAI_API_KEY with HANZO_API_KEY for publishable key flow
- Replace Deepseek/Kimi/Moonshot display labels with Zen in parsers.ts
- Add HANZO_API_KEY env var to .env.example with IAM documentation
2026-02-27 11:00:50 -08:00

194 lines
5.4 KiB
YAML

# Hanzo Router Configuration
# Hanzo LLM proxy -- unified LLM gateway routing all models through api.hanzo.ai
model_list:
# =====================
# Zen model family (Hanzo AI)
# Publishable key (HANZO_API_KEY) for unauthenticated users.
# Authenticated users override with their own key via IAM (hanzo.id).
# =====================
- model_name: zen3-nano
litellm_params:
model: openai/zen3-nano
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen3-nano: 4B dense, fast free-tier model"
- model_name: zen4-mini
litellm_params:
model: openai/zen4-mini
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-mini: 8B dense, fast and efficient"
- model_name: zen
litellm_params:
model: openai/zen
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen: 32B default general-purpose model"
- model_name: zen4-pro
litellm_params:
model: openai/zen4-pro
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-pro: 80B MoE flagship reasoning"
- model_name: zen4
litellm_params:
model: openai/zen4
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4: 744B MoE frontier model"
- model_name: zen4-max
litellm_params:
model: openai/zen4-max
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-max: 1.04T MoE, 256K context"
- model_name: zen4-ultra
litellm_params:
model: openai/zen4-ultra
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-ultra: 744B MoE + CoT reasoning"
- model_name: zen4-thinking
litellm_params:
model: openai/zen4-thinking
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-thinking: 80B MoE with chain-of-thought"
- model_name: zen4-coder-flash
litellm_params:
model: openai/zen4-coder-flash
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-coder-flash: 30B MoE, fast code specialist"
- model_name: zen4-coder
litellm_params:
model: openai/zen4-coder
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-coder: 480B MoE code specialist"
- model_name: zen4-coder-pro
litellm_params:
model: openai/zen4-coder-pro
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
model_info:
description: "zen4-coder-pro: 480B dense BF16 coding model"
# =====================
# Third-party models (via Hanzo Cloud)
# =====================
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
- model_name: gpt-4o-mini
litellm_params:
model: openai/gpt-4o-mini
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
- model_name: claude-sonnet-4-5
litellm_params:
model: openai/claude-sonnet-4-5
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
- model_name: claude-haiku-4-5
litellm_params:
model: openai/claude-haiku-4-5
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
# =====================
# Wildcard passthrough
# =====================
- model_name: "openai/*"
litellm_params:
model: "openai/*"
api_base: https://api.hanzo.ai/v1
api_key: os.environ/HANZO_API_KEY
litellm_settings:
drop_params: true
num_retries: 3
request_timeout: 300
telemetry: false
router_settings:
routing_strategy: simple-shuffle
enable_pre_call_checks: true
redis_host: os.environ/REDIS_HOST
redis_password: os.environ/REDIS_PASSWORD
redis_port: os.environ/REDIS_PORT
general_settings:
master_key: os.environ/LITELLM_MASTER_KEY
store_model_in_db: true
database_url: os.environ/DATABASE_URL
database_connection_pool_limit: 10
# UI Configuration
ui_access_mode: "admin"
ui_username: "admin"
ui_password: "hanzo123"
# Branding
custom_branding:
app_name: "Hanzo Router"
logo_url: "/static/hanzo-logo.png"
primary_color: "#000000"
documentation_url: "https://docs.hanzo.ai"
support_email: "support@hanzo.ai"
# MCP Integration
mcp_enabled: true
mcp_servers:
- name: "hanzo-mcp"
command: ["python", "-m", "hanzo_mcp_server"]
- name: "hanzo-code-executor"
command: ["python", "/app/mcp/hanzo_code_executor.py"]
env:
RUNTIME_API_URL: os.environ/RUNTIME_API_URL
RUNTIME_API_KEY: os.environ/RUNTIME_API_KEY
# Runtime API Integration
runtime_api_enabled: true
runtime_api_url: os.environ/RUNTIME_API_URL
runtime_api_key: os.environ/RUNTIME_API_KEY
# Enable health checks
health_check_interval: 30
# Runtime execution models (for code execution)
runtime_models:
- model_name: "hanzo-runtime-python"
description: "Execute Python code in secure sandboxes"
runtime_language: "python"
- model_name: "hanzo-runtime-typescript"
description: "Execute TypeScript code in secure sandboxes"
runtime_language: "typescript"