模型

支持的大模型厂商

六家一方大模型厂商(OpenAI、Anthropic Claude、Google Gemini、DeepSeek、Qwen、Kimi),外加 Azure OpenAI、Codex OAuth 与 OpenRouter——以及任何你自己部署的 OpenAI 兼容端点。可以按节点混用不同厂商,在速度、成本与质量之间调优。

OpenAI

类型openai
说明GPT-4、GPT-5 系列
认证API Key

Anthropic Claude

类型claude
说明Claude 4 Sonnet / Opus
认证API Key · 订阅 Token

Google Gemini

类型gemini
说明Gemini 2.5+ Pro / Flash
认证API Key

DeepSeek

类型deepseek
说明对话与推理模型
认证API Key

阿里 Qwen

类型openai
说明OpenAI 兼容
认证API Key(OpenAI 兼容)

月之暗面 Kimi

类型openai
说明kimi-k2-turbo-preview
认证API Key(OpenAI 兼容)

MiniMax

类型minimax
说明MiniMax 系列模型
认证API Key

智谱 GLM

类型glm
说明GLM-4 系列
认证API Key

Azure OpenAI

类型openai
说明企业部署
认证Azure Key + endpoint + deployment

OpenAI Codex

类型codex
说明OAuth 认证,无需 API Key
认证OAuth(本地 Codex 凭据)

OpenRouter

类型openrouter
说明300+ 模型,一个 Key 通用
认证API Key(一个 Key,300+ 模型)
agent.ymlyaml
厂商类型说明
OpenAIopenaiGPT-4、GPT-5 系列
Anthropic ClaudeclaudeClaude 4 Sonnet / Opus
Google GeminigeminiGemini 2.5+ Pro / Flash
DeepSeekdeepseek对话与推理模型
阿里 QwenopenaiOpenAI 兼容
月之暗面 Kimiopenaikimi-k2-turbo-preview
MiniMaxminimaxMiniMax 系列模型
智谱 GLMglmGLM-4 系列
Azure OpenAIopenai企业部署
OpenAI CodexcodexOAuth 认证,无需 API Key
OpenRouteropenrouter300+ 模型,一个 Key 通用
认证方式

认证方式对照表

每家厂商如何认证,以及它是否支持走 Azure 或自部署的 OpenAI 兼容端点。

auth-matrix.ymlyaml
厂商认证方式Azure自部署
OpenAIAPI Key✔ 通过 Azure OpenAI✔ 任意 OpenAI 兼容端点
Anthropic ClaudeAPI Key · 订阅 Token
Google GeminiAPI Key
DeepSeekAPI Key
阿里 QwenAPI Key(OpenAI 兼容)
月之暗面 KimiAPI Key(OpenAI 兼容)
MiniMaxAPI Key
智谱 GLMAPI Key
Azure OpenAIAzure Key + endpoint + deployment✔ 原生支持
OpenAI CodexOAuth(本地 Codex 凭据)
OpenRouterAPI Key(一个 Key,300+ 模型)
策略

按节点选型指南

各个工作流阶段推荐的模型档位。配合下面的 pipeline YAML 就能把路由接起来。

Schema Linking

快且便宜:DeepSeek Chat、gpt-4o-mini。每一轮都会跑,用来挑出相关的表。

SQL 生成

能力要强:Claude Sonnet、gpt-4-turbo。它写出的 SQL 会交给下游步骤校验。

推理 / 输出

能力最强:Claude Opus、gpt-4-turbo。负责解释结果并驱动多步推理。
Embedding

用于上下文召回的 Embedding 模型

把文本和查询向量化,用于语义检索、召回与上下文匹配。

OpenAI Embeddings

text-embedding-3-*1536 / 3072 维,托管服务

sentence-transformers

all-MiniLM-L6-v2384 维 · 约 100MB · 默认选项

Multilingual E5

e5-large-instruct1024 维 · 约 1.2GB · 多语言

BGE(中文)

bge-large-zh-v1.51024 维 · 针对中文优化

BGE(英文)

bge-large-en-v1.51024 维 · 针对英文优化
可观测性

大模型可观测性

既能在生产环境追踪每一次 prompt,也能在本地导出 YAML 排查——挑适合你工作流的那种。

LangSmith

用途大模型调用链路追踪与调试
环境变量LANGSMITH_TRACING=true · LANGSMITH_API_KEY

Langfuse

用途Agent + 工具的全链路追踪(OTel / OpenInference)
环境变量LANGFUSE_PUBLIC_KEY · LANGFUSE_SECRET_KEY · LANGFUSE_HOST

LLM Trace

用途把 prompt 与 completion 导出成本地 YAML
环境变量--save_llm_trace
按节点路由

按节点分配模型

不同的工作流步骤用不同的厂商。Schema Linking 路由到便宜的模型,SQL 生成路由到更强的模型——都在同一条流水线里完成。

Schema linking → 快且便宜SQL 生成 → 能力强校验 → 折中
pipeline.ymlyaml
pipeline:
  schema_linking:
    provider: openai
    model: gpt-4o-mini
  sql_generation:
    provider: claude
    model: claude-sonnet-4
  validation:
    provider: gemini
    model: gemini-2.5-flash
常见问题

常见问题

支持的厂商、按节点路由、切换模型、Embedding 与链路追踪。

Datus 支持哪些大模型厂商?

Datus 开箱支持 11 家以上厂商:OpenAI、Anthropic Claude、Google Gemini、DeepSeek、阿里 Qwen、月之暗面 Kimi、MiniMax、智谱 GLM、Azure OpenAI、通过 OAuth 接入的 OpenAI Codex,以及一个 Key 就能用上 300+ 模型的 OpenRouter。

工作流的每一步能用不同的模型吗?

可以。按节点分配模型让你给每一步挑不同的厂商和模型——比如规划用快模型、生成 SQL 用推理强的模型、校验用便宜的模型。

怎么在 CLI 里切换当前模型?

在 Datus CLI 里执行 /model,会列出已配置的厂商供你选择新的当前模型。改动会写回 ~/.datus/agent.yml,下次会话仍沿用这个默认值。

Embedding 呢?

Datus 支持 OpenAI Embeddings、Sentence-Transformers 以及 Hugging Face 上的模型(E5、BGE),检索既可以完全本地跑,也可以按需接托管厂商。

每家厂商的 Key 都要配吗?

不用——只配你真正会用到的。很多团队一开始只用一个 Key(OpenAI 或 OpenRouter),之后再出于成本或延迟考虑补上专用模型。

怎么追踪大模型调用?

Datus 支持 LangSmith、Langfuse(配合 OpenTelemetry / OpenInference),也提供本地的 --save_llm_trace 参数,把每一次 prompt 和 completion 导出成 YAML 供离线排查。

每一步都用对模型

按厂商配置 planner、coder 与 reranker——Anthropic、OpenAI、Gemini,或者你自己部署的端点,全部由一份 YAML 管理。