支持的大模型厂商
六家一方大模型厂商(OpenAI、Anthropic Claude、Google Gemini、DeepSeek、Qwen、Kimi),外加 Azure OpenAI、Codex OAuth 与 OpenRouter——以及任何你自己部署的 OpenAI 兼容端点。可以按节点混用不同厂商,在速度、成本与质量之间调优。
OpenAI
openaiAnthropic Claude
claudeGoogle Gemini
geminiDeepSeek
deepseek阿里 Qwen
openai月之暗面 Kimi
openaiMiniMax
minimax智谱 GLM
glmAzure OpenAI
openaiOpenAI Codex
codexOpenRouter
openrouter| 厂商 | 类型 | 说明 |
|---|---|---|
| OpenAI | openai | GPT-4、GPT-5 系列 |
| Anthropic Claude | claude | Claude 4 Sonnet / Opus |
| Google Gemini | gemini | Gemini 2.5+ Pro / Flash |
| DeepSeek | deepseek | 对话与推理模型 |
| 阿里 Qwen | openai | OpenAI 兼容 |
| 月之暗面 Kimi | openai | kimi-k2-turbo-preview |
| MiniMax | minimax | MiniMax 系列模型 |
| 智谱 GLM | glm | GLM-4 系列 |
| Azure OpenAI | openai | 企业部署 |
| OpenAI Codex | codex | OAuth 认证,无需 API Key |
| OpenRouter | openrouter | 300+ 模型,一个 Key 通用 |
认证方式对照表
每家厂商如何认证,以及它是否支持走 Azure 或自部署的 OpenAI 兼容端点。
| 厂商 | 认证方式 | Azure | 自部署 |
|---|---|---|---|
| OpenAI | API Key | ✔ 通过 Azure OpenAI | ✔ 任意 OpenAI 兼容端点 |
| Anthropic Claude | API Key · 订阅 Token | — | — |
| Google Gemini | API Key | — | — |
| DeepSeek | API Key | — | ✔ |
| 阿里 Qwen | API Key(OpenAI 兼容) | — | ✔ |
| 月之暗面 Kimi | API Key(OpenAI 兼容) | — | ✔ |
| MiniMax | API Key | — | — |
| 智谱 GLM | API Key | — | — |
| Azure OpenAI | Azure Key + endpoint + deployment | ✔ 原生支持 | — |
| OpenAI Codex | OAuth(本地 Codex 凭据) | — | — |
| OpenRouter | API Key(一个 Key,300+ 模型) | — | — |
按节点选型指南
各个工作流阶段推荐的模型档位。配合下面的 pipeline YAML 就能把路由接起来。
Schema Linking
SQL 生成
推理 / 输出
用于上下文召回的 Embedding 模型
把文本和查询向量化,用于语义检索、召回与上下文匹配。
OpenAI Embeddings
text-embedding-3-*1536 / 3072 维,托管服务sentence-transformers
all-MiniLM-L6-v2384 维 · 约 100MB · 默认选项Multilingual E5
e5-large-instruct1024 维 · 约 1.2GB · 多语言BGE(中文)
bge-large-zh-v1.51024 维 · 针对中文优化BGE(英文)
bge-large-en-v1.51024 维 · 针对英文优化大模型可观测性
既能在生产环境追踪每一次 prompt,也能在本地导出 YAML 排查——挑适合你工作流的那种。
LangSmith
LANGSMITH_TRACING=true · LANGSMITH_API_KEYLangfuse
LANGFUSE_PUBLIC_KEY · LANGFUSE_SECRET_KEY · LANGFUSE_HOSTLLM Trace
--save_llm_trace按节点分配模型
不同的工作流步骤用不同的厂商。Schema Linking 路由到便宜的模型,SQL 生成路由到更强的模型——都在同一条流水线里完成。
pipeline:
schema_linking:
provider: openai
model: gpt-4o-mini
sql_generation:
provider: claude
model: claude-sonnet-4
validation:
provider: gemini
model: gemini-2.5-flash常见问题
支持的厂商、按节点路由、切换模型、Embedding 与链路追踪。
Datus 支持哪些大模型厂商?
Datus 开箱支持 11 家以上厂商:OpenAI、Anthropic Claude、Google Gemini、DeepSeek、阿里 Qwen、月之暗面 Kimi、MiniMax、智谱 GLM、Azure OpenAI、通过 OAuth 接入的 OpenAI Codex,以及一个 Key 就能用上 300+ 模型的 OpenRouter。
工作流的每一步能用不同的模型吗?
可以。按节点分配模型让你给每一步挑不同的厂商和模型——比如规划用快模型、生成 SQL 用推理强的模型、校验用便宜的模型。
怎么在 CLI 里切换当前模型?
在 Datus CLI 里执行 /model,会列出已配置的厂商供你选择新的当前模型。改动会写回 ~/.datus/agent.yml,下次会话仍沿用这个默认值。
Embedding 呢?
Datus 支持 OpenAI Embeddings、Sentence-Transformers 以及 Hugging Face 上的模型(E5、BGE),检索既可以完全本地跑,也可以按需接托管厂商。
每家厂商的 Key 都要配吗?
不用——只配你真正会用到的。很多团队一开始只用一个 Key(OpenAI 或 OpenRouter),之后再出于成本或延迟考虑补上专用模型。
怎么追踪大模型调用?
Datus 支持 LangSmith、Langfuse(配合 OpenTelemetry / OpenInference),也提供本地的 --save_llm_trace 参数,把每一次 prompt 和 completion 导出成 YAML 供离线排查。
每一步都用对模型
按厂商配置 planner、coder 与 reranker——Anthropic、OpenAI、Gemini,或者你自己部署的端点,全部由一份 YAML 管理。