本文要点

DeepSeek R1 等推理端点用延迟与 output token 换更难的多步任务。适合数学、复杂重构与规划——不适合每一轮对话。路由/便宜模型做分发,推理模型做难切片。模型名以 platform.deepseek.com 为准。

何时开推理

普通对话模型 pass@1 失败且错误在逻辑而非 tool schema 时启用。FAQ、简单抽取、高 QPS 路径不必开。预算 output 重的 trace。与 Agent 联用时谨慎。

海外接入

从 deepseek-api-overseas-quickstart 开始 → 相同 15 任务对比 reasoner/chat → 测 P95 与 $/成功 → 加 failover。与 Qwen 推理档一并对比。

在 Swift Horse 上的下一步

DeepSeek /models → vs Qwen → 编程指南。

常见问题

DeepSeek R1 是什么?

DeepSeek 推理模型线——用于难多步任务;API ID 以官方文档为准。

R1 值得额外成本吗?

仅在对话模型失败的任务上——看 $/成功任务,不看 demo。

R1 还是普通 DeepSeek 对话?

简单走 chat;难的走 R1/推理端点。

这是 DeepSeek 官方文档吗?

否——Swift Horse 独立指南。