高速推理
Turbo 后缀主打低延迟,适合高频补全与快速迭代,与旗舰模型形成快慢搭配。
模型 · 字节 Doubao-Seed-2.1-turbo
字节跳动高速代码模型,火山方舟 Coding Plan 在售。主打低延迟高频场景:代码补全、快速问答、批量小改动。
Turbo 后缀主打低延迟,适合高频补全与快速迭代,与旗舰模型形成快慢搭配。
与 GLM-5.3 系列 / Kimi-K3 / Kimi-K2.8-Preview / DeepSeek-V4.1-Flash 共享方舟套餐额度。
方舟 Auto 调度会把轻任务路由给高速档模型,省下旗舰额度;夜间 00:00-08:00 Kimi-K3 的路由比例大幅提升。
方舟支持 1M 上下文的型号:glm-5.3、glm-5.3-flash、deepseek-v4.1-flash、deepseek-v4-flash、deepseek-v4-pro、kimi-k3、kimi-k2.8-preview。
| 平台 | 入门价 | 说明 |
|---|---|---|
| 火山引擎方舟 | ¥9.90/月起(首购,Pro ¥49.90) | 唯一官方渠道 · 刊例 Lite ¥40 / Pro ¥200,受邀再享 9.5 折 |
Doubao-Seed 是字节跳动豆包大模型家族的「种子」系列,命名里的 Seed 指代从预训练到对齐的完整自研链路。2.1-turbo 是 2.0 系列之后的迭代:参数规模未大幅变化,重点在推理延迟与高频场景的吞吐优化,这也是方舟把它作为 Coding Plan 主力型号之一的原因。
在方舟的模型矩阵里,turbo 扮演「快档」:Auto 模式将简单任务路由过来,把 GLM-5.3 系列、Kimi-K3 等旗舰额度留给难任务。如果你的日常请求以补全、小范围改动、批量机械修改为主,turbo 的实际体感会明显快于旗舰模型。
方舟当前主推 DeepSeek-V4.1-Flash、GLM-5.3 系列、Doubao-Seed-Evolving、Kimi-K3 与 Kimi-K2.8-Preview,支持自由切换或 Auto 模式调度;doubao-seed-2.0-lite 即将下线,doubao-seed-2.1-lite / 2.1-pro 与 deepseek-v4-pro 正式版已上线。邀请方面,好友首单额外 9.5 折,邀请人每单得下单金额 5% 代金券(上不封顶)。
2.1-turbo 是新一代高速版本,延迟更低;同代还有 2.1-lite / 2.1-pro 已上线,2.0-lite 即将下线。
Doubao 系列模型目前仅通过火山方舟 Coding Plan / API 提供,其他平台暂未接入。
turbo 定位高速档,复杂工程建议同池切换 GLM-5.3 / Kimi-K3 / DeepSeek-V4.1-Flash,把 turbo 留给高频轻任务。
Lite 刊例 ¥40/月、Pro ¥200/月;首购限时价 Lite ¥9.90/月、Pro ¥49.90/月(限时 9.9 元起,名额有限先到先得),受邀下单再享 9.5 折。