# models 场景化推荐表（策展层 / 意图排序最高权重）

> **前置条件：** 先阅读 [`../arkcli-shared/SKILL.md`](../../arkcli-shared/SKILL.md) 了解认证、全局参数和安全规则。
> **快照对齐：** 2026-06。表里的"版本"列是**策展快照**，不是事实源。**任何完整模型 ID 都以 `arkcli models search` 实时返回为准**——见下方 JOIN 协议。

## 这张表解决什么

模型搜索不是召回问题，是排序问题：本地缓存有**全量模型**，任何 query 都 100% 召回，难的是**精准排序**。命名启发式（代次 / tier / update_time）只能从模型名字猜能力，猜不出"这个模型适合翻译还是适合 Agent 任务"——缺的是**标签系统**。

本表就是那套标签系统：人工策展的 `场景标签 → 推荐模型`，把"意图 → 模型"这一跳钉死。它是**意图排序的最高权重信号**，压过命名启发式；但必须经左表（本地缓存）事实校验才采纳。

## 使用规则

- Agent 基于「场景标签 + 推荐模型描述」召回推荐模型。
- 推荐模型描述包含版本差异、常见需求词、旧模型别名和升级引导，用于提升检索命中率。
- 用户明确指定第三方、开源或历史模型时，回到 `arkcli models search` 检索，**不强行替换**。
- 本表只服务"按意图找模型"（search 线）。**枚举 / 盘点 / 统计走 `arkcli models list`，不挂本表重排。**

## 模型推荐表

| 场景标签 | 默认推荐模型 | 版本 | 推荐模型描述 |
| --- | --- | --- | --- |
| 文本生成 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | 通用生产模型，兼顾效果、响应速度与成本。适合日常问答、内容创作、文案撰写、摘要总结、办公辅助和一般文本处理。用户未提出特殊要求，或仅询问通用模型、默认模型、日常模型时优先推荐。 |
| 文本翻译 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | 适合文章、产品文案、技术资料和日常内容的多语言翻译，也可用于润色、改写和跨语言内容转换。用户询问翻译模型、英文润色、多语言处理时推荐。 |
| 信息抽取 | Doubao-Seed-2.0-mini | doubao-seed-2-0-mini-260428 | 面向高吞吐、轻量调用优化。适合字段提取、分类归纳、标签生成、格式转换和批量结构化处理。用户强调调用量大、任务明确、批处理或成本敏感时优先推荐。 |
| 长文本理解 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | 适合分析长文章、报告、网页内容和多轮上下文，完成总结、问答、归纳和关键信息提取。用户询问长文阅读、长上下文、报告总结时推荐。 |
| 文档理解 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | 适合阅读文档、分析材料、总结报告和回答基于文件内容的问题，可用于办公、研究和知识整理。用户询问 PDF、文件解析、文档问答时推荐。 |
| 复杂推理 | Doubao-Seed-2.0-pro | doubao-seed-2-0-pro-260215 | 面向复杂工作流和长链路推理优化。适合多步骤分析、复杂指令、多约束任务、方案比较、数学逻辑和科研辅助。用户强调效果优先、复杂度高、推理能力强时优先推荐。 |
| Agent 任务 | Doubao-Seed-2.0-pro | doubao-seed-2-0-pro-260215 | 适合智能体、自动化任务和复杂工作流，可处理任务拆解、多轮规划、持续决策和长链路执行。用户询问 Agent、智能体、复杂任务编排、自动执行时优先推荐。 |
| 工具调用 | Doubao-Seed-2.0-pro | doubao-seed-2-0-pro-260215 | 适合通过 Function Calling、MCP 或外部 API 完成信息查询、业务操作、流程自动化和复杂工具编排。用户明确要求调用工具、MCP、函数调用或 API 编排时推荐。 |
| 低成本调用 | Doubao-Seed-2.0-mini | doubao-seed-2-0-mini-260428 | 面向推理吞吐和部署密度优化，适合预算敏感的轻量任务，如分类、抽取、改写、格式转换、标签生成和批量内容处理。用户询问便宜、省钱、低成本时推荐。 |
| 高并发调用 | Doubao-Seed-2.0-mini | doubao-seed-2-0-mini-260428 | 面向高并发和批量生成优化。适合快速回复、实时分类、短文本处理、大规模离线任务和高频调用。用户询问高吞吐、低等待、批处理时推荐。 |
| 代码生成 | Doubao-Seed-2.0-Code | doubao-seed-2-0-code-preview-260215 | 面向企业级编程任务优化。适合代码生成、补全、解释、调试、Bug 修复、前端开发、多文件修改和项目级开发。用户询问 Coding、代码能力、研发 Agent、仓库级修改时优先推荐。 |
| 角色扮演 | Doubao-Seed-Character | doubao-seed-character-251128 | 面向角色扮演和故事叙事定向优化。适合虚拟角色、人设对话、情感陪伴、多人剧情互动和长旁白故事。用户询问角色模型、陪伴模型、剧情互动时推荐。 |
| 视觉理解 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | Seed2.0 Lite 原生支持文本、图片、音频、视频统一理解，适合图片问答、截图分析、图表解读、视觉信息提取和图文混合输入。用户询问看图、识图、图表分析或通用多模态模型时优先推荐。 |
| 复杂视觉推理 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | Seed2.0 Lite 支持跨模态推理，可结合图片、视频、音频和文本信息完成复杂分析。适合多图理解、复杂图表、视觉逻辑推理、图文整合和跨模态问答。 |
| 视频理解 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | Seed2.0 Lite 强化视频时序理解和运动感知，并可联合视频画面、语音和环境声音完成端到端音视频理解。适合视频总结、关键事件分析、动作理解、视频问答和从视频中提取音频信息。 |
| 音频理解 | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | Seed2.0 Lite 支持原生音频输入和音频理解，可分析录音、播客、会议和访谈内容，完成摘要总结、信息提取和问答。适合需要同时结合语音、环境声音与上下文的任务。 |
| GUI Agent | Doubao-Seed-2.0-lite | doubao-seed-2-0-lite-260428 | Seed2.0 Lite 已升级 GUI 能力，适合网页、桌面和 App 界面的视觉理解、元素识别、视觉定位、点击执行和流程自动化。用户提到 GUI Agent、UI-TARS、ui tars、Browser Use、Computer Use、页面自动化时，默认优先引导至 Seed2.0 Lite；仅在必须兼容旧接入时再查询旧模型。 |
| 图片生成 | Doubao-Seedream-5.0 | doubao-seedream-5-0-260128 | 新一代图片生成模型，支持深度思考和联网检索，强化知识推理、指令理解、生成效果、编辑响应和一致性。适合海报、电商素材、品牌视觉、插画、概念图和专业创意内容。用户询问 Seedream 4.0、Seedream 4.5 或旧版生图模型但未要求兼容旧接入时，优先引导至 Seedream 5.0。 |
| 知识型图片生成 | Doubao-Seedream-5.0 | doubao-seedream-5-0-260128 | 支持深度思考与联网检索，适合结合知识信息、实时内容和复杂指令完成生成。可用于信息图、知识海报、专业设计素材、时事可视化和需要事实理解的图片创作。 |
| 图片编辑 | Doubao-Seedream-5.0 | doubao-seedream-5-0-260128 | 相比 Seedream 4.5，进一步强化编辑响应和一致性。适合局部修改、元素增删、参考图改图、风格调整、画面优化和主体一致性保持。用户提到 Seedream 4.5、Seededit 或旧版图片编辑时，默认优先引导至 Seedream 5.0。 |
| 多图参考 | Doubao-Seedream-5.0 | doubao-seedream-5-0-260128 | 适合结合多张参考图完成生成和编辑，可用于人物一致性、商品一致性、多图融合、系列素材和参考图改造。用户询问多图编辑、主体保持、系列图片生成时推荐。 |
| 图片文字渲染 | Doubao-Seedream-5.0 | doubao-seedream-5-0-260128 | 适合在画面中生成文字、制作带文案视觉素材和完成知识型图片创作，可用于海报、封面、营销图片、信息图和版式设计。用户提到 Seedream 4.5 的文字渲染能力时，默认优先推荐新版 Seedream 5.0。 |
| 视频生成 | Doubao-Seedance-2.0 | doubao-seedance-2-0-260128 | 新一代音视频联合生成模型，支持文本、图片、音频和视频混合输入，可参考画面、动作、运镜、视觉效果和声音。适合广告、短片、创意视频、复杂动作、视频编辑和视频延展。用户提到 Seedance 1.5、SD1.5、Seedance 1.0 或旧版视频生成时，默认引导至 Seedance 2.0，说明其为全面升级版本。 |
| 快速视频生成 | Doubao-Seedance-2.0-fast | doubao-seedance-2-0-fast-260128 | Seedance 2.0 快速版本，适合快速生成视频预览、批量产出短视频和高频迭代。用户强调快速出片、降低等待、批量生成或先看效果时推荐。 |
| 音画视频生成 | Doubao-Seedance-2.0 | doubao-seedance-2-0-260128 | 采用统一多模态音视频联合生成架构，支持文本、图片、音频和视频输入，适合原生音轨、对白、环境音、动作和镜头协同的视频创作。可用于短剧、广告、音乐视频、口型同步和多模态参考生成。 |
| 3D 生成 | Doubao-Seed3D-2.0 | doubao-seed3d-2-0-260328 | 新一代图生 3D 模型，强化几何精度、纹理和 PBR 材质质量，并提升下游可用性。适合商品展示、游戏资产、设计原型、仿真环境和具身智能训练素材。用户询问 Seed3D 1.0 或旧版图生 3D 时，默认引导至 Seed3D 2.0。 |
| 语音播客 | Doubao-语音播客 |  | 基于端到端实时语音模型，将文章、网页和知识内容自动提炼为双人对话，并生成播客音频。适合资讯解读、知识讲解、教育内容和音频分发。 |
| 音色设计 | Doubao-音色设计 |  | 适合根据自然语言描述设计个性化音色，可用于品牌声音、虚拟角色、游戏人物和差异化语音体验。 |
| 语音合成 | Doubao-语音合成-2.0 |  | 适合将文本转化为自然、流畅且具有表现力的语音。可用于视频配音、有声阅读、客服播报、导航和智能助手。用户询问 TTS、配音、朗读、旁白时推荐 2.0 版本。 |
| 实时语音识别 | Doubao-流式语音识别 |  | 适合边说边转文字的实时场景，如会议字幕、直播字幕、语音输入、智能外呼和 IM 语音消息转写。用户询问 ASR、实时转写、流式识别时推荐。 |
| 录音文件识别 | Doubao-录音文件识别 |  | 适合将录音文件转写成文字，支持会议纪要、访谈整理、课堂记录、客服质检和字幕生成。用户询问离线音频转写、录音识别、批量音频处理时推荐 2.0。 |
| 实时语音交互 | Doubao-实时语音交互 |  | 端到端 Speech-to-Speech 实时语音模型，适合低延迟语音对话。S2S-O 用于闲聊、客服、车载和通用助手；S2S-SC 用于角色扮演、情感陪伴和人格化语音交互。 |
| 多模态向量化 | Doubao-embedding-vision | doubao-embedding-vision-251215 | 适合将文本、图片和视频转换为向量表示，用于语义检索、相似内容召回、跨模态搜索、推荐系统和多模态知识索引。用户询问 embedding、向量模型、以图搜图、视频检索时推荐。 |

## JOIN / 验证协议（场景表 ⨝ 本地全量缓存）

**核心原则：场景表给意图，`arkcli models search` 给事实。表里的版本/full-id 只是起点，命中以 search 实时返回为准。**

**层级边界（别串台）：本表是「模型广场选型层」，数据源永远是 `models search`（catalog），给的是 catalog 推荐模型名。** "当前 profile 能不能调用、确切可调用 id"是下游可用性层（`resources list` → `models get` → `+gen`/`+chat`，arkcli-gen 已实装），**不在本表职责内**。纯选型问题（"查/选哪个模型"）只走 `models search`，不要跑去查 `resources list`；只有用户真要生成/调用时才下沉到 resources list 解析本 profile 真实 id。例：生图选型答 `doubao-seedream-5-0`（catalog 名）；具体到套餐 profile 能点的可能是 `doubao-seedream-5.0-lite`，那是下游 `+gen` 解析的事。

```
① 用户意图 → 匹配场景标签            （用"推荐模型描述"里的需求词提升命中）
② 取该行"默认推荐模型"，推出族名词干  （如 Doubao-Seed-2.0-lite → doubao-seed-2-0-lite）
③ arkcli models search <族名词干>     ← 回左表校验事实（必做，不可跳过）
   ├─ exact   族名命中、版本一致        → 拼 <name>-<primary_version> 置顶推荐
   ├─ drift   族名命中、版本不同        → 用 search 返回的真实版本（它已按 gen/time 排好序，取 top）
   │                                     并提示"推荐表快照 X，当前 Y"
   ├─ bare    命中但 primary_version=None（语音/音频类）→ 停在广场发现层：只说明可搜到，不拼版本，不交给下游能力
   └─ miss    词干完全无命中            → 表 id 可能陈旧；改用场景中文词或更短词干再 search
④ 用 search 同 modality 结果补 2–3 个备选候选
⑤ 用户点名第三方/开源/历史模型（Seedream 4.5、qwen、glm…）→ 跳过本表，直接 search，不强替
```

### 关键边界（实测得出，必读）

- **不要把表里的 full-id 直接拼给 `+chat` / `+gen`，也不要凭记忆给模型名加后缀**。图片生成的真实模型就是 `doubao-seedream-5-0`（**没有 `-lite` 后缀，缓存里不存在带 `-lite` 的变体，硬查会返回 no items**）。这类命名漂移会反复发生——**用族名词干 search，永远以返回结果为准，不要自行补 `-lite` / `-pro` 等后缀**。
- **search 容错 DisplayName**：`Doubao-Seed-2.0-lite`（带点号大小写）也能命中 `doubao-seed-2-0-lite`，但**族名词干（小写连字符）最稳**，优先用它当 search keyword。
- **语音 / 音频 6 项是 bare 路径，且在 arkcli 当前只支持广场发现**：它们在 models 目录里但 `primary_version=None`、无 enrich（ctx/lifecycle 为空）。命中后直接说明裸名（如 `doubao-seed-tts-2-0`、`seedasr-streaming`、`doubao-seed-asr-2-0`、`doubao-seed-podcast`、`doubao-seed-voice-design`）能在广场搜到，但不要尝试拼版本号，也不要继续交给 `+chat` / `+gen` / `+deploy` / `+code-example` / `usage` / `pricing` / `onboard`。对 arkcli 来说，广场可搜不代表可调用、可开 Endpoint、可生成示例、可查费用或可查用量。
- **避开 `-internal` 变体**：search 可能返回 `doubao-seed-2-0-lite-internal` 等内部变体，不要推荐给用户。
- **lifecycle**：命中 `Retiring` 的候选要主动提示用户它在下线，并在同族找更新版本（与主 SKILL 一致）。
