能力地图——从"你想做什么"到"该调什么模型"
U-Router 的入口不是模型清单,而是业务需求清单。你勾选需求,平台自动映射到底层基础模型能力。
需求 → 基础模型能力映射:
你的需求 | 典型场景 | 映射到的基础能力 |
智能问答 / 客服对话 | 用户提问、客服应答、商品咨询 | 文本 / 对话生成 |
文案 / 摘要 / 改写 | 营销文案、内容摘要、润色改写 | 文本 / 对话生成 |
分类 / 打标 / 信息提取 | 内容分类、关键词与字段抽取、审核辅助 | 文本 / 对话生成 |
长文档 / 合同理解 | 长文问答、合同 / 论文 / 说明书提炼 | 长文本理解 |
复杂推理 / 代码 | 多条件决策、数学逻辑、代码生成与解释 | 深度推理 |
识别图片 / 截图 / 票据 | 商品、票据、故障图、截图内容识别 | 视觉理解 |
生成图片 / 海报 | 商品图、封面、插画、营销海报 | 图片生成 |
五类基础模型能力:
基础能力 | 说明 | 计费单位 | 候选模型池(示例) |
文本 / 对话生成 | 实时对话、问答、文案生成、改写润色、摘要、分类与信息提取,支持流式与批量 | 按 token | DeepSeek V4、qwen3.7-max、Kimi K2.6、豆包 Seed2.0、GLM-5.2 |
长文本理解 | 长上下文问答与提炼,处理长文档、合同、论文、说明书等超长输入 | 按 token | Kimi K2.6、qwen3.7-max、DeepSeek V4 |
深度推理 | 数学逻辑、多条件决策、代码生成与解释等强推理任务 | 按 token | DeepSeek V4-Pro、qwen3.7-max、MiniMax M2.7 |
视觉理解 | 图片、截图、票据、商品等多模态输入的识别与理解 | 按次 | 千问多模态、MiniMax 多模态、火山方舟多模态 |
图片生成 | 文生图,用于封面、商品图、插画、海报等 | 按张 | Seedream |
两个重要限制,请在选型时先确认:
其一,图片生成不参与自动路由。 文本、长文本、推理、视觉理解四类能力均支持 model=auto 由平台自动选路;图片生成需要在调用时指定具体生成模型,不支持 model=auto。
其二,多模态能力(视觉理解 / 图片生成)当前仅支持 API 接入。 这两类能力需联系客服开通专属 API 通道,暂不能通过 ADK 调用。若你的业务同时需要文本类与多模态能力,需评估分别走 ADK 与 API 两条链路,或统一走 API 接入。