选模型,从你要做的事开始
TASK GUIDES

从场景理解模型

先弄清输入和输出,再选择对应的能力与接口。

写作与对话

输入文字,输出文字。适合写作、总结、翻译;事实性内容仍需核对。

帮我把会议记录整理成清晰的工作总结
阅读选型指南

编程开发

不仅要能输出代码,还要考虑上下文长度、工具调用协议和运行环境。

我需要一个擅长写代码的模型,优先国内原厂 API
阅读选型指南

生成图片

从文字描述生成新图片。能够绘图不代表能够编辑原有图片。

我想根据文字生成一张产品宣传海报
阅读选型指南

修改图片

对原图做修改。保留商品像素可能需要遮罩、抠图和合成,不能仅靠一个能力标签保证。

给商品图片换背景,商品外形和文字完全不变
阅读选型指南

识图与文字提取

识图模型输出解释或结构化文字。表格识别之后,还需校对与文件生成步骤。

识别图片里的表格,最后导出 Excel
阅读选型指南

文字转语音

把文字合成为语音。语言、音色、语速和返回音频格式都需要单独确认。

把中文文章转换成自然的配音,可以调节语速
阅读选型指南

语音转文字

把录音转写成文字。多人分离、时间戳和实时识别是不同的能力。

把会议录音转换成中文文字
阅读选型指南

生成视频

根据文字或参考图片生成视频。时长、比例、音轨以及异步任务流程分别核验。

根据一张商品图片生成短视频
阅读选型指南

向量与检索

把文本表示成向量用于相似度检索。向量模型与重排模型承担不同步骤。

为中文知识库生成向量,用于语义搜索
阅读选型指南