写作与对话
输入文字,输出文字。适合写作、总结、翻译;事实性内容仍需核对。
“帮我把会议记录整理成清晰的工作总结”阅读选型指南
先弄清输入和输出,再选择对应的能力与接口。
输入文字,输出文字。适合写作、总结、翻译;事实性内容仍需核对。
“帮我把会议记录整理成清晰的工作总结”阅读选型指南
不仅要能输出代码,还要考虑上下文长度、工具调用协议和运行环境。
“我需要一个擅长写代码的模型,优先国内原厂 API”阅读选型指南
从文字描述生成新图片。能够绘图不代表能够编辑原有图片。
“我想根据文字生成一张产品宣传海报”阅读选型指南
对原图做修改。保留商品像素可能需要遮罩、抠图和合成,不能仅靠一个能力标签保证。
“给商品图片换背景,商品外形和文字完全不变”阅读选型指南
识图模型输出解释或结构化文字。表格识别之后,还需校对与文件生成步骤。
“识别图片里的表格,最后导出 Excel”阅读选型指南
把文字合成为语音。语言、音色、语速和返回音频格式都需要单独确认。
“把中文文章转换成自然的配音,可以调节语速”阅读选型指南
把录音转写成文字。多人分离、时间戳和实时识别是不同的能力。
“把会议录音转换成中文文字”阅读选型指南
根据文字或参考图片生成视频。时长、比例、音轨以及异步任务流程分别核验。
“根据一张商品图片生成短视频”阅读选型指南
把文本表示成向量用于相似度检索。向量模型与重排模型承担不同步骤。
“为中文知识库生成向量,用于语义搜索”阅读选型指南