按任务类型、上下文长度和价格三个维度筛。
「模型广场」按对话、图像、视频、向量等类型分好了。用错类型的端点会直接被拒, 例如拿对话模型去调图像端点。
每个模型详情页标注了上下文窗口与最大输出。长文档处理要留意窗口上限, 超出会被上游截断或直接报错。
同一能力档位内不同模型价差可能很大,模型广场上每个模型都标了单价。 如果只是做分类、抽取这类结构化任务,小模型往往够用且便宜一个数量级。
博客