视觉
使用视觉模型分析图像
配置
图像文件
上传图像文件
图像文件引用
引用先前模块中的图像
图像 URL(备选)
或输入可公开访问的图像 URL
视觉模型
gpt-4o
提示词*
输入图像分析提示词
API 密钥*
••••••••
工具
vision_tool
使用先进的视觉模型处理并分析图像。可理解图像内容、提取文字、识别对象,并提供详细的视觉描述。
输入
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
apiKey | string | 是 | 所选模型提供方的 API 密钥 |
imageUrl | string | 否 | 可公开访问的图像 URL |
imageFile | file | 否 | 要分析的图像文件 |
model | string | 否 | 要使用的视觉模型 (gpt-4o, claude-3-opus-20240229 等) |
prompt | string | 否 | 用于图像分析的自定义提示词 |
输出
| 参数 | 类型 | 说明 |
|---|---|---|
content | string | 图像的分析内容与描述 |
model | string | 用于分析的视觉模型 |
tokens | number | 分析所用的总 token 数 |
usage | object | token 用量明细 |
使用说明
将 Vision 集成到工作流中。可使用视觉模型分析图像。
备注
- 类别:
tools - 类型:
vision