视觉

使用视觉模型分析图像

配置

图像文件
上传图像文件
图像文件引用
引用先前模块中的图像
图像 URL(备选)
或输入可公开访问的图像 URL
视觉模型
gpt-4o
提示词*
输入图像分析提示词
API 密钥*
••••••••

工具

vision_tool

使用先进的视觉模型处理并分析图像。可理解图像内容、提取文字、识别对象,并提供详细的视觉描述。

输入

参数类型必填说明
apiKeystring是所选模型提供方的 API 密钥
imageUrlstring否可公开访问的图像 URL
imageFilefile否要分析的图像文件
modelstring否要使用的视觉模型 (gpt-4o, claude-3-opus-20240229 等)
promptstring否用于图像分析的自定义提示词

输出

参数类型说明
contentstring图像的分析内容与描述
modelstring用于分析的视觉模型
tokensnumber分析所用的总 token 数
usageobjecttoken 用量明细

使用说明

将 Vision 集成到工作流中。可使用视觉模型分析图像。

备注

  • 类别:tools
  • 类型:vision