CLIP Interrogator 页面截图
产品页面 点击查看大图

CLIP Interrogator

CLIP Interrogator 是一款提示词工程工具,结合 OpenAI 的 CLIP 与 Salesforce 的 BLIP,为给定图片优化文本提示词,以配合 Stable Diffusion 等文生图模型创作图像。

反向学习提示词人工智能绘画
平台
Replicate、Docker
价格
开放源代码,可通过 Docker 在本地自行运行;在 Replicate 平台运行时按使用量付费,约 $0.038/次。
01

Overview

产品概述

该工具使用 OpenAI 的 CLIP 模型将输入图片与多种艺术家、媒介和风格进行比对,分析模型如何理解图像内容;同时结合 Salesforce 的 BLIP 生成的图片描述,输出可用于生成相似图像的文本提示词。模型托管在 Replicate 平台上,以 API 方式运行,使用 Nvidia T4 GPU 硬件,预测通常在 3 分钟内完成;项目同时开放源代码,可通过 Docker 在本地运行。
02

Capabilities

核心能力

01

图像到提示词生成

结合 OpenAI CLIP 与 Salesforce BLIP,为输入图片生成匹配的文本提示词,可用于 Stable Diffusion 等文生图模型。

02

艺术家、媒介与风格分析

使用 CLIP 模型将图片与多种艺术家、媒介和风格进行比对,帮助理解模型对图像内容的解读。

03

开源且支持本地部署

模型开放源代码,可通过 Docker 在自己的计算机上运行,不依赖云端服务。

04

通过 Replicate API 调用

提供 Replicate 上的 API 运行方式,并展示运行时间与费用估算。

03

Use Cases

适用场景

  1. 01

    辅助 Stable Diffusion 艺术创作

    利用生成的提示词配合 Stable Diffusion 等文生图模型制作图像。

  2. 02

    提示词工程与图像理解研究

    分析 CLIP 模型如何看待不同艺术家、媒介和风格,并结合 BLIP 描述改进提示词。

04

Integrations

集成能力

01

OpenAI CLIP

用于分析输入图像与多种艺术家、媒介和风格的匹配程度。

02

Salesforce BLIP

用于生成图像描述,并与 CLIP 结果结合以建议文本提示词。