Photo to Prompt(phototoprompt.org)是一个在线的 AI 图像描述与图片转提示词工具。官方描述是:上传图片即可得到清晰的 AI 图像描述、图像转文字结果、alt 文本、字幕,或可直接复用到 Gemini Image、Midjourney、Stable Diffusion、ComfyUI 等模型的提示词。界面上有上传区(JPG、PNG、WEBP,一次最多 5 张)、可选的 Description Goal(说明用途,如文生图或图生图)、可选的 Target AI Tool,以及 11 种描述语言,包含英语、中文、日语、韩语、法语、德语、西班牙语、俄语与阿拉伯语等。
官方把流程写成三步:上传图片 → 选择描述选项(目标工作流与输出语言)→ 获取并复制 AI 图像描述。可选的输出类型包括通用图像描述、无障碍 alt 文本、网站文案、字幕、物体识别、艺术风格说明,以及为 Midjourney、Stable Diffusion、Gemini Image、ComfyUI 准备的可直接使用的模型提示词;官方也说明支持免费试用,升级后月度上限更高。
页面还给出一个完整的输入输出示例:输入一张人物照片后,生成的提示词详细描述为一位年轻女性坐在浅紫色背景前的地板上拍全身影棚人像,穿着淡紫色粗针织毛衣、白裙与白袜,抱着大号 Sanrio Kuromi 玩偶并温和看向镜头,背景有手绘紫色涂鸦与文字 A、ANNISA、纸飞机和花朵,风格类似 K-pop 小卡或同人杂志封面,并在末尾追加要求:保持上传图片中完全相同的脸、不做改动、去掉耳环。这种写法适合做角色一致性复现。
CLIP Interrogator 主要在本地或 WebUI 内使用、输出偏标签堆叠;Photo to Prompt 是网页服务,可选目标模型与输出类型(alt 文本、字幕、艺术风格说明),并支持 11 种语言
通用助手输出的是对话式描述,需要自己改成模型提示词;Photo to Prompt 直接按目标工具生成 prompt-ready 文本,并可切换输出语言与用途
Midjourney /describe 只能在 Midjourney 内使用、输出面向自身模型;Photo to Prompt 不绑定生图平台,同时服务无障碍与 SEO 文案场景
上传图片后生成画面描述、alt 文本、字幕或可直接用于 Midjourney、Stable Diffusion、Gemini Image、ComfyUI 的提示词。
支持 JPG/PNG/WEBP 格式,一次最多上传 5 张用于批量描述。
支持,可选英语、中文、日语、韩语、法语、德语、西班牙语、意大利语、葡萄牙语、俄语、阿拉伯语共 11 种。
官方说明可免费在线试用,升级后月度上限更高。
官方建议上传主体清晰、细节充足的图片以获得更好的图像转文字结果,输出后按发布场景再微调。
Photo to Prompt 是在线图像描述与反推提示词工具,把图片转成 alt 文本、字幕或可直接喂给 Midjourney、Stable Diffusion 的提示词
将图片转化为提示词,以及图像生成