# AI 图生视频生成器

> 可以让单张图片动起来、控制两帧之间的过渡，或使用多张参考图引导场景，同时清楚查看生成设置和积分成本。

- **规范网址**: https://genvideo.app/zh/image-to-video
- **语言**: 简体中文
- **最后核验**: 2026-07-28

## 什么是照片转视频 AI？

照片转视频 AI 是一种以静态照片作为视觉引导的图生视频工作流。上传图片后，描述主体动作和镜头运动，再选择当前可用的模型与画幅，即可生成短视频草稿。生成结果可能存在差异，正式发布前仍需要逐条检查。

## 将照片和图片转成 AI 视频

当产品、人物、角色或画面构图已经符合预期时，可以直接从静态图片开始。GenVideo 会以原图作为视觉起点，根据提示词添加主体动作和镜头运动。

### 照片转视频 AI

上传人像、家庭照片、插画或概念画面，再描述你想要的动态。照片转视频 AI 工作流可以添加细微表情、环境运动或可控的镜头推进，无需从空白场景开始。

### 从图片生成 AI 视频

使用一张起始图片直接生成动画，使用两张图片制作画面过渡，或在角色、物体和场景需要更强视觉引导时上传多张参考图。提示词应重点描述动作、镜头和节奏。

### 产品图片转视频

为电商详情页、落地页、产品发布和社交广告制作产品动画。描述旋转、揭晓、扫光、环绕运镜或特写，同时要求模型保留产品形状和包装细节。

### 社交媒体图生视频

TikTok、Instagram Reels 和 YouTube Shorts 可以选择 9:16，网站和演示内容可以使用 16:9。先生成短片草稿，更方便在消耗更多积分前测试运动和构图。

## 根据任务选择图生视频输入方式

不同模式会向模型提供不同的视觉引导。优先选择能够表达目标镜头的最简单输入方式。

| 输入模式 | 适合场景 | 需要提供 | 提示词重点 |
| --- | --- | --- | --- |
| 起始图片 | 让一张照片或产品图动起来 | 一张起始图片 | 主体动作、环境动态、镜头运动和节奏 |
| 首尾帧 | 控制两个构图之间的画面过渡 | 一张起始帧和一张结束帧 | 第一帧如何运动并过渡到第二帧 |
| 参考图片 | 为角色、物体或场景提供更多视觉引导 | 一至三张参考图片 | 如何使用参考图构建场景、动作和镜头方向 |

## 用四层信息组织图生视频提示词

图片已经提供了外观和构图，因此提示词应重点描述画面随时间如何变化。先写一个主要动作，再补充镜头方向、环境运动和需要保持稳定的细节。相比堆叠互不相关的特效，简短且彼此一致的要求更便于生成后判断结果是否符合方向。

实用结构：主体与稳定细节 + 主要动作 + 镜头运动 + 环境运动 + 节奏与氛围。

### 说明主体和需要稳定的细节

指出原图中的产品、人物、角色或场景。如果标签、面部、轮廓、颜色或构图很重要，要明确写出应保持可识别。这能让要求有清晰优先级，但任何生成结果仍然需要人工检查。

### 描述一个主要动作

说明片段中发生的核心变化，例如人物转身、布料随风摆动、产品旋转或光线扫过表面。先从一个容易辨认的动作开始。短片中同时安排过多事件，会增加控制和判断结果的难度。

### 补充镜头和环境运动

只在符合场景时指定缓慢推进、环绕、平移、俯仰、跟拍或固定镜头，再补充雾气、反射、粒子或背景活动等次要运动。避免同时使用彼此冲突的镜头方向。

### 设定节奏、画幅与氛围

按照发布位置选择画幅，并说明动作应当轻微、快速、顺滑还是戏剧化。竖屏画面尤其要避免主体贴近容易被裁切的边缘。提示词中的时间描述属于创意方向，不代表逐帧保证。

## 如何使用 AI 将图片转成视频

先生成短片草稿，确认运动和构图是否符合原图，再决定是否使用更多积分制作变化版本。

1. **上传有权使用的图片** -- 选择自己拥有或已获得处理授权的产品照片、人像、插画或其他图片。
2. **选择输入模式和设置** -- 选择起始图片、首尾帧或参考图片，再根据投放位置选择当前可用模型和画幅。
3. **描述动作和镜头方向** -- 提示词应聚焦主体如何运动、镜头如何移动、画面氛围，以及哪些视觉细节需要尽量保持稳定。
4. **确认消耗、生成并检查** -- 提交前查看界面显示的积分消耗。在工作区或"我的创作"检查结果，再下载视频或调整下一版提示词。

## 发布 AI 视频前需要检查什么

图生视频首先是一份生成草稿，不等于自动通过审核。请用正常速度完整播放，并在关键转场处再次检查。如果某个细节不正确，可以简化下一版提示词，或每次只调整一个设置，以便判断变化来自哪里。

### 主体一致性

对照原图检查面部、手部、Logo、包装、文字、比例和其他身份细节。如果业务关键元素出现意外变化，应重新生成或进入后续编辑。

### 运动与转场

检查突然跳变、非预期变形、穿模或与提示动作相反的运动。使用首尾帧模式时，要分别查看视频如何离开起始画面并到达结束画面。

### 构图与画幅

确认主体在整个片段中保持可见，并检查发布位置中的字幕、按钮或界面遮罩是否会覆盖重要区域。

### 版权与敏感内容

只处理自己拥有或已获授权的图片。涉及人物、品牌、受版权保护角色或敏感主题时，还要核对目标发布平台的规则。

### 导出可用性

在目标工作流中检查文件、时长、方向和画面质量。保留原始图片和提示词，方便之后复现创意决策或继续修改。

## 图生视频常见问题

### 可以只用一张图片生成 AI 视频吗？

可以。选择起始图片模式，上传一张照片，再描述希望出现的动作和镜头方向。这张图片会成为短视频生成的视觉起点。

### 可以免费预览一次图生视频吗？

可以。注册后，每个账号可以使用 Grok Imagine 和一张起始图片生成 1 次 6 秒 480p 视频预览，无需信用卡。更多生成次数和高级模型需要使用充值视频积分。

### 可以选择哪些视频画幅？

图生视频工作区当前提供 16:9、9:16 和 1:1。模型和其他生成设置可能有所不同，提交前应以界面当前显示的选项为准。

### 图生视频提示词应该包含什么？

描述主要动作、环境动态、镜头运动、节奏和氛围。如果产品或角色需要保持稳定，应明确说明需要保留的视觉细节，并在生成后检查准确性。

## 相关 AI 视频工具

在 GenVideo Studio 中继续使用纯提示词生成、动作迁移和产品广告工作流。

- [文生视频](https://genvideo.app/zh/text-to-video): 不需要保留现有图片时，直接从文字提示词创建新场景。
- [AI 动作控制](https://genvideo.app/zh/video-to-video): 把参考视频中的动作和节奏迁移到角色图片。
- [AI 产品视频广告](https://genvideo.app/zh/ai-product-ads): 结合产品、数字人和场景参考图，使用可复用的广告结构创作。

[打开工作区](https://genvideo.app/zh/image-to-video)
