🖼️ TapNow AI影像生成小白教程
从一张图都不会做,到能独立生成图片和视频:文生图、图生图、文生视频、图生视频、视频生视频,5种生成方式一次搞懂
🧠 一句话记住:AI模型是大脑决定画质,操作平台是身体决定功能,生成方式决定你怎么开口
🧩
先搞懂两个概念:AI模型 & 操作平台
前置条件
操作平台和AI模型
图:用TapNow做AI影像,先分清「操作平台」和「AI模型」两件事
1AI模型 = 大脑

你可以把AI模型想象成大脑。它决定了你生成的画面质量、风格、对提示词的理解能力。

AI模型是大脑
图:AI模型负责"想得怎么样",不同模型擅长的画风和真实感不同
2操作平台 = 身体

操作平台想象成身体。它决定了你能用什么功能:节点式工作流、多图参考、氛围参考、图生视频、首尾帧……

操作平台是身体
图:操作平台负责"能做什么动作"
关键结论:同一个AI模型,放在不同平台里,能调用的功能可能完全不同。TapNow的优势就是把多个模型和多种生成方式集成在一个工作流里。
不同平台用同一个AI模型
图:不同平台可能调用同一个AI模型,但功能差异很大
🎨
AI影像生成的5种基本方式
总览

在TapNow里,AI影像生成主要分5种入口。新手只要记住下面这张图,就不会再迷路:

五种生成方式
图:文生图、图生图、文生视频、图生视频、视频生视频
5种方式一句话区分
  • 文生图:只输入文字,直接出图片
  • 图生图:上传一张图,让它按你的文字指令改图
  • 文生视频:只输入文字,直接出视频
  • 图生视频:上传一张图,让图动起来
  • 视频生视频:上传一段视频,重新生成风格化视频(首尾帧也属于这一类)
✍️
文生图:从一句话开始
图片生成
1输入提示词

在输入框里用自然语言描述你想要的画面,例如:

一只猫趴在沙发上

文生图输入
图:在文生图模式下直接输入文字描述
2选择生成数量

点击数量按钮,可以选择一次生成1张、2张或4张。新手建议先生成2张,方便对比挑选。

选择生成数量
图:点击数量按钮选择一次出几张图
小白提示:提示词不用写得太复杂,先写清楚「主体 + 动作 + 场景」就够了。后面进阶再学加风格、光线、镜头。
🔄
图生图:在一张图的基础上改造
图片生成

图生图是小白最常用的功能之一:你上传一张图,然后告诉AI要改哪里,AI会尽量保持其他部分不变。

1上传图片,建立图生图连接

把图片拖到工作区,或者点击添加节点上传图片。当图片节点和图片生成节点之间出现连线时,表示后续生成会参考这张图。

图生图预览窗口
图:左侧是原图,右侧是即将生成的预览窗口
图生图连线
图:两个节点之间的连线代表参考关系
2设置画质和比例

在生成参数里,你可以选择画质(如512P、1K、2K、4K)和画面比例(如16:9、4:3、1:1等)。比例和画质会同时影响消耗积分和生成速度。

选择画质和比例
图:点击参数栏调整画质和比例
3输入修改指令

在输入框里写清楚你想怎么改。例如:

把猫变成狗

输入把猫变成狗
图:输入修改指令后点击生成

生成结果:猫变成了金毛,但沙发、靠垫、书架等场景几乎完全保留。

猫变成狗结果1
图:原图里的猫变成了狗
猫变成狗结果2
图:场景几乎没有变化
4改变时间和光线

图生图还能控制时间。例如你输入:

变成晚上,其他细节保持不变

变成晚上
图:输入"变成晚上,其他细节保持不变"

生成结果:画面从白天自然过渡到晚上,整体光源非常协调。

晚上效果
图:时间从白天变成晚上,光线协调自然
注意:图生图虽然强大,但改得越多、要求越具体,越容易偏离原图。建议一次只改一个明确要素,逐步迭代。
⚖️
AI模型对比:Tap Nano 2 vs Midjourney
选型

不同AI模型擅长的角度不同。下面用同一组提示词对比Tap Nano 2和Midjourney,你会发现它们的适用场景差别很大。

AI模型对比
图:同一组提示词下,不同模型生成的猫
🎨 Midjourney
  • 画面艺术感强,更像摄影作品
  • 美学和氛围把控出色
  • 但可控性弱,比如「把猫变成狗」这类精确替换很难完成
⚡ Tap Nano 2
  • 对提示词跟随更精准
  • 改主体、改时间、保持场景一致性更强
  • 适合做可控的图像改造
Midjourney做不到替换
图:Midjourney尝试"把猫变成狗",结果完全做不到精确替换
Tap Nano 2对比Midjourney
图:同一提示词下,Tap Nano 2(左)和Midjourney(右)的风格差异
怎么选?如果你想要一张好看的氛围图、概念图,可以优先试Midjourney;如果你想要精确控制画面元素、做局部修改,优先用Tap Nano 2。
🌅
氛围参考生图:让AI学一种感觉
图片生成

有时候你不是想让AI照着某张图重画,而是想让AI学习这张图的光线、色调、氛围,然后生成一张新图。这就是「氛围参考生图」。

1上传参考图并选择氛围参考模式

上传一张你喜欢的氛围图,然后在提示词里描述你想要的新内容。例如:

参考这张图的氛围,重新生成一张图:一只猫趴在沙发上

氛围参考生图
图:上传氛围参考图,输入新内容描述
2得到氛围近似的新图

AI会学习参考图的光线、色调、质感,然后生成一张内容不同但氛围很接近的新图。

氛围参考结果
图:生成了一张氛围和参考图很近似的新图片
适用场景:你看到一张电影截图、摄影作品或插画,很喜欢它的色调和光线,想让AI用同样的感觉生成属于你的画面。
🧬
节点式工作流 & 多图参考
进阶图片生成

当你不满足于"一句话出图",想把多个元素组合在一起时,就要用到节点式工作流。

1添加图片节点

点击「添加节点」,选择「图片」。你可以把多张图、多个提示词、多个生成步骤像搭积木一样连起来。

添加图片节点
图:节点菜单里选择"图片"节点
2多图参考连线

把多张参考图都连接到同一个图片生成节点上,AI会同时参考这些图的内容、风格或构图。

节点式工作流
图:节点式工作流可以同时测试多个模型
多图参考生图
图:三张参考图连接到一个生成节点
3用 @ 引用素材

在提示词里输入 @,会弹出已连接的节点列表,选择你要引用的图片即可。这样AI就知道你到底想参考哪张图。

用@引用素材
图:输入@后选择已连接的节点
为什么用节点?简单的生成需求直接一句话就行;复杂需求(多图融合、多模型对比、分步骤修改)才需要节点式工作流。先简单后复杂,不要一上来就搭复杂工作流。
🎬
视频生成:三种入口
视频生成

在TapNow里做视频,基本有三种入口:文生视频、图生视频、视频生视频。选择哪种,取决于你手上有什么素材。

视频生成三种入口
图:文生视频、视频生视频、图生视频三种入口
三种入口怎么选
  • 只有想法:用文生视频,直接写文字描述
  • 有一张图:用图生视频,让图动起来
  • 有一段视频:用视频生视频(含首尾帧),做风格化重绘或延续
📝
文生视频:写一句话出视频
视频生成
1输入视频提示词

切换到文生视频模式,输入你想要的动态画面。例如:

一只猫在一个不寻常的地方睡觉,打了一个哈欠

文生视频输入
图:在文生视频模式下输入文字
2选择生成方式、比例、清晰度、时长、音频

点击底部参数栏,可以看到更多选项:

  • 生成方式:首尾帧 / 全能参考
  • 比例:16:9、4:3、1:1、3:4、9:16、21:9
  • 清晰度:480p / 720p
  • 生成时长:4s ~ 12s
  • 生成音频:开启 / 关闭
视频生成参数
图:文生视频底部的参数面板
3选择视频模型

不同视频模型擅长的风格、清晰度、运动幅度不同。常见选项有:

Seedance 2.0
1080P,4-15秒,画质高
Seedance 2.0 Fast
720P,4-15秒,生成更快
Video 3.1 / Fast / Lite
4K/1080P,4-8秒,不同速度档位
Kling O3 / V3 Pro
4K,3-15秒,运动表现强
视频模型选择
图:下拉选择不同的视频生成模型
小白建议:先选Fast模型试效果,确认画面方向后再用高质量模型出正式版,可以节省积分和时间。
🎞️
图生视频 & 视频生视频
视频生成
1图生视频:让一张图动起来

图生视频的操作逻辑和图生图类似:上传一张图片作为首帧,然后描述你想要的运动。

图生视频示例
图:上传图片后,用图生视频让画面产生动态
关键技巧:首帧图的质量直接决定视频质量。建议先用文生图或图生图得到一张满意的静态图,再让视频模型让它动起来。
2视频生视频 & 首尾帧

如果你已经有一段视频,想让AI重新生成另一种风格,或者想让AI根据首帧和尾帧补全中间过程,就用视频生视频或首尾帧模式。

相关教程:首尾帧的进阶玩法和全能参考的进阶玩法,本站有专门专题: 🎞️ 首尾帧专题 · 🔮 全能参考专题
🎯
小白上手路线图
总结
1先玩文生图

用最简单的提示词,体会AI怎么把文字变成画面。这是建立"提示词感觉"最快的方式。

2再试图生图

找一张你喜欢的图,尝试改主体、改时间、改风格。理解"参考图"和"文字指令"怎么配合。

3对比不同模型

同一组提示词多试几个模型,记住每个模型擅长什么风格,以后就知道该用谁。

4从图生视频入门视频

不要一上来就做复杂视频。先让一张满意的静态图动起来,效果往往最稳。

5复杂需求再用节点工作流

多图融合、多模型对比、分步骤修改,这些才是节点式工作流的价值所在。

最后提醒:AI生成不是魔法,它需要"清晰描述 + 合理预期 + 多次迭代"。第一张图不满意很正常,调整提示词、换模型、改参数再试。