|
|
The following article is from 产品零感 Author 葛零零
# \/ O; F% Y4 e. _/ |关注并将「人人都是产品经理」设为星标
$ C+ [& B2 h4 W% a! Q) [每天早 07 : 45 按时送达
; Y* z6 B) N6 |- y, C
' ]- X) P" F* i- V$ o" d
: @7 u: y( N, a2 l' c- Z x# W* F8 J, [2 t7 }0 R2 w
在过去的几年里,人工智能取得了极快的发展,其中包括基于机器学习和深度学习的「图像生成技术」。运用该技术,只需输入文本语句就可输出具有独特风格和想象力的图像。面对AI绘图这个势不可挡的趋势,设计从业者们,是否做好准备了呢?
& X$ p o6 o# T作者:葛晓玲
7 P) S8 Z% x `6 o9 Z来源微信公众号:产品零感(feelingPM)
0 [' k- I, v' |+ R0 w+ s题图来自Unsplash,基于CC0协议8 }% f' E* Q. T8 J" `) G2 C: u
全文共8156 字,阅读需要 17 分钟; r9 v p% `/ ^& @( M. _6 e
—————— / BEGIN / —————
( z) z! R, C& k/ N# y& l4 A在过去的几年里,人工智能(AI)取得了极快的发展。
! S& u2 |& u9 a1 p# z/ U0 aChatGPT和GPT-4对话上的智能程度在不断刷新常人的认知,给大众带来了惊人的体验与惊叹。6 M0 J9 {3 r$ J* c
同期发展的AI技术,还有基于机器学习和深度学习的「图像生成技术」。
* t9 l2 Z4 y- z+ I该技术能够让计算机在一定程度上模拟人类进行绘画,用户只需输入文本语句(prompt提示)就可输出具有独特风格和想象力的图像。7 k, |( W8 K+ l) X$ l4 V( R
文本->图像,AI绘画,指的就是这个过程。
) Y* k/ O1 X0 k随着大众对于AI绘画关注度的升温,相关的争议不断,有人开始提出「AI取代画师」的观点。
$ U3 q: S! \) p' G& X! j& @& f3 ]8 O7 Q面对AI绘画这个势不可挡的趋势,设计从业者们,是否做好了准备?3 j) L9 a; n& g0 b
1 L* V! b7 t, n& N
AI绘画,高效无情的出图机器
+ _2 }. W$ \1 s8 s! k2022年8月,在美国科罗拉多州艺术博览会上一幅名为《太空歌剧院》的画作在数字艺术类别比赛中获得了第一。
1 p1 T, b2 }, M( F% @1 r
% \0 r. ~6 ^$ B+ @5 d1 c- X& U9 Q4 ^: W# A# W5 s
0 p- u2 n8 ]- C0 R由AI绘制的《太空歌剧院》
3 I+ D% H# c# z人们也很快得知,这个画作并非真人绘制,而是由游戏设计师使用一个叫Midjourney的AI工具生成而来。+ }: T9 L" t& p8 a- A
随着这则新闻的传播,AI绘画也开始进入更多人的视野。+ S9 Y. ?- a# ~! b; Z
1. 国外知名的AI绘画工具1 j7 D- A* V; ~
下面先介绍几个国外具有代表性的AI绘画工具:2 j( l9 X$ m6 d- b
1)DALL·E2
! k0 J$ P" y) ^3 QDALL·E2 是一个由 OpenAI 公司开发的模型,也是一个在线服务。它通过输入一个文本描述(prompt提示)生成多个精准匹配文本的图像。2 I3 n/ l" o% T6 P2 w' k/ e
6 b2 a$ H- J# J$ Y# D! s3 W/ V9 Y& r/ }4 D
7 f' m* `# X4 F6 ZDALL·E2 结合"CLIP 预训练模型"和"Diffusion扩散模型"来实现了文本->图像(text-to-image)的生成。
! L }( s2 T8 r C扩散模型运行时的成像过程,就是一个"Diffusion 扩散"的过程——
5 t9 j* t" J5 }3 u从有噪声开始->逐渐改善图像->直到完全没有噪声->图像越来越接近所提供的文本描述。
# h1 Q1 ]6 l& h/ n0 A6 J3 cDALL·E2 还有一个的特别的功能是"AI编辑",可以在生成的图片上涂抹某些部分再让 AI 直接修改。. c" y+ Z( l4 y1 j3 @- x
; P8 G! L4 r: L4 R& K3 _( n2 q# D q6 j% S- T2 X. o: [
- ^, |$ }2 \6 W$ R
DALL·E2 只使用了已获授权的图片集来进行训练。
& ~* g; a$ n0 q, l+ M r. F; a2)Stable Diffusion
) w. x% q/ J ^$ t9 w& P( @# F
& u& `" [6 u) W$ Y# t b. U/ u, ~1 x. P, K) ?
4 C" Y+ ~1 V- Q' lStable Diffusion 模型,前身是谷歌开源的 Disco Diffusion 模型。
4 g' R$ {- n! g5 S/ C) ~# q7 H3 UStable Diffusion 模型也结合了CLIP技术(OpenAI发布的技术)和Diffusion扩散模型,同样是通过输入文本(prompt提示)来生成图像。
- ~( s5 V4 n' c$ x$ G1 D& L4 e5 ]" y比较特别的是, Stable Diffusion 是一个开源的模型,很多开发者基于这个开源模型开发训练出了更多不同的生成模型。
+ N( G Q" N5 i/ sStable Diffusion 的母公司Stability AI 在2022年10月宣布获得1.01亿美元融资,投后估值达10亿美元。
% o7 @) V4 P! u! t) X# R3)Midjourney9 V* j1 Q I; I; X' y9 |
Midjourney由同名实验室开发,和大部分市面上的AI绘画应用采用的是同一个模型,但是模型使用了大量图像数据来训练。/ D" m+ K' O0 P- c9 l; {1 H
Midjourney在生成图片的一致性和连贯性上做了很多努力,它生成的图像风格十分独特。+ w: g9 C q. t- E/ a3 P9 p" U
Midjourney几乎所有的生成和交互都发生在Discord社区里,使用其Discord机器人来接收请求和发送生成结果。
6 T9 d% }3 \. |& B5 D7 c; E6 n. D) d
7 q: V) |6 \7 N" Y6 N9 U8 m- e
' j5 {2 ~2 c+ [# D: J% g
3种绘画工具的对比:我们进行测试,对于同样一句文本(其他参数默认的情况下),这3种绘图工具的图片生成效果。
' n/ |" A/ |' |0 o4 N% @8 _输入文本:3 a. [$ m# }- w/ C( |
An old man rowing a boat on a lake.
) e( Z' a. J! U( TAI生成的图片:
" {% d% S. n/ s/ k' j# I- T+ @; M# u. ]" @
: [1 D6 H! ]- M9 n
7 h# _6 L6 h' \, R% K& j收费标准:
0 a4 K$ J/ @1 ^1 t3 _0 h+ g: _
1 J' R4 x0 e& [: Y
( q, o4 g' N" b2 \' `' ~ O9 \1 J- A- m4 P& ?
3种绘画工具的体验地址:% B% d8 m# K( h
①Stable Diffusion. V1 G5 s- G. C9 p0 y: b9 A, J/ M
Dream Studio:https://beta.dreamstudio.ai/dream; f! D5 D3 z: v9 p7 F2 _" i, [- D! ~
Hugging Face(免费): https://huggingface.co/spaces/stabilityai/stable-diffusion
! z7 d" S. k' K+ s3 h% @' ~1 F, ]6 b②DALL·E2
. }- x! n0 s% E; M1 x' Q3 `https://openai.com/dall-e-2/
# ~3 p( w2 ]; j8 L' z; L% w3 |5 Q5 `CLIP:https://openai.com/blog/clip/
. u% }- {' C+ i5 b* A: }% _③Midjourney
9 j4 R3 ~; |1 o0 k3 C% I. ?- Chttps://www.midjourney.com/home/
, c; O! m% {& U) z(注:某些服务只对部分国家开放)
$ _# ^, m/ p% K0 F8 _; ] \Midjourney的效果更具艺术感:
, e# D9 X5 ^$ a$ R2 _' a对比生成效果可以明显看出,Midjourney生成的图像不太像照片,似乎更像一幅艺术画作。; n- S1 Y) I" s5 y' u0 L
在Discord社区里运作的Midjourney社区 ,因为其具有艺术感且画面注重细节的生成效果,收获了全球近千万用户,在线用户也是百万等级。! y V) Z2 |* P- h& w
7 g9 q1 F" c$ \0 C0 \0 H2 `
& p% T2 {' t( g5 O6 w' y5 L
$ ?+ l* s' n2 ~$ U
. K5 P% Q |: J9 i
% W; V- D3 U9 M- M5 Y" [: y- G- i( i: ^在社区频道里,用户仅仅需要使用/唤起命令行操作,在/imagine命令下输入prompt文本发送即可。
5 O% _' C! v* G* A% a8 ?以下是输入简单文本后,Midjourney生成的图像:7 n: E8 q8 w! \- H5 ?/ K0 y% N
/ j# ^8 D4 H% N% @
/ D# q4 N q2 q8 [& s+ z7 ~& ?* [! C" C, h4 L
效果如此惊艳的生成图片,只需几十秒内就能得到。
! @ D/ V n& F% [2. 国内的AI绘画产品 y* M4 D' W8 K" N
国内也相继出现了类似的AI绘画产品,几乎都有免费尝试的额度,通常支持多种风格/艺术家/模型。
. x4 D6 m2 I# p' J: E( X以下是国内提供AI绘画服务的一些产品:
4 v8 k( Q# I3 Y0 f9 H
" x. A' {) Y; l
) q) g9 H1 m% n& q. w& a
9 c7 M( B8 D8 `9 g( y6 L1 o; N3 Z. V8 N# @
- O) x$ b( g4 o E0 t随着技术的逐渐普及和越来越高的热度,AIGC似乎就不再是大众试水画图画着玩儿的一个小工具。2 {1 q g, a7 d3 C& J
这个"高效无情的出图机器",似乎已经开始在影响和撬动设计行业的变革。
1 T2 | n6 m/ n( U. m2 q6 T: p8 L8 U, t. Z; r- ]; z
设计行业 X AIGC2 R3 J, n1 G K3 n2 e' _
1. 游戏制作× AIGC
+ f' B. H, c6 i# o# U* X- m; j u很多游戏项目,开始利用AIGC生产游戏相关素材。4 h" l9 f9 K' N% R- S
1)国外游戏工作室 Lost Lore《Bearverse》游戏
7 G, m: t1 V5 _1 F) ]国外游戏工作室 Lost Lore 出品的主打 NFT 集换概念的F2P游戏《Bearverse》包含了大量的角色设计。
, M( y# b# W3 | J# S4 Z8 Z% O7 g游戏工作室直言:采用AI画图节省了80%美术成本!
5 Y2 E V" s! I* G" w①17名角色的调整:
; o' i' U( O' M! E$ d( u开发成本:从5万美元压缩至1万美元;
4 t4 M2 N1 d5 I, N) n+ `3 s工时耗费:从6个月大幅减少至1个月。7 q/ h+ i5 S3 P6 k/ n, P% R
$ p' ^8 y! o7 b9 S& F; c) B
" v% \; ?$ _% T. p* \, r
$ p1 C4 [! A0 o# h. ]3 z②创作一张场景概念图:$ O2 ~& A4 ] D7 J- [! }8 D
工时耗费:从1-2周压缩至1天以内。
, I8 ^3 Z; c1 o8 v7 ~- k: P
8 [7 H' U# m# @/ |8 L7 t" H
7 w5 o2 e; m! Z' ~7 j& a# d: E
) }0 y6 t9 B6 b. G设计总监最后也坦言:
, i. Q5 F6 |' e0 w( s0 D95%的效果和概念图呈现仍是由团队真人创作。
# q3 D, h% \3 G2 |* t( U, ?2. 商业设计 ×AIGC
4 U) }# ~! k, Q3 H大厂团队已经不甘观望,开始了AIGC在商业设计工作流中的实践。8 i3 ^4 o$ A* Y a4 ]* z5 I
1)腾讯-ISUX团队: R' G9 y4 R, w" i8 d
腾讯的ISUX团队2023年3月1日刚刚发表其官网的文章《运用AIGC人工智能生产内容》。6 W: Q3 @4 ] e' x, J
$ L- K7 D/ E8 V1 V6 i1 U8 O, z) v! z
' U- N7 i" Z" [# p9 p, k+ n3 C' W' h' d0 }: R! x& c
https://isux.tencent.com/articles/aigc-design.html# m) W* a! u: e! R. h8 b
文中提到了腾讯的ISUX团队运用AIGC进行商业设计的好几个案例,并进行了结合使用AIGC后设计团队的全新工作流的方法总结。
# v5 z9 C) F6 R) s
/ g7 y2 F1 ]7 A
* f8 S' H) U, E3 l' i# o$ t. I9 b# C7 Z
. v% W7 K7 C. i+ w2 }/ a
9 M' t0 D" } q, t Y/ [0 ~0 S2 D: \8 m* Y+ l* h* f
; \ F& Z1 r6 ~3 g8 S* ~2)百度-AIGC营销赋能业务) x# F9 C. X' N. T
百度也在试图利用AIGC满足商业设计上的需求。
) B' Z" h' W( ]6 X3 i百度发布了AIGC方向的产品负责人岗位,负责比如"商业广告平台部的内容生产相关工具的规划和落地"。& ?7 w& M( U6 m8 w! o' c
+ W4 m5 B) C; e& B9 i$ K ]; P
) |' z- v9 |5 [0 i) P) ^
0 ]) d% f4 i: J* j+ k( K+ h+ ]6 S4 X
3. 个人头像设计× AIGC
$ t" J1 \, M5 _8 A& ~0 ~0 ?" q1)国外的AI美图软件Lensa「魔法头像」功能1 O* I* o: t0 b- R& \ F$ l* V, ?
「魔法头像」是Lensa基于Stable Diffusion技术开发的头像生成功能,用户上传10-20张自拍照,能生成50~200张不同风格的AI自画像/头像。
# I8 C2 z Z8 [% S% O' y( f8 Z3 n/ k# b: r( A! Z
0 \, {0 t U/ o3 \% Z7 i6 F7 }
; B% u) L! [7 Q& b F8 h! C6 g/ i! s- m3 E" O
: w3 m* M' X2 m9 c$ ]& t/ y& U
" e: c4 {$ O+ e& i- @" P- D
9 J5 n2 W. `. Y; H生成50/100/200张的价格分别是:3.99/5.99/7.99 美元。$ }7 q+ H; g- S! q' u7 Q2 r: p$ m
2)美图秀秀「百变 AI 头像 」功能& [5 w4 Q4 p$ W, z
同样是美图软件的国内团队——美图秀秀,也随机发布了相似的功能。' X9 E; b. ^* ] y' a6 ~
从产品定位来看,也是输入真人头像就能批量地获得多种风格的头像。
- \' t0 n" e( D
4 `- V- c0 o- {/ ?8 R9 u7 h0 p z& j T# }9 i6 F7 [6 `
1 K0 X0 J1 M# B和国外的AI美图软件Lensa相比,美图秀秀对于用户的输入门槛要求更低一些,只需要提供3张正脸无遮挡自拍照即可。" R+ H5 b* ?8 t. x5 |* A$ @# I- C
3)抖音「AI绘画」特效
- G2 z, R+ \& Y3 U2 O继2021年的「漫画脸」特效(基于GAN技术)后,2022年抖音又上线了特效玩法「AI绘画」(基于Stable Diffusion技术)。
/ w! C3 K+ \* Z5 d2 L用户只要输入一张图片,AI就会根据图片生成一张动漫风格的图片。
" L- o6 h% C1 |; O
2 Z+ |! b) l. L9 O' s( i+ F' e# y. o- y; b4 n( X6 X/ ]. m' W" u2 R
( w5 P8 K# h" c
抖音「AI绘画」功能的的峰值QPS(每秒请求量)一度达到1.4w。
Y1 I3 L6 U; r$ G9 l) l" B4)QQ小世界AI画匠
& f4 F. w, }, Y: f: k4 q$ p腾讯QQ上线了"QQ小世界AI画匠"活动,主题为"异次元的我"。
1 _% l& i: f A& ~$ d% Q/ D5 h; e/ x用户上传1张个人照片,即可一键生成专属异次元形象。
% C* Z1 C. N6 F9 S5 O7 r1 L
: H3 R7 a) o, ~ g' w" T
2 k3 y% y$ y# K z7 c
+ l& K; W& q* H3 q1 D5 G# h4. 动画背景× AIGC
* W: N* ^1 `" S1)国产志怪类动画《神弦曲:猫儿与时光铃铛》- `2 b2 f. @! a5 T$ F! K$ O
由十九号动漫出品的国产志怪类动画《神弦曲:猫儿与时光铃铛》将于明年上映。官方在2022年12月发布了预告片。* Y4 {3 S P5 H1 s# V$ w
主创团队称,预告片三分之二的背景都是结合AI制作完成的。
$ U8 Z) b7 h8 N" {/ T/ c0 s制作预告片中的30多个背景,工时耗费从3个月降到2个月,效率上提升了至少30%。
. d8 W5 @+ v% f6 F! }9 c# u E/ ^6 D1 c8 k7 f
4 ~6 V& n& {, N; {) @
2 q- x8 |: l6 ]3 Y# p+ I9 b6 h主创在采访中提到:"有了这样的一个技术,把我们的预算从一个标准动画电影预算直接减半,我们就快速地获得了一些投资机会。"& _' |- g, L6 j% x
5. 视频制作× AIGC
0 t/ E3 l: _/ p; N1 p- C' G8 Q除了绘画领域外,AIGC也在动态的视频生成上有了很多突破。* O# U1 Q6 X2 a g+ w1 I/ U0 A
1)Runway 新功能:视频转风格生成器 GEN 1
+ X, b! X5 S1 F8 ?& ^8 t& u( n3 D* ^% tRunway AI 是一家图片和视频AI编辑软件提供商,为设计师、艺术家和开发人员提供一系列工具的平台,帮助他们利用人工智能技术创建作品。
8 |& c4 X) l8 p: b/ T0 D$ X0 ERunway 平台推出了新功能 —— 把视频转换成任意风格的生成器 GEN 1。; m0 X% s- m2 W
GEN 1 这个能力和图生图功能(image-to-image)类似,只是变成了从视频到视频(video-to-video)的生成。
; }5 p0 \- ^5 ~
* e& a7 f9 L8 x& A- p
$ J Q/ H K+ I! n1 d3 z- `* ~+ f% J& ]1 R. |, g3 L
https://research.runwayml.com/gen1
+ i5 O, F* l0 @& k0 L; V2 a看起来, GEN 1 是一个支持用户可订制化的视频滤镜的能力。
. W8 X' u/ g/ o5 l! h( X而定制化的方式极为简单,只需一张具有风格的图片。
% {, _' q- W K$ K2)Wonder Studio:一键替换真人为CG角色9 w5 T* _+ ~3 ^: _; A7 Y/ c$ e
这款由一家人工智能初创公司Wonder Dynamics推出的AI工具Wonder Studio,声称可以实现「一键把视频中的真人替换为CG角色」,简化电影制作流程。" q' c) r* w" {; E( w
* L/ \$ ^/ [& E! s
# V1 v# t! m8 N, S: Z1 Y0 M
* k# y7 Z9 o) L) ^3 M3 {5 U7 W
4 {! C. p2 T' E' c9 z) B' M4 ]5 w3 d2 P/ k" I) G# U( b
https://wonderdynamics.com/
" c/ k& Z9 [6 d9 c I) R整个工具的使用流程大概是:
5 S3 Q" O" q) X$ p真人先替代CG机器人进行表演* g+ m) n( v) T1 L9 Z* P/ O
视频拍摄完成,导入进软件
1 s" \# _0 \% e! j* z1 o2 q选择想要的CG角色,安装在实拍的真人身上: x9 L. Z' }4 l2 o3 r* G5 }. _- F( F" {
目前官方网站上开放了内测申请。 v( t8 Z. X6 }) W
( I7 d C/ Q- }% E% y* G" SAI绘画的争议
; _3 ^& @! h- t. Z2 Q- R) Z% u2 J在设计行业中,很多人的对于AI绘画的态度,都是不怎么正面的,主要集中在几点:
: q" [" p& J2 ~; R% X从业者的担忧
1 @- o3 U( I7 j版权( ~. [; K2 O4 t' I$ c& p- ^
学习信心的打击" {& r# o m% G. x+ U' E2 ~
争议1:从业者的担忧
; O( x1 y/ m$ N在AIGC生成绘画能力效率和质量皆可的前提下,中底层画师好像确实慢慢就不需要那么多了……! [0 z$ s' i4 g- l0 l7 p
论出图速度:人赶不上机器的出图速度;
* q4 E& c7 {6 l3 `: E1 |5 P6 q! ?6 ]论出图创意:AI 可以生成出关键元素外的细节,似乎更为惊喜;
+ o2 b) R! L# R7 w论风格效果:AI 能训练出不同的绘画模型,对应不同画风; ~7 v7 }5 ]$ ^/ Y+ V
输入相同的一段prompt文本后,不同的模型可以生成出不同风格的图片,且速度极快,通常是几秒~20秒内不等:2 R% g: l$ _. G) f1 B0 q- @
7 t! q: s# P7 o( K9 X& n8 J
一个戴着黑框眼镜的美女,抱着一只小兔子
/ o2 d' q2 G& t3 HA beautiful girl in black-rimmed glasses, holding a bunny in her arms
* r& k. x/ f5 R# F) v' v6 S0 m8 O | Midjourney 模型- w/ \: P1 b! _! u3 L
画面注重细节
, a& |. w, s" S' n |
4 ?, Z& ]6 H( c) J! K7 r; L3 C) s ^; E. M. c K
) Y' o4 I; |! C% L' \6 Z3 ]
7 Y* W8 f/ h( M; U2 W: _ | Niji 模型) V6 z6 m4 ]5 R
Midjourney 模型的二次元版
! U4 I8 m" Y4 _! c. {! ^% d | 1 }7 w' D# b' P8 V7 f
8 X3 F% x2 W' Y# W0 u
" Z( b2 j- B4 n8 a6 k9 H, v* Q }( {
/ l% K# x: d6 T }. v& _ | Novel AI 模型
2 L) f- a& A* X8 `! Q4 p( u x; k更偏日漫的二次元风格' `2 V+ ~; l) n. n8 {8 k2 _$ L
|
1 M2 t" L6 [+ {0 ~- W0 |3 O9 V: ]; f# K1 e; x u$ F
0 g+ D: W: Y4 @4 s% d
+ X) z% j6 K' }' w$ R | LoRA 模型9 H# t$ y: V: L
真人写实照片风格$ p1 l5 S, i# i4 w0 j/ a, a$ K& ~0 c
| 2 H; \1 D) g, X: y; x% e ]- o
# _! [1 J' \! h2 G7 d. m I
0 w' B( ], y6 f' Z; i% f
7 m' H h& b' [0 C9 W. q
| % r+ _, d& ?5 }5 f3 D$ ?" I' k
除了想要的关键元素外,生成图片中还包含更多精彩的细节描绘。4 u) R% r3 C2 U! D: F X. q
结合AI批量生成的能力,很多绘画需求,似乎只靠AI就都被高效地满足了。& U) l7 C) f2 ~. |: t; j/ s
随着AI作画的部署成本逐渐降低,一些中小企业和初创团队,也开始有能力在通用大模型的基础上进行模型的调教、设计师岗位的精减。* i4 W1 J8 ?3 R. G9 O" \8 b2 `
令从业者最担心的事情就是:- M" V# b* J$ H4 q9 o9 b
当AI绘画工具具备了一定绘画能力,也就同时具备了"抢人类设计师饭碗"的能力。. {5 X" p6 l9 `. e% P
争议2:版权
8 N( |5 {2 K& A0 b3 q- k3 }我们在AI绘画出的作品中能看到很多有明显风格的影子。
( F) T4 S2 \6 y也可以直白地说,一些AI绘画模型的训练数据中,有着很多未经明确授权的画师作品。9 e1 T& [ R; L7 H2 H5 `9 _
AI绘画侵犯了画师的版权,也开始遭到画师们的集体抵制。
# s/ \+ Z1 ^, m1 G* Q1 } D2022年8月29日,一个名叫mimic的AI绘画网站上线了测试版,主攻日系二次元画风头像,允许用户上传15-200张图像让AI学习并输出相同画风的AI画作。没想到刚发布便遭到大量日本画师的抵制,画师们集体发表了"禁止将我的作品用于AI作画"的声明。有的画师为了防范于未然,甚至删除了发在推特上的画作,怕有心之人盗用上传至平台使用。
7 q. a9 C9 H* `7 i; K8 N8 \2 o* M8 j$ b* @/ m. E7 M: R9 T
5 Q0 C: [7 Y- T6 i. `0 H5 C5 t! o; W9 C. ^
2022年12月,全球知名CG视觉艺术网站 Art Station也被上千名画师发起了联合抵制,画师们认为,任由系统学习模仿自己的画作是在侵犯版权。网站画师纷纷上传一张名为"NO TO AI GENERATED IMAGES(拒绝AI绘画)"的图片表明态度,首页一度被此图片占领。! H& t9 [" x; F9 w% `" h( R: V
; A& G. u' L( P7 T2 k1 d/ D
3 x; f( ^! l J! Z8 J$ d; e
( Y! k: j. S3 E( N0 p& k. _0 s* i对于画师们来说:
) q) B& g: U% Y: o7 g自己的画风,是独属于自己的独特标志和可贵财产。如果让AI简单地模仿自己画风来作画,那无疑是对独有艺术的糟蹋。; f! j/ D, S9 }" R* R4 A. U
即便有的画师愿意提供自己的绘画作为模型的训练数据,但似乎他/她们也没有收到任何版权上的收益。) d. B. k+ a, p2 t9 W+ z
AIGC产出的画作的版权归属于谁,成了关注和争议的话题。
- }4 ?4 t- m7 G$ H4 P6 q* d8 d: U
6 s# _& P _! t/ Q5 P
2 X& B: L2 p+ d
M4 N: n( U# q; a8 J& y7 v争议3:打击小白学绘画的信心: q$ `3 C+ y4 @3 H# i' G- P% e
AI 绘画的强势碾压的能力,似乎也打击到了不少绘画小白从零开始学绘画的信心。9 }% ? J* |9 m& M& f! K7 {) P
有的人会感叹:
% b! O# S3 [& S: n2 m既然AI几天就能学到做到那么好的效果了,自己再花费数年去学习,还有没有必要…! e) q: y2 z9 v, q" n0 w
4 O: I: I9 Q# ?! ?
: \$ Y3 o% K& u) r5 U' I
5 [- z7 ?1 i. ]9 Q; O: O
. k k, C# x8 i9 W! Y+ ~: k/ D6 p- J% q1 Z! t+ O9 z) y) m
) D5 \! {: \2 f: T9 A2 u! R/ h
AI 绘画的短板- q6 N) D5 v, U' y' ?! {4 [5 h
AI绘画当然不是全能的,也永远不会是。至今的AI绘画也还存在着众多短板。
& h5 t8 z! a: I" U/ K短板1:AI 无法准确还原想象中的创意
; G# D4 `1 N% d3 u$ j5 G3 kAI绘画的确具有非常强大的创造力和想象力。但这样的创造力和想象力,其实是一种「快速随机」的结果。' c3 x4 @0 c% ~4 @3 T: [9 j
效果既受限于算法、数据的质量和数量,也受限于用户对于prompt的运用。
7 {) y' l1 D# s4 d人类的创造力和想象力仍然具有独特的价值,想要AI生成还原出来十分贴合人脑想象中的创意,是很有难度的。
3 a, n3 _$ T& h8 K. Y( q不少尝试了MidJourney进行AI绘画的人表示:
# z( M5 J9 Y; o. ?6 FAI生成的图片效果确实是不错,但都并不是我脑海中想象的那个样子。
- z: [+ V+ _0 m( t" P甚至,AI会理解失误,生成"离谱图片":
- Q( \; ~" ~; l% \. }+ x- a% @输入的文本是:一个小女孩,一手拿着冰淇淋,一手牵着气球,走在公园里。
# `0 l3 r& |% G& L. SAI生成出的却是——"冰淇淋气球"。2 \$ |' Y/ q* ^' N, W. X C
短板2:AI 绘图还不足够满足个性化需求2 N4 H/ |: q2 b3 J' l7 |$ k
AI 绘图是很强,但是还不足以满足个性化需求。比如:0 {* L, R6 l) w; y$ {( x5 E
针对不同场景类型进行统一且又独具个性的设计;' ]9 l" k j3 Q& f' A9 b) c2 c. i
稳定一个主体使之在每一次生成结果中都保持成套效果;, f7 w! g; g% N; r2 b1 h
7 h" n. W) _) m0 V. F+ N# d/ R
( Z. I0 [) N: p" C8 h* {
1 {8 l) N/ A4 G* w5 C* [+ {以上能力的欠缺,使得AI无法高效地完成"成系列的商业设计"。
0 O) \7 m4 A9 y* v. b, Q) A* k
9 e, X2 d* w V8 Q0 ]: [AI绘画的未来4 ^0 u( ~% w# D! J
尽管很多设计从业者对于AI绘画表示焦虑,但作者判断:未来很长一段时间内,大部分行业可能只会把AI绘画当成一个「辅助工具」来用。& M u# B! R# u5 Y% r
前期,大家在拼AI的效率;后期,则是拼人工优化AI的能力。
! J u- ]/ t/ h- ~人工优化AI能力,可以从以下3个方向出发。* j& t8 M/ I; d+ n: J u
优化AI方向1:AI 模型的定制" `, P5 m( r3 a9 i6 M# O
想要模型更稳定地产出特定风格的绘画图片,可以定制出一个AI模型。
; |! D" e6 G" ], x6 P% w但AI模型的定制的门槛比较高,通常至少需要一个设计师搭配一个算法工程师来实现,而涉及到模型训练的过程,则需要工程部署能力、硬件显卡的支持。5 w4 {9 v h; Q
模型训练出的效果也取决于多个因素,比如:训练素材、模型选型、参数设置、训练方法等。
( M: Y3 p+ J( P- ?0 G2 z9 e7 K" A+ i
+ |1 @. o7 t! i/ v
2 U* d$ h9 t, {4 g. I优化AI方向2:会用 prompt "咒语"& b' R0 q* J/ G# u" H5 e
我们可以把"prompt"理解为"送给AI模型的文本指令"。
7 G1 V6 m8 M9 q2 d9 [! q& u5 i$ G' r输入高质量有效的prompt,可以大幅度提升AI绘图的稳定度,让成图更加接近我们的描述。
* B" p: y& n, Fprompt输入的格式通常可以是以下内容的一个组合:
- }+ i- K% t- y! B" Wprompt文本输入=[形容词+主语 / 主语+状语],[背景],[画面类型],[风格/艺术家],[灯光/色调],[视角/修饰词],[细节],[画面质量]( O; S0 \ Y8 \& s4 Q$ p
因为这一体验过于神奇,很多人不禁将prompt形容为"咒语"。
3 u% v# H s+ w0 x" ]. _& D在市场上,还出现了买卖prompt词的平台:一家初创公司PromptBase,允许用户在该平台买卖提示词(Prompt),售价约为1.99美元~9.99美元不等。PromptBase将向卖家抽成20%。- W* C3 f* ?1 m. ^/ R# y3 P+ |& v9 |
平台上目前已上架不少提示词,适合不同模型、不同种类。) t: O2 q2 _& q
而在学术上,也有所谓"prompt engineering" 即" prompt 工程"的说法。
9 s! K( @3 E% ~2 w* r提示工程(prompt engineering):如何同人工智能交流,并得到你要的结果。
1 j/ R( n1 M. ?3 [& t0 a5 l' S: t) O9 B
7 i( O. K' q3 z t
: k3 V4 | }3 m- [, t9 b5 b* dhttps://learnprompting.org/docs/intro" A0 T y+ r& w; g5 h" o* k
优化AI方向3:灵活组合模型,优化工作流
1 O8 L2 A0 y8 ]因为AI绘画工具的介入,现有设计的工作流程将随之而改变,整合诞生了全新的工作流:
3 x3 Z* A3 x- S1 kAI绘画先进行生成-> 再从AI生成的十几张结果中挑选用作局部素材->再利用PS或其他工具精修处理5 H" {7 K: j4 Q* }# K$ h( J' ?& J
# l/ R4 T# w( _
) I- p5 M0 h1 v1 P: b a2 Z+ Z/ T+ _) t0 k7 j$ v$ O4 R
随着AI绘画相关的新技术不断出现,其AI绘画的工作流也需要随着新的技术来优化,进化为更适合的工作流。
# |; b2 R0 f1 E' e) x, R! ~比如,当发现了「根据图片提取prompt」的新技术后,可结合这个新技术优化设计工作流。$ k7 k5 h& j9 B ^, u
结合了「提取prompt」的设计工作流,也许就变成了这样:
0 t7 w6 T! m0 y2 ^; c
9 m* p7 {' x, V& |# a% q. `, r1 f5 w! d/ m* ?
P1 u' V6 J' k9 ^
再比如,当发现了出现「ControlNet插件」的新技术后,可结合这个新技术再次优化设计工作流。
# r* y% e2 a! eControlNet插件:可以完成对人物骨骼走势、形态、动作、姿势的精确控制。
8 v$ r5 k9 e6 ]' D/ B, ^0 F) o3 y% o: y; S6 y Q
9 a( C K. s/ O0 c6 ~5 r9 ~7 L" D" D; m0 c
结合了「ControlNet插件」OpenPose模块的设计工作流,也许就变成了这样:; p K' e- N* L9 L+ p
' F/ M6 R0 [9 R0 d B9 v' R
( ^# u1 h0 c# E* R3 F9 z: a f, J4 S: Z1 L: @) D4 L
以上提到的"人工优化AI能力",第1点"AI模型定制"门槛较高,需要一定技术和硬件。
9 Y$ G+ e1 a" t6 n. T' k1 X但"prompt实践"、"设计流程优化",都是现今设计从业者可以探索和实践的方式。
. r- E& M3 ?( W3 L4 P1 L; e$ ^) O( m( T2 X
画师的命运
$ x* T l- p0 T6 A# K等着被取代,还是转型?
! z, U! M1 i& ^7 w% R: q0 N我们经常看到一些新的AI技术应用的效果出现后,很多人立马开始感叹:AI抢饭碗了、AI取代设计师、失业倒计时+1……
2 t/ B$ f( A6 R) V! h5 UAI绘画的能力不容忽视,但它也不是万能的。
; x7 Z, Z% L: J6 FAI解决了生成效率,能在一定流程上减少一部分工作量。但又因为AI绘画引入了新的工作流,同时会创造新的工作量。
3 [5 Y% y% Z" b& B5 T, G相应地,一些新的就业岗位也会增加,比如现在就有俗称为"AI调教师"的一种存在。/ J8 C2 ?; Y3 k# }6 ^) ]9 `) A
在某些绘画领域中,也已经有了"AI插图绘制师"、"AI绘图师"的人力需求:
/ n0 _+ @6 E$ I6 V& s
+ ~4 n1 k# O) j' E( p) q+ w
' ], i E+ O1 {& d K+ B0 P1 S& }! o2 u. ?) q
" }3 H$ D t3 f; L9 f' ]/ ^- c: }2 G5 d% B. Z
以下,也许是"AI绘图师"可以贡献的能力:, q s' o' C" p( h# R0 X, m; s! N
绘制优质的训练素材供模型学习# r. Z ^- C# z" k# d. E
高效地使用prompt,测试出稳定的生成效果
# r0 M( h" G) a2 _3 A0 J, l- {# I, R将"生成结果的质量好坏"准确地反馈给算法(人类反馈强化学习RLHF); |( l" R8 v$ g+ H
结合AI技术,优化设计工作流
" _2 O7 r# ?( y" p) D6 o4 TAIGC势不可挡,那些率先学习如何用AI进行美术工作的人,将会发现自己处于行业的顶端。- d( w+ n, O5 F8 Z3 i& S6 o
毕竟,差异化竞争的关键,就是让自己掌握"差异化的优势"。
% j: H& Y4 g$ t1 t
) x9 }/ r8 }3 C' e7 b$ |$ O0 m5 q! ?) X/ S
. F `: m4 \2 U( B" _- H, H7 e2 ~6 D截图源自Aisocia.com平台的AI对话
8 c+ ~+ D. k8 d( P* A s结语
: }7 x% A0 a' I; r8 u h7 |借用一段"腾讯ISUX团队"文章中的结语:
9 n% h6 s7 C6 B Q# l" {% U随着AI模型能力的飞速迭代升级,现有的短板能力也会不断补齐,因此我们可以相信在不远的将来,设计师利用AI模型来开脑洞并辅助出图是趋势所向,但并不是说我们需要完全依赖AI,因为设计本身是理性而浪漫的工作,仅靠随机性做设计是完全不可取且不靠谱的。更合适的思路应该是,设计师首先定义好规则与框架,从AI模型提供的成百上千个结果中寻找到最匹配我们诉求的结果,从而辅助我们更快更好的达成目标。: s* r0 l' m* C2 z# J
另外面对日新月异的的智能工具,我们应该保持终生学习的心态,做好时刻接受新事物的挑战,才能在越来越激烈的竞争中立于不败之地。8 ]1 U* o q! M$ U
——《运用AIGC人工智能生产内容》
6 T0 O, s/ R) a$ AAI绘画,还仅仅是AI技术应用的其中一环。8 N* F" w; j0 H
未来,AI将涉足3D模型生成、AI视频创作、AI作曲等领域。
3 E) {' O2 C, N5 {更多AI能力也会发展,就像现在的AI绘画一样,影响和撬动相关行业的变革。
: V2 ^- Z* X& Y/ s% S: ]AI绘画会取代所有画师吗?不可能。
( }; x/ P: K$ Z" k& _& i3 O& Z7 zAI绘画会逐渐取代中底层画师吗?不无可能。0 G/ c9 ?* H' m' K; [% ]! o( @
留给从业者的忠告,还是那句话:保持终生学习的心态,做好时刻接受新事物的挑战。3 |7 {8 m" |: F( o* {/ s
最后,送给所有打工人的心声:
0 g* k/ A: Q Y- q5 _! K& e* p5 L+ X* b$ e; ?" X" g6 G) ?5 x
6 ?& m6 z9 z9 S% H- y9 B8 P
' w1 j/ u2 X+ |1 @& U' h参考文章:. \3 f$ a, |' {4 q/ Q
https://www.marktechpost.com/2022/11/14/how-do-dall%C2%B7e-2-stable-diffusion-and-midjourney-work/ How Do DALL·E 2, Stable Diffusion, and Midjourney Work?
" }2 \* r; t M8 l! ahttps://www.thepaper.cn/newsDetail_forward_214203253 R. z( a6 V2 x6 m4 J+ U
https://finance.sina.com.cn/blockchain/2023-03-03/doc-imyiqhat7670720.shtml
$ \. @ ?. n# z. s8 n" xhttps://baijiahao.baidu.com/s?id=1759154697131925527
4 l' P% q+ d e% H5 i# w& f/ [! xhttps://mp.weixin.qq.com/s/pkzXaW_-77zXLKQqx2nlcA
& L& u- c! Z7 m- v——————/ E N D /——————: _. t" T! }4 H
产品经理培训|产品运营培训|企业内训服务
T- J& X7 {: F# j6 U' X3 G& y' i请在公众号后台回复「培训」了解更多3 T" j1 f% B) B$ U A3 G
▼ 喜欢请分享&收藏,满意点个赞,最后点「在看」 ▼ |
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
×
|