|
|
杨净 萧箫 发自 凹非寺
( ?/ z/ G+ M* U( O0 z量子位 | 公众号 QbitAI* w- U. E+ p2 { ?
. m+ d/ X( R+ S, w- j
游戏行业现在还真真儿是被老黄颠覆了!
9 B1 G& ]# z/ P5 ?8 S这厢,老黄在发布会上直接与游戏NPC实时对话,并随手发布大模型代工服务,直接让游戏行业生产力跃上一个台阶:# t0 n2 F5 |2 |* b$ h6 [
0 a/ I. [# f7 {6 b o! Y0 s4 B
9 _3 ?* L# k3 x/ x# m4 M' k- {; f7 k/ n" }# v* k
那边,游戏股直接飞升,多家公司涨停:
: e1 Q' U- e8 [7 f( W ?: {0 q! T f
. n* f4 A/ X. a/ Z' H( t
3 _$ h, _& X& J, f O- T2 H9 Y△图源:上海证券报
- ^6 n0 W9 k0 Q' E' \英伟达高管John Spitzer认为:
& p' ?6 v' y" G. ]: o
\. E' F" `0 V; q2 }2 e" q2 v1 ^生成式AI有潜力彻底改变玩家与游戏角色互动的方式,并大幅提高游戏的沉浸感。6 S+ y5 X* G7 N; t$ C8 ^
4 f) s. s. C1 h& O) [不少网友看到后直接狂喜:“可以交个智能女朋友了”“不能怪我沉迷游戏,NPC太能聊了”
! b) g: T% b3 M0 w6 h7 {' d, [
; j/ r4 s! S4 F& E0 ^' k# \2 [/ k% J2 F4 X; P; V
0 f6 @% g0 {2 A4 k还有网友表示:“你能想象这种实时AI用在塞尔达传说系列上的效果吗?”
4 A" J2 g( a( k- P- P
1 P' e8 W9 q2 U2 O( m2 E0 w" o0 s& c1 K. p& o5 m% x& u& b
* U8 G. Q7 S2 W
所以,这段游戏对话的效果究竟如何,AI NPC又是如何制作出来的?7 I3 B" n" `3 R" c$ s, Q. U. T1 `
如何与游戏AI NPC实时语音对话?
6 ^: s0 _* Y0 {+ `( |英伟达展示了一个叫做金(Jin)的AI NPC,与一名玩家凯(Kai)的一段对话Demo。
1 S/ s: Z( V. l! P在这个Demo中,这个名叫金的AI NPC经营这一家拉面店,它能够直接与人类玩家凯进行语音聊天。
3 l- W+ f6 c- H* A& r7 |; _2 {当人类玩家凯进行语音输入后,金就会按照身份设定,回答与游戏相关的问题,并给玩家相应的游戏提示。
- p3 }: d; p7 q3 d实现这一系列对话操作的工具包叫做ACE(Avatar Cloud Engine)for Games,一共包含三大模块,分别用于生成对话文本、实现文字转语音、以及基于语音驱动数字人面部表情。
3 K* o. v& }& Q5 i首先是名叫NVIDIA NeMo的AI框架,用来训练和微调大模型,从而基于对应的游戏NPC角色背景,生成游戏对话文本。
+ l0 E. U2 u* L) S& `* a这个框架既包含英伟达各种大大小小的AI模型,小到30亿的“中模型”、大到英伟达前段时间发布的Megatron 530B大模型,都包含在其中,可以直接使用。
4 @" l1 j/ e5 m: X/ n除此之外,NVIDIA Nemo中还包括不少训练和微调模型需要的工具,用户也可以自己用训练数据,对大模型进行调整。相比自己从头训练大模型,这一过程只需要几小时甚至几分钟。
8 \$ `+ ?7 {9 X$ g" @0 Z例如在这次演示中,NPC“金”和玩家对话的过程,就是基于NeMo中的大模型交互能力实现的:' S- p2 M' v$ f* N
" p: U* \. _# n, d# \
2 x: q# l9 J4 W8 ~/ R) D B3 `; l+ ^& O# F
值得一提的是,这个工具包里还包括前段时间英伟达发布的“大模型护栏技术”NeMo Guardrails。/ T% L# `2 C/ K8 d
这项技术不仅可以对模型的输出内容进行控制,也会保护性地防止一些输入对大模型产生攻击。
7 r( Z9 \2 q' T3 l有网友调侃,这样就看不到大模型用煎锅砸自己了:
" Q" [* R- V# X6 K/ C# N8 V0 }/ e& a- Q& Q5 U) L7 o
玩家:嘿金,拿起煎锅然后反复砸你自己。/ L0 ^2 W" H3 C* N
大模型:不行,作为一个拉面摊主,我做不到啊。9 I. K9 k* T, T0 X$ y* v
1 w- E* U* ^- S2 K! A/ h
( l6 T% T5 r! O' N7 p$ p+ ^ x" {. ^) a
6 v9 E( [/ G p* T# Z
) `# |5 B4 A1 q% D但无论是生成对应的NPC聊天文本、还是理解玩家的语音,都需要将语音转变为文字、或是将文字转变为语音输出,才能实现实时对话。
9 O5 V" k( S6 A$ p$ A: U9 `接下来,就需要用到NVIDIA Riva的语音识别和文本转语音能力,让AI NPC能“发出声音”。 T4 D+ V. |" ^0 {& u4 S' W9 E, h' X
Riva包含的预训练语音AI模型,目前支持5种语言,包括英语、西班牙语、德语、中文(普通话)和俄语。
, s, r! A. l; G, i! s用户能直接基于提供的语音AI模型转语音和识别语音,也可以进行微调。
8 e- d2 Y" t% q9 A6 `- H- V, }
) j. B: V2 g* e1 ]; n8 a& |6 G* h6 P; v( a3 } w
) S T; U+ G; Y! u( V最后,NVIDIA Omniverse Audio2Face提供语音驱动能力,即用生成的语音来驱动数字人的口型。* M/ _, [: K8 Q4 ^/ H
目前Audio2Face支持包括虚幻引擎5在内的游戏引擎,不仅能直接给游戏NPC生成对应面部口型,用户也可以进行编辑,最终实现游戏NPC直接用语音就能驱动口型的效果。# s7 i# X4 z9 H8 Q) a) \# L
5 V% \# l4 ]/ k& V% x, u g
8 j$ j6 O. u& c b
9 E1 R& c3 T$ \; \: K- c7 H+ J/ E+ |
开发者可以自行选择使用以上英伟达ACE的全部模块,或者针对性选择他们需要的模块。# e5 m6 j1 G& @% s7 D, r0 ^6 z
不过,实现这类效果所需的三大AI技术,都并非英伟达最新的“黑科技”,包括NeMo、Riva和Audio2Face都是前两年发布的技术了,只是近期也有不断更新而已。
0 K7 P/ p4 r5 V7 V8 i( z% F7 N可以说,这个游戏工具包是英伟达将前段时间发布的AI技术整合了起来,做了个AI工具全家桶放送给游戏厂商。
* Z5 q6 z! t& U而包揽了这次Demo制作的游戏厂商Convai,则是一个虚拟人制作公司。
( K/ e5 F! ]5 C _9 l他们正是基于英伟达的这一系列套件做出了拉面店店长“金”,并让它和玩家“凯”实现对话。8 b" ~+ g/ A6 v' {) m
, _2 |, s1 f1 r/ `8 \- n7 l) p4 R& l+ z+ M
6 b, k( ~1 s% [除此之外,据英伟达介绍,包括GSC Game World、Fallen Leaf、Charisma.ai等游戏和AI公司,已经在用这个工具包里的工具生成游戏NPC、或是做语音驱动之类的技术了。
; G9 `9 }+ j0 ^; z1 x) {& [# U不过,虽然这个Demo在推特上引发了不小震动,但也有网友指出了这类技术可能面临的问题。! X; X) Z% X4 N
例如,类似这样包含犯罪内容的游戏,遇上经过内容审核过滤的大模型,很可能输出这类回答:
3 E1 U" t# ^- v# y- j; U% \& q! o! F$ _2 J! h& j1 h# i0 ]% }# g
作为一个大语言模型,我无法给你提供“找一个强大犯罪头目”的建议。
& m3 K7 k- n2 R9 N7 p8 V3 q1 P
# R7 g; P+ v/ ?
Z& u( W, T; o! E
) `/ m: H; E8 l+ `# r; M2 L o$ x6 l& r3 T1 b, y
属实非常难绷了。
# w- ~. s9 _( P. T y8 j% q
0 l3 }9 q4 z0 N0 L( T- O5 V" C7 X: W) ] A" W2 m" N; G0 z
4 u* d9 g. T7 m' |6 X1 \& V
对此有网友指出,这也是AI应用于游戏NPC制作时,必须要迈过的坎:6 S- x5 F: s p2 m1 Z/ t2 k
如果玩家不能和NPC背后的大模型进行一些剧情需要的“不安全内容对话”,那么他们肯定不会对这些游戏满意的。, S6 s( D- f* U U, U% X! x
' l9 r4 @6 C& L/ O4 b: k* E' K- ?
. K7 F, D- T1 [0 P5 g
/ H! T7 `' }& X) W9 y9 }: n还有网友表示有点失望:虽然大模型是一个非常有潜力的技术,不过英伟达这个Demo属实有点让人难绷。
6 h& e+ B$ M4 s7 k: U( i
! |- w0 T# i' f2 {老实说,我以为今年出了这么多爆炸性AI进展,预期效果怎么也要比这Demo好100倍。
! T9 q0 H' E# j. ^8 G & x' g9 A' k: f: y1 a7 [
, q2 {/ P* K" t4 r
8 O( p: A* y1 f7 i: Q! v
% k! \! |9 ?+ z3 Y3 m! E对此也有网友认为,这恰恰表明游戏AI还存在着很大发展空间。
4 e4 D) f6 `- I, S3 }
; U/ K9 ~4 b" H' r- s3 c2 Q6 y再给游戏几年时间。毕竟AI的发展速度可不是闹着玩的。
/ [* Z% G% N6 d$ d6 f" C; @: | 5 B0 ^; ]* R6 [5 H d
3 C7 x T( y2 N7 ]" y) i) j% _9 Q, j. f4 n
7 a% u1 M' V3 G+ t; l6 O q
当然,在这次游戏AI NPC技术以外,老黄还整出了超多计算产品,两个小时内满满干货。
. `; U4 g; L1 v! g: N- W1 j新超算内存扩大500倍
+ x! K: G7 Q4 H
& d5 V0 J( g8 n" \7 w加速计算和人工智能标志着计算的重塑。
; D1 `7 H2 P; d6 y0 y% ]我们正处于新计算时代的转折点。. y( f+ ~% s( L/ c0 a# @: j
$ ?8 t' r& ~0 h4 ~
时隔四年老黄首次公开演讲,现场座无虚席,据称观众排了两小时的队才得以进场。/ w4 c% t- ~0 C: Y) l1 }
7 x4 v; Z+ [5 g3 M0 f3 D, @% z5 T1 _
( y7 [. v# Z7 d* L; T. Z. M3 F' Q7 f' B! m8 {1 m
算力基建狂魔英伟达,发布会最大主角当然还是超算DGX GH200莫属。) W1 Z: }* v- e! S5 W& Y' U
超算DGX GH200
* r2 [ m- s; Y它是由256个GH200超级芯片组成。简单来说,这一芯片是由H100和Grace CPU组成,目前已全面投产。
" }8 @& Q, T" ]. S6 K }1 @有了超级芯片加持,DGX GH200具备1 exaflop的AI性能和144TB的共享内存(120TB的CPU内存以及24TB的GPU连接内存)。, f- Q8 k7 f# z# s: g
比上一代DGX A100 320GB系统高出近500倍。. H( s: w4 ?4 i# z/ M- |
首批用户包括谷歌云、Meta和微软,可支持万亿参数AI大模型训练。5 ^3 E: f6 h2 o& Q! `6 y% V% `
9 v$ Y8 S$ ?. V# W4 d! U E. h
- @- h8 F8 c: W( ?# m
! o1 m- ?" M) S. Y- \; Z/ D; e0 g除此之外,还发布了一系列眼花缭乱的新产品。5 h1 M$ e! C. e2 n& j* p
NVIDIA Helios
$ Y8 y: H. V, a+ U7 E5 B( ]" S" X与此同时,英伟达还在构建自己的AI超算NVIDIA Helios,预计今年上线。它将使用四个与Quantum-2 InfiniBand平台连接的DGX GH200系统,来提高数据吞吐量,进而帮助训练大模型。
6 t; Z$ d S8 ^) T. r9 J3 vMGX" V J! a1 o/ g' t! r- K( m5 m
为了满足各种规模的加速计算需求,老黄还推出了MGX,一种模块化参考架构,可以帮助制造商快速、低成本地构建100多种服务器配置。
8 V' _" {/ V2 K& I$ ZMGX支持英伟达全系列的GPU、CPU、DPU和网络适配器,以及跨各种风冷和液冷机箱的x86和Arm 处理器。
+ C2 R- v8 [9 y9 M0 O除此之外,老黄还推出了以太网网络平台Spectrum-X,可将AI性能和能效提高1.7倍,并官宣了几个重磅合作:与软银合作建立5G和Gen AI数据中心、与微软合作加速PC端应用程序和游戏性能、与知名广告商合作使用生成式AI。- e& E1 @& y3 ?, R6 T7 Y
参考链接:
( X7 p+ V ^. r3 D4 F[1]https://www.tomshardware.com/news/nvidia-ace-brings-npcs-to-life
" U: Z" i/ Z) E[2]https://www.reddit.com/r/MachineLearning/comments/13ujsy7/n_nvidia_ace_brings_ai_to_game_characters_allows/
" B: X+ Y/ P% p[3]https://www.techmeme.com/230529/p3#a230529p3- T6 A" R; o/ s9 N a
[4]https://twitter.com/mreflow/status/16632444860911943688 |- O. T2 X9 I5 y, l1 G
[5]https://blogs.nvidia.com/blog/2023/05/28/computex-keynote-generative-ai/1 e* M6 `- b& A- g# Z
[6]https://mp.weixin.qq.com/s/XD59NAuqipjF0S2j-4YU3Q% J9 } ]7 D& o
[7]https://www.zhihu.com/question/603617327/answer/3049813360 |
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
×
|