|
|
1 P* r. [9 v& K# Z- u. K0 u6 @4 d0 O# t$ M$ ]6 x
新智元报道" f% i0 F5 U) t* m9 T- J
编辑:编辑部# V! @+ D: m6 r5 K$ B
【新智元导读】2月20日,复旦大学邱锡鹏团队推出中国版ChatGPT「MOSS」。发布当晚,服务器被挤爆。2月21日,复旦MOSS团队致歉,称模型还不成熟。& H ~. Q9 c5 F+ ^; F3 `3 [
今天,MOSS又火了。不仅登顶知乎热榜,收获近千万流量,还引来诸多媒体竞相报道。
6 f X5 K% }, Z( e+ z6 i+ H6 G" L0 M, `, i6 ~
k) ~9 `* X, q% v
不过,这次出圈的,不是陪刘培强流浪的MOSS,而是复旦大学研发的中国版ChatGPT。
% Y0 Q' i2 N, }6 `1 ~. ?6 z. r( O- J: v3 M: |" \
国内首个对话式大型语言模型; Q+ r$ Z' a; H
ChatGPT自发布以来,已经收获了全球巨大关注。尤其是在春节后,ChatGPT突然走红,许多网友开始期待中国版聊天机器人的诞生。
2 c2 ~9 x! M8 o8 F现在,这个愿望得以实现。复旦大学自然语言处理实验室表示,国内第一个对话式大型语言模型「MOSS」已由邱锡鹏教授团队发布至公开平台,邀公众参与内测。
% ]" y2 G1 x$ g0 [/ L8 C7 D) h, X5 B# |7 m& i( t+ p
7 L" T" D u5 e7 t( v6 eMOSS可以执行一系列任务,如对话生成、编程、事实问答等。官网称,MOSS为生成的语言模型打开所有技术路径,以理解人类意图并具有对话能力。
8 T4 Q# R" _2 w, S, ?0 OMOSS的出现为国内学术界和业界提供了重要经验,并有助于进一步探索和应用大型语言模型。
3 q- h3 S5 s# O7 {9 j1 g" W- f9 k团队负责人邱锡鹏表示:「尽管MOSS仍有很大的改进空间,但其推出证明,国内科研团队有能力在开发ChatGPT产品的道路上克服重要的技术挑战。」9 d C" U% ]- Q: j
7 F9 B: p. ]9 A: N3 ^* ~ m* c2 A
8 k- c) k& [3 R据悉,MOSS研发项目得到了上海人工智能实验室的大力支持。后期,该项目将会通过开源方式,和行业人士与社区分享。; `1 w A$ J9 \9 E5 K9 Q
开源代码,打造MaaS生态8 T( k: O" k: O8 b# I
MOSS的回答语言流畅、逻辑清晰且观点正确。科研团队在演示时,用英文输入多个指令,展示了MOSS多轮交互、表格生成、代码生成和解释能力。- w* H/ k6 D, v" r4 f) Y
「告诉我5部科幻电影。」「生成一张展示这5部电影和导演的表格。」「增加一列表格,显示这些电影上映的时间。」在这个包含表格生成的多轮交互中,MOSS都顺利完成了任务。# V4 B7 |3 F4 s; u; G2 A5 w
6 ]- s& i: h V( S$ {% k# S
; H( b" F6 z% {. l然而,MOSS与ChatGPT最大的不同,在于其开源属性。2 F/ \4 x% |5 M9 H3 [. {% a
由于ChatGPT并未开源,其技术解决方案的细节尚未披露,研究人员对此有很多猜测。一些专家认为,ChatGPT是一个复杂的组合系统,无法通过单一的生成语言模型实现。: d5 o( C4 |+ V& H* c/ ~" \3 H
作为自然语言处理专家,邱锡鹏近年来一直致力于研究具有多任务学习能力的一般模型。为了探索ChatGPT的技术路线并获得LLM研究的一手经验,他带领团队加快了MOSS的开发。
* r; }) |+ j) r, `# Z+ _' J4 a
/ L* K- S, a* U' E, r; O) ~ j. C/ v j4 D- E4 q
MOSS开发的基本步骤与ChatGPT相同,包括两个阶段:自然语言模型的基座训练和理解人类意图的对话能力训练。
6 Z4 q9 t+ K r在对话能力培训阶段,OpenAI收集了至少数十万条人工指令,要求各行各业的专业标注员编写指令回复,然后将其输入模型库,以帮助ChatGPT逐步理解各种指令。5 k+ U' I2 {: X3 O1 b: n
复旦团队采用不同的技术路线,通过允许MOSS与人类和其他对话模式互动,并在短时间内高效完成对话能力培训,从而显著提高学习效率和研发效率。) ~, W; ]( [/ ?' m9 ^1 X( m
为了提高研发效率,MOSS团队选择开源代码。对此,MOSS模型的官方公告表示:
( g7 V U8 P1 i r" Z& H/ ], F" G2 a' A( F2 ]# c: B a) K
预训练大语言模型的研发门槛很高,需要大量算力、训练语料和人工标注。在我国产业界,只有大型机构才有实力开发大模型。 MOSS开源后,可有效降低预训练语言模型的研发和应用门槛,让中小企业在其基础上开发出智能客服、智能家居、人工智能律师等各种垂直类产品。 % Y- w$ V$ B7 b! H
推出伊始便开源代码,虽然可以提高数据收集和研发效率,但也不得不称为一个冒险的举动。然而,这也为未来企业的发展提供了一个新的思路:MaaS(基础模型服务)。
4 K2 j( O1 R Z* y$ ~# r在未来,企业或许不需要在大模型领域「卷生卷死」,有了类似于MOSS的高质量LLM,企业只需对已经完备的模型进行微调,就能获得所需的品质良好的垂类产品。' H6 h, P8 B& ? W$ \+ Y7 f
* R9 T9 _8 V& o* G
取名MOSS,致敬《流浪地球》; ?. T! F, A5 V2 f! a
随着MOSS的推出,互联网上出现了怀疑的声音:为什么要叫MOSS?
* \ [( i/ \/ I! f7 @ j1 L+ W1 f( a
4 I" J- G! v8 {$ Y. J- ]+ O0 H7 J _
面对「蹭热度」的质疑,MOSS团队发公告予以澄清。公告称:8 `) k2 l0 X/ x* B0 t- k$ i
! \9 Q! E# y6 h/ e g
尽管我们的对话模型和《流浪地球》中MOSS的能力不能相提并论,但就像过去NLP领域的其它优秀模型一样,作者们都希望使用自己喜欢的影视角色名称命名自己的模型,我们在训练完成第一代模型的时候,正值流浪地球2热映,片中MOSS给团队每个人都留下了深刻的印象,因此便使用了这样一个名称来指代我们的模型,以表示我们对最前沿AI模型的不懈追求。
: c# Q* ?5 p5 _1 m' C事实上,用大IP给科研项目命名并不是什么新鲜事。ChatGPT基础技术之一的Transformer,其名称来源于大热电影《变形金刚》(Transformer)。, h) e- m+ O! D9 ^; p2 S8 J" N
网友评价' @5 H! I% u9 l8 ~
MOSS一上线,官网都快被挤爆了,小编也只能乖乖排队等内测资格啦。( s: o& k# T4 b7 e [9 z
, Q! x/ A3 v6 C# ]0 O3 Z! E
1 F0 S: N4 I" K: z( G$ x# l体验地址:https://moss.fastnlp.top/* E/ r( S f9 M1 ~4 m7 I' j* m* D9 A
项目地址:https://txsun1997.github.io/blogs/moss.html
; E* F8 E/ ], ?, n9 ?不过,根据网上记者的对话以及知乎答友们的评价,咱也能来仔细瞅瞅MOSS了。9 X& X7 [$ D! D+ z5 x
文风很AI,但未来可期
6 @3 ?- k. W: k: a# l基于目前已知的信息,「段小草」对Moss的特点进行了总结:
}& y; f# W: Q8 y! Z m& F) z1. 上下文的能力是有的,但不确定能保留多少,毕竟展示出来的上下文对话都不是太长;
: W1 \2 t! I: J- q2. 文风很 AI,不过生成的内容不算长。即使是分 1、2、3、4 点回答的时候,句子也比较短。ChatGPT 一般会生成更长的展开。
! q3 K" j8 k1 s* n G9 ]8 {3. 文章中也专门展示了英文能力,但还不确定训练集中不同语言语料的效果。
: Q# k& ~. w1 R; u& p4. 吸取 ChatGPT 和 NewBing 翻车的教训,在上线初期就套上了足够的道德枷锁。
: c: E$ _& R4 D: }最后,「段小草」表示:「希望能尽快体验到产品,也期待看到更多产业落地。」
9 W! N5 e# C1 iMOSS回答:/ s H7 y# t9 ?: s* S0 W/ D
$ q" A" Z8 }/ _/ y% u4 R
0 v/ p! P& b: _7 C4 S1 K: TChatGPT回答:
4 t# M' z. P2 c, J5 s- s, n$ _; R3 |$ S9 }- F, q/ a
2 W, D, j2 |, d; a回答地址:https://www.zhihu.com/question/585248111/answer/29031325792 H" |3 [. ~: T8 C* m: u
给国内AI开了个好头
/ j. f8 b' B- N: t的确,MOSS的发布对国内AI的发展肯定大有益处。
- M& g* P5 Y0 @) G知友「极智视界」表示,在AI领域,技术源于美国而盛行于世界,例如框架类的pytorch、tensorflow,目标检测算法YOLO以及造就ChatGPT的transformer。我们「对标」国外的技术,虽然赶超美国可能做不到,但是「对标」的过程一定会让国内的AI有一个快速的发展。
9 Z2 c+ h2 w. _* T
& S/ e8 L# \8 j. {% B4 n+ O& {7 d, u8 D5 E! }6 I4 U" I
回答地址:https://www.zhihu.com/question/585248111/answer/2903303710
) r W: d& d/ q! e「极智视界」还提到,国内首个类ChatGPT模型MOSS的发布既符合预期但也有些意外。+ j- a: D1 X. H4 a" ~0 e! _
符合预期是因为近段时间以来也一直有国内版ChatGPT摩拳擦掌的消息,所以迟早都会来的;意外的是在当前这种强大的利益驱动下,研究机构居然还走到了大厂的前头。1 x" w5 {. L* X+ G
但总的来说这是一个令业界比较振奋的消息,咱们终于可以用上咱们自己的AI问答系统了。
$ L: f. e6 W8 `6 [高校的重点还是理论探索8 P% A! _" C) v0 }1 s! Q
知友「卜寒兮」表示,想研发出类ChatGPT的产品,需要一个团队能撬动各个方面的资源,还要有过硬的技术做支撑。3 _8 Z7 O: ]: I9 c
以ChatGPT为例,单单想要研发出一个成规模的LLM模型,就需要以下四个方面:
- u# E/ f7 y: W# h6 U2 i/ g2 n3 C7 o! |# d: L! Y
3 k$ Z' j6 T* Q2 q5 L. ^
- 7 I; V* |" R5 h( V6 L9 H! ]8 `
海量数据的语料库:ChatGPT背后的模型的GPT-3、GPT-3.5系列,初代的GPT-3是2020年发布的,这个模型有1750亿个参数,训练它所使用的语料库包含45TB的数据、约3000亿个单词
! j: X' A6 s% I) p( I1 P6 ^( v2 ^
- + m; L5 C1 @: L8 z8 F* T
大量的人力:毕竟ChatGPT成功的背后是时薪不到2美刀的血汗工厂
6 U5 y1 T3 C& T( b0 V/ l
$ v) X0 _. \, E3 z, [0 c
; p+ }3 X" T0 b* k% Z! H算力的支撑:训练chatGPT这样规模的LLM模型需要目前世界上最强大的GPU来满足算力要求而像NVIDIA Tesla A100这种最新的AI超级计算机芯片已经禁止对国内出售了。国内除了几家互联网大厂,很少有公司有实力能长期投入大量资金在算力上,更不要提校内的科研团队了,靠点科研经费可远远不够。
! w% s/ K' n& ?0 `4 F2 C$ m, i5 j
5 Y) b2 I6 n1 {5 d% @3 F- # d0 D, }) t! ]" V
技术上的壁垒:GPT-3的初代版本在2020年就出现了,而到2022年11月首次推出ChatGPT产品,这期间花了三四年的时间迭代不同的版本。这是一个长期的过程,意味着花大量的时间找到关键的训练tricks,反复调参,在不同的训练集上反复训练、微调,并且还有找到合适的训练方法,才能迭代出一个优秀的版本: b/ r9 f- R- k |( d: q
. A/ q1 O3 Y. ?2 V- B/ ^
' p3 w1 ^3 j. O: G9 l+ |4 r
0 o- M/ \7 h2 Q$ l# Z5 ^
# u( g! G" S: q# j# @& }- P回答地址:https://www.zhihu.com/question/585248111/answer/2903161180
# X' B% y# E' K9 ~$ K& D目前来看,还真的只有大公司才有能力做得出来。对于高校的科研团队,其优势在于技术和方法上的创新,所以还是要在这方面做更多功夫,为将来有一天该方向的发展做技术储备。, U: n+ \; }& W0 w+ G3 X% f" U1 ]# T$ s
' W# M! [9 C0 y4 v, |
复旦MOSS团队:还不成熟
( o8 r, x7 `. s' h2月20日,就在MOSS模型公布的当晚,不少测试的网友发现,MOSS已经显示服务器流量过载,只能第二天再重试。
/ U* H z. i) Y8 @3 } e2月21日,复旦团队在MOSS官网发布公告称:首先非常感谢大家的关注!MOSS还是一个非常不成熟的模型,距离ChatGPT还有很长的路需要走。
. o" c. M# b E; @0 ?
4 g4 I, q; A$ {) {5 t L& a2 J" t* B# R0 I3 Z0 c
9 A/ z& ]" W( i! Z) A我们一个学术研究的实验室无法做出和ChatGPT能力相近的模型,MOSS只是想在百亿规模参数上探索和验证 ChatGPT的技术路线,并且实现各种对话能力。 我们最初的想法只是想将MOSS进行内测,以便我们可以进一步优化,没有想到会引起这么大的关注,我们的计算资源不足以支持如此大的访问量,并且作为学术团队我们也没有相关的工程经验,给大家造成非常不好的体验和第一印象,在此向大家致以真诚的歉意。 在 MOSS完成初步的验证之后,我们会将MOSS的经验、代码、模型参数开源出来供大家参考。中国版ChatGPT的诞生还需要中国全体AI从业者的努力,也更需要不断。和人交互以提高能力。
$ |4 ~$ w& j+ ^5 E' w q参考资料:
; y4 ^( Q6 H7 K, D: G# f' Shttps://txsun1997.github.io/blogs/moss.html. a3 K2 o* m n
https://www.zhihu.com/question/585248111& i# I Z/ ^$ B) d/ O7 R
https://m.weibo.cn/status/4871507265982631?wm=3333_2001&from=10D2293010&sourcetype=weixin&featurecode=newtitle
5 W" W7 _% O( i* }0 V9 x4 {特别鸣谢:(授权转载)0 l( U0 ?7 z m+ M; ~
「段小草」https://www.zhihu.com/question/585248111/answer/29031325799 }( t) _' J/ H+ t
「极智视界」https://www.zhihu.com/question/585248111/answer/2903303710) [: v8 C0 @# A8 ^+ y7 @
「卜寒兮」https://www.zhihu.com/question/585248111/answer/2903161180 |
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
×
|