|
|
0 u! W- M- v$ F
1 u9 P, Q4 n& `- \& V5 Q% u新智元报道
: L. C- p% |; T# b5 `; M2 K编辑:编辑部* B9 y1 l( U/ u; E
【新智元导读】2月20日,复旦大学邱锡鹏团队推出中国版ChatGPT「MOSS」。发布当晚,服务器被挤爆。2月21日,复旦MOSS团队致歉,称模型还不成熟。2 @# l, w% a/ E4 ], n! @
今天,MOSS又火了。不仅登顶知乎热榜,收获近千万流量,还引来诸多媒体竞相报道。# M% A# ]6 E+ L4 n2 o E9 @1 \, e" I
, l( Q2 o+ ]2 C% t6 v" H2 E' E
H/ T3 l/ l7 {! _4 D9 n
不过,这次出圈的,不是陪刘培强流浪的MOSS,而是复旦大学研发的中国版ChatGPT。7 j4 s* K! S' s
( w, ?2 k$ t; p国内首个对话式大型语言模型" S; p7 x& y) k/ N% L ~" M* s# c7 x
ChatGPT自发布以来,已经收获了全球巨大关注。尤其是在春节后,ChatGPT突然走红,许多网友开始期待中国版聊天机器人的诞生。
* J3 W- j3 f& [. c5 x$ P现在,这个愿望得以实现。复旦大学自然语言处理实验室表示,国内第一个对话式大型语言模型「MOSS」已由邱锡鹏教授团队发布至公开平台,邀公众参与内测。
% U8 h! c+ R3 \( o4 ~# @0 V# v) O t' }9 [2 v+ s1 i7 [
5 y9 S& P1 T. {; U# H) s6 Z- Z. p! z; V
MOSS可以执行一系列任务,如对话生成、编程、事实问答等。官网称,MOSS为生成的语言模型打开所有技术路径,以理解人类意图并具有对话能力。
. |" C( F% M! D% r" t1 QMOSS的出现为国内学术界和业界提供了重要经验,并有助于进一步探索和应用大型语言模型。3 ^# l, y, [ j, w/ ]
团队负责人邱锡鹏表示:「尽管MOSS仍有很大的改进空间,但其推出证明,国内科研团队有能力在开发ChatGPT产品的道路上克服重要的技术挑战。」
: n9 q5 |& o0 E3 {4 y3 G5 Y. G! y5 u7 ~9 Z
}# L$ k4 m. M# C* o, x7 @' N据悉,MOSS研发项目得到了上海人工智能实验室的大力支持。后期,该项目将会通过开源方式,和行业人士与社区分享。7 ?. }$ z" D+ ?8 I
开源代码,打造MaaS生态2 b8 @- m9 r @- _6 Q) O
MOSS的回答语言流畅、逻辑清晰且观点正确。科研团队在演示时,用英文输入多个指令,展示了MOSS多轮交互、表格生成、代码生成和解释能力。
% y+ S# B, ~- T+ `/ \" p「告诉我5部科幻电影。」「生成一张展示这5部电影和导演的表格。」「增加一列表格,显示这些电影上映的时间。」在这个包含表格生成的多轮交互中,MOSS都顺利完成了任务。
* y( L3 S2 E* _0 o g$ C/ d2 d4 I& Q4 C% O2 \
& U: U/ Z6 ^7 @' Y7 j( E* D+ A# O然而,MOSS与ChatGPT最大的不同,在于其开源属性。4 e! e4 R. P: C
由于ChatGPT并未开源,其技术解决方案的细节尚未披露,研究人员对此有很多猜测。一些专家认为,ChatGPT是一个复杂的组合系统,无法通过单一的生成语言模型实现。
, x! n; G$ E6 K" A作为自然语言处理专家,邱锡鹏近年来一直致力于研究具有多任务学习能力的一般模型。为了探索ChatGPT的技术路线并获得LLM研究的一手经验,他带领团队加快了MOSS的开发。
6 {! v" I1 X$ l- e' s$ p0 x5 C) `* n& X+ E L3 }3 P
! |: v, @* D+ v% `' A1 j5 nMOSS开发的基本步骤与ChatGPT相同,包括两个阶段:自然语言模型的基座训练和理解人类意图的对话能力训练。- n5 [* f% s) U/ k
在对话能力培训阶段,OpenAI收集了至少数十万条人工指令,要求各行各业的专业标注员编写指令回复,然后将其输入模型库,以帮助ChatGPT逐步理解各种指令。8 \! W9 h f; d! b {* }) k/ h
复旦团队采用不同的技术路线,通过允许MOSS与人类和其他对话模式互动,并在短时间内高效完成对话能力培训,从而显著提高学习效率和研发效率。
, h, L! Z3 ~( n5 d# `) }为了提高研发效率,MOSS团队选择开源代码。对此,MOSS模型的官方公告表示:* \+ D) g, B6 Z
9 S; B* ?' y. P1 j预训练大语言模型的研发门槛很高,需要大量算力、训练语料和人工标注。在我国产业界,只有大型机构才有实力开发大模型。 MOSS开源后,可有效降低预训练语言模型的研发和应用门槛,让中小企业在其基础上开发出智能客服、智能家居、人工智能律师等各种垂直类产品。
( ]+ U& r5 Z6 R5 g/ [% D; S推出伊始便开源代码,虽然可以提高数据收集和研发效率,但也不得不称为一个冒险的举动。然而,这也为未来企业的发展提供了一个新的思路:MaaS(基础模型服务)。
: Y) P; |- ]# {/ L8 o在未来,企业或许不需要在大模型领域「卷生卷死」,有了类似于MOSS的高质量LLM,企业只需对已经完备的模型进行微调,就能获得所需的品质良好的垂类产品。5 e% o) E0 [- P( d, V
0 {5 _/ w+ Y6 {. n
取名MOSS,致敬《流浪地球》- e$ Y: |, M H
随着MOSS的推出,互联网上出现了怀疑的声音:为什么要叫MOSS?. i" R: w2 W/ w" E7 j
! F/ Z, a1 }6 d. I) ] k& d
: ^+ d; q: H* n面对「蹭热度」的质疑,MOSS团队发公告予以澄清。公告称: M: y7 N( m6 I
. ^: c# I# |" c# L- p
尽管我们的对话模型和《流浪地球》中MOSS的能力不能相提并论,但就像过去NLP领域的其它优秀模型一样,作者们都希望使用自己喜欢的影视角色名称命名自己的模型,我们在训练完成第一代模型的时候,正值流浪地球2热映,片中MOSS给团队每个人都留下了深刻的印象,因此便使用了这样一个名称来指代我们的模型,以表示我们对最前沿AI模型的不懈追求。 ' D6 w8 x/ E! L1 h
事实上,用大IP给科研项目命名并不是什么新鲜事。ChatGPT基础技术之一的Transformer,其名称来源于大热电影《变形金刚》(Transformer)。
# j+ \2 k/ |7 C6 l9 j. k! b网友评价8 S( W" p; ~& z" H' W2 i
MOSS一上线,官网都快被挤爆了,小编也只能乖乖排队等内测资格啦。
; W, _3 ~- {% n7 w9 c
$ ~1 {: T4 t2 w1 V, i* J7 s
G9 k2 L$ }3 y. ]3 q$ b0 s" n- ~体验地址:https://moss.fastnlp.top/" u6 J$ c- Z! l. [
项目地址:https://txsun1997.github.io/blogs/moss.html
! _% w/ V' V8 ~+ i$ \8 h不过,根据网上记者的对话以及知乎答友们的评价,咱也能来仔细瞅瞅MOSS了。8 u" @3 W5 |( x; ?% r# r' `
文风很AI,但未来可期) q! m' Y& u; {$ V2 F+ C
基于目前已知的信息,「段小草」对Moss的特点进行了总结:+ j8 ~) B% U2 ~0 t# i( k+ W e+ | P
1. 上下文的能力是有的,但不确定能保留多少,毕竟展示出来的上下文对话都不是太长;. D7 v% @9 q$ r5 W
2. 文风很 AI,不过生成的内容不算长。即使是分 1、2、3、4 点回答的时候,句子也比较短。ChatGPT 一般会生成更长的展开。
" l2 T: u3 n% t$ `7 w3. 文章中也专门展示了英文能力,但还不确定训练集中不同语言语料的效果。
4 \! z& |3 ]* ^: C: w4. 吸取 ChatGPT 和 NewBing 翻车的教训,在上线初期就套上了足够的道德枷锁。9 l3 v( m$ l4 e- F
最后,「段小草」表示:「希望能尽快体验到产品,也期待看到更多产业落地。」& E! o! i0 A# }% V8 Q4 M5 ^
MOSS回答:) m" K6 J( M, M
\! l$ Z1 A& `6 @1 N
2 N( D& w& ?; R+ W& m9 U: \, aChatGPT回答:
8 O- j0 S; @1 Y- y# v
( u7 V2 S) x. \9 f- _- z6 `6 n+ c$ x' m, S& Y
回答地址:https://www.zhihu.com/question/585248111/answer/29031325793 r% U6 {2 b4 _9 Q J3 D D% r
给国内AI开了个好头9 B$ ?1 I, T# X* m6 Y
的确,MOSS的发布对国内AI的发展肯定大有益处。
% Y# h6 S! H3 @ o9 d3 j: |8 l4 i知友「极智视界」表示,在AI领域,技术源于美国而盛行于世界,例如框架类的pytorch、tensorflow,目标检测算法YOLO以及造就ChatGPT的transformer。我们「对标」国外的技术,虽然赶超美国可能做不到,但是「对标」的过程一定会让国内的AI有一个快速的发展。
5 I* _ S$ W5 ^, o+ H0 o! i1 u! X( X) y: I$ u2 X4 F* F
. z( t) ^0 z- I* J" e( o9 J: p; }4 B回答地址:https://www.zhihu.com/question/585248111/answer/2903303710
( M8 ~# V1 Y' n$ b$ G/ V7 q4 }; m「极智视界」还提到,国内首个类ChatGPT模型MOSS的发布既符合预期但也有些意外。
/ I+ A. `* s8 d9 s符合预期是因为近段时间以来也一直有国内版ChatGPT摩拳擦掌的消息,所以迟早都会来的;意外的是在当前这种强大的利益驱动下,研究机构居然还走到了大厂的前头。
1 B! r- _$ G" T+ e但总的来说这是一个令业界比较振奋的消息,咱们终于可以用上咱们自己的AI问答系统了。
" ?9 F3 {+ d8 |4 T( [5 w6 h7 ]高校的重点还是理论探索
! [- F) a0 X3 ^' J o8 _6 U知友「卜寒兮」表示,想研发出类ChatGPT的产品,需要一个团队能撬动各个方面的资源,还要有过硬的技术做支撑。% ^- c: e: H* q# q4 } L
以ChatGPT为例,单单想要研发出一个成规模的LLM模型,就需要以下四个方面:# d& L2 H" Q2 Z& S! K# D, c$ L; }
% O7 Z# j# I* u8 w4 m P- C5 _/ [) r* Z4 l/ v/ V
- 7 n' ` y" u/ C/ q w1 v
海量数据的语料库:ChatGPT背后的模型的GPT-3、GPT-3.5系列,初代的GPT-3是2020年发布的,这个模型有1750亿个参数,训练它所使用的语料库包含45TB的数据、约3000亿个单词
- Q- a# I1 L; ]1 X @% j' I
* d+ q) N2 K' i - . p- Y3 ^3 `2 g* ^, G
大量的人力:毕竟ChatGPT成功的背后是时薪不到2美刀的血汗工厂
% Z! |2 N9 b5 [, T
# {* l( b2 U" y
$ b# r! l0 A* l; T( l* p+ m% t算力的支撑:训练chatGPT这样规模的LLM模型需要目前世界上最强大的GPU来满足算力要求而像NVIDIA Tesla A100这种最新的AI超级计算机芯片已经禁止对国内出售了。国内除了几家互联网大厂,很少有公司有实力能长期投入大量资金在算力上,更不要提校内的科研团队了,靠点科研经费可远远不够。
/ G+ @, Q: m% G3 K I% k! b# O4 w# Y$ R3 F4 m# J# F& l! a
- 7 k8 r/ L- g3 l: \& V
技术上的壁垒:GPT-3的初代版本在2020年就出现了,而到2022年11月首次推出ChatGPT产品,这期间花了三四年的时间迭代不同的版本。这是一个长期的过程,意味着花大量的时间找到关键的训练tricks,反复调参,在不同的训练集上反复训练、微调,并且还有找到合适的训练方法,才能迭代出一个优秀的版本3 k" x# n! k" R3 [
Y/ {3 Y4 p7 p I+ x/ {8 _1 x
8 D3 p! o5 o4 r# t
, {( ?& J' q5 ?! p/ t) z# \
3 j+ c7 [: ], A. @/ w8 |+ s+ M回答地址:https://www.zhihu.com/question/585248111/answer/2903161180/ K1 N0 Y: z' z8 I. w9 p4 J
目前来看,还真的只有大公司才有能力做得出来。对于高校的科研团队,其优势在于技术和方法上的创新,所以还是要在这方面做更多功夫,为将来有一天该方向的发展做技术储备。
, ^, |$ N2 Q) W8 `3 N1 J* V
1 _ d+ V/ Y S1 G复旦MOSS团队:还不成熟
) J% p ~! S# g1 u2月20日,就在MOSS模型公布的当晚,不少测试的网友发现,MOSS已经显示服务器流量过载,只能第二天再重试。& ]2 |$ r+ x6 F' `" L
2月21日,复旦团队在MOSS官网发布公告称:首先非常感谢大家的关注!MOSS还是一个非常不成熟的模型,距离ChatGPT还有很长的路需要走。
" j0 @, A% D4 @( F8 |
+ c1 }8 w3 m5 V. i# b6 g" |0 k, K% A1 F
1 T% h- A# J" R$ @* b我们一个学术研究的实验室无法做出和ChatGPT能力相近的模型,MOSS只是想在百亿规模参数上探索和验证 ChatGPT的技术路线,并且实现各种对话能力。 我们最初的想法只是想将MOSS进行内测,以便我们可以进一步优化,没有想到会引起这么大的关注,我们的计算资源不足以支持如此大的访问量,并且作为学术团队我们也没有相关的工程经验,给大家造成非常不好的体验和第一印象,在此向大家致以真诚的歉意。 在 MOSS完成初步的验证之后,我们会将MOSS的经验、代码、模型参数开源出来供大家参考。中国版ChatGPT的诞生还需要中国全体AI从业者的努力,也更需要不断。和人交互以提高能力。
\+ Q- X) F/ C4 z x参考资料:
F8 P" h0 i- N; P" W! v7 ^https://txsun1997.github.io/blogs/moss.html; l; |; u$ u) `' O/ D
https://www.zhihu.com/question/585248111- }1 y, e: b$ ^) u0 @( ^% r
https://m.weibo.cn/status/4871507265982631?wm=3333_2001&from=10D2293010&sourcetype=weixin&featurecode=newtitle
: E3 E4 U, q! a a' K. K特别鸣谢:(授权转载)
: o7 s0 B5 D, ?「段小草」https://www.zhihu.com/question/585248111/answer/2903132579' w, E: J% r9 \" R7 s% H) a5 m
「极智视界」https://www.zhihu.com/question/585248111/answer/29033037105 S7 B, x Q* w# V
「卜寒兮」https://www.zhihu.com/question/585248111/answer/2903161180 |
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
×
|