法国版OpenAI杀疯了!1760亿参数MoE登开源榜首,3张A100显卡可跑,杨立昆转发“逆天”评论 法国版OpenAI杀疯了!1760亿参数MoE登开源榜首,3张A100显卡可跑,杨立昆转发“逆天”评论
admin
2024-04-11 11:33:06
0


智东西(公众号:zhidxcom
作者香草
编辑李水青

智东西4月11日报道,昨日,“欧洲版OpenAI”Mistral AI又一次悄然秀肌肉,甩出全新MoE(专家混合)大模型Mixtral 8x22B磁力链接,模型参数规模高达1760亿,仅次于马斯克的Grok-1,成为市面上参数规模第二大的开源模型。


▲Mistral AI发布Mixtral 8x22B

Mixtral 8x22B由8个专家模型构成,每个模型的参数规模220亿,模型文件大小约为262GB。测评成绩方面,Mixtral 8x22B在MMLU(大规模多任务语言理解)登顶开源模型榜首,Hellaswag、TruthfulQA、GSM8K等多项测评成绩超越Llama 2 70B、GPT-3.5以及Claude 3 Sonnet。

这是近日继OpenAI的视觉版GPT-4 Turbo和谷歌的Gemini 1.5 Pro全面更新后,大模型厂商们发布的第三个重要型号。此外,Meta还暗示将在下个月发布Llama 3。

一、问鼎MMLU开源榜首,3张A100显卡可跑

Mixtral 8x22B包含8个专家模型,每个专家模型的参数规模从上一代的70亿飙升至220亿,序列长度为65536。

在放出磁力链接后不久,Mixtral 8x22B便上架了开源社区Hugging Face,模型文件大小约为262GB,用户可以进一步训练和部署。

性能方面,其在MMLU测评榜登顶开源模型榜首,多项测评成绩超越Llama 2 70B、GPT-3.5以及Claude 3 Sonnet。


▲Mixtral 8x22B测评成绩

虽然发布方式低调,但Mixtral 8x22B再一次引爆了开源社区。AI搜索平台Perplexity Labs和开源平台Together AI都迅速提供了该模型的支持。

AI科学家贾扬清称,通过合理的量化,Mixtral 8x22B可在4个A100/H100显卡上运行,严格来说,其实3张A100显卡就够了


▲贾扬清称3张A100显卡可以跑Mixtral 8x22B

苹果机器学习研究员Awni Hannun称,Mixtral 8x22B模型在苹果机器学习框架MLX上使用M2 Ultra芯片运行良好,并发布了MLX社区中的4位量化模型。


▲苹果机器学习框架MLX运行Mixtral 8x22B

二、杨立昆转发,法国AI生态如此“逆天”

现如今,法国巴黎的AI生态已是“Next Level”。出身巴黎的Meta首席AI科学家杨立昆转发了一篇讲述巴黎是如何成为一个主要AI中心的帖文,故事可以从10多年前说起。


▲杨立昆转发Damien Henry帖文

2013年,Xavier Niel创办了计算机培训学校Ecole 42,这所不同寻常的学校接收来自不同背景的学生,以点对点学习的方式培训编程。

2015年,杨立昆创办了FAIR Paris,也就是FacebookAI研究院。他被公认为深度学习的三大发明者之一,另外两位是加拿大人。

FAIR向法国人才发出了一个信号:他们不必离开法国就可以从事深度学习研究;也向美国其他科技巨头发出信号:在法国进行科学研究是可行的。之后在2018年,谷歌DeepMind也在巴黎开设了一家实验室。

2016年,第一届VivaTech举办,它成为欧盟首屈一指的初创企业和投资者盛会,吸引了超过2400家初创企业和超过2000名投资者。

同年,开源社区Hugging Face在法国成立。也许当时的他们不会知道,其Transformer库不久之后就会成为行业标准。

2017年,Xavier Niel成立了STATION F,这是世界上最大的创业园区。在Roxanne Varza的带领下,它成为了法国的科技中心。值得一提的是,Hugging Face是首批加入STATION F计划的创企之一,也是该计划诞生的首个独角兽。


▲STATION F创业园区

2018年,杨立昆获得图灵奖,成为AI领域最具影响力的人物之一。


▲杨立昆

在此期间,这篇帖文的作者Damien Henry在巴黎组建了Google Arts&Culture团队,专注于AI和图像。他还和其他两位联创共同创建了AI视觉生成工具Clipdrop,后被Stability AI收购。

2019年,巴黎已经在世界AI地图上占据一席之地,但并不像如今一样成为主流。

但在2020年,疫情席卷了全球,远程办公成为常态。这让科技界开始转移阵地:世界上有这么多地方可供选择,我为什么非要在硅谷租房?此外,美国人开始逐渐把科技发展视为一种威胁,而大多数科技没那么发达的国家则恰恰相反。

2021年,Hugging Face迅速增长,成为如今我们熟知的最强开源AI平台。深度科技在全球范围内加速发展,而在巴黎尤为迅速。

2023年Mistral AI成立,并在几个月内就飞速成长为OpenAI的最大劲敌之一。他们发布模型的方式低调又“激进”,仅凭一条没有任何背景信息磁力链接就获得超400万次浏览量,让昂贵的发布视频变得过时。

同年,欧洲首个独立AI研究实验室kyutai成立,Scaleway、Rodolphe Saade等宣布进入计算领域,要为欧洲带来更多GPU。计算机视觉国际顶级会议ICCV也选择在巴黎举办,红衫资本等顶级投资机构也越来越多地将目光放到法国AI创企。

结语:开源社区再添一员巨匠

随着Mixtral 8x22B模型在开源社区中引起轰动,我们见证了开源大模型的迅猛发展和欧洲AI生态的崛起。这一成就不仅展示了Mistral AI在大模型领域的强大实力,也反映了法国乃至整个欧洲在AI研究和创新方面的深厚潜力。

从Ecole 42、FAIR Paris的成立,再到Hugging Face、STATION F的兴起,巴黎已经成为全球AI创新的重要中心。未来,我们期待看到更多硅谷之外的城市在全球AI舞台上扮演重要角色,推动科技前沿创新。

相关内容

热门资讯

成分股集体上涨,港股通汽车ET... 截至2月24日14点10分,上证指数涨0.89%,深证成指涨1.41%,创业板指涨1.11%。ETF...
韩国股指再刷新历史新高!2月最... 来源:财联社 财联社2月23日讯(编辑 马兰)周一,受益于美国对等关税政策无效、人工智能热潮继续刺激...
影石开工红包:每人100,到岗... 2月24日消息,影石为员工安排开工红包,每人100,当天到岗就有。 据介绍,该红包由部门leader...
太疯狂!“现在至少要10万”,... 2月24日早盘,贵金属盘初直线飙升。现货黄金突破5240美元/盎司,触及三周高点,纽约期金突破526...
别盲目跟风!华工科技赶单忙到疯... 最近华工科技涨得有点猛,身边不少人问我是不是又在炒概念。其实吧,这次真不是瞎炒,背后有实打实的订单撑...
韩广岳再辞任董事长职务,李学军... 近日,中邮资管发布公告称,因年龄原因,韩广岳正式向董事会提交辞去公司董事长、董事会投资决策委员会主任...
2026年中国智能舒缓穿戴设备... 华经产业研究院为助力企业、科研、投资机构等单位了解智能舒缓穿戴设备行业发展态势及未来趋势,特重磅推出...
茅台带动春节白酒价格触底止跌,... 虽然业内对2026年春节白酒市场有着“最冷”的担忧,但记者了解到,在茅台的带动下,尽管白酒市场整体需...
广东省情中心:广东生产性服务业... 2月24日,春节后首个工作日,广东连续第四年召开全省高质量发展大会,今年聚焦“制造业与服务业协同发展...
2022三文鱼行业及市场洞察报... 今天分享的是:2022三文鱼行业及市场洞察报告 报告共计:32页 三文鱼作为一种备受青睐的高端水产,...
AI芯片新突破 12只概念股获... 来源:证券时报e公司 人民财讯2月24日电,据科技日报2月23日报道,北京大学电子学院研究员邱晨光团...
原创 不... 特朗普突然改口,全球关税在短时间内再度上调5%,引发市场与舆论的广泛关注。有分析指出,在这一轮博弈中...
湖南三线小城春节消费火爆,商场... 常德街道。胡雅文/摄 本报(chinatimes.net.cn)记者胡雅文 常德报道 马年春节,常德...
小红书负面笔记处理|品牌舆情优... 在当下的社交媒体版图中,小红书早已超越单纯的“种草社区”定位,成长为月活跃用户突破3亿、每日新增笔记...
原创 俄... 最近,国际金融圈发生了一件让许多观察者都感到摸不着头脑的大事——俄罗斯正在源源不断地将黄金运往东方,...
知名食品上市公司实控人陈飞龙去... 2月23日晚间,南侨食品(SH605339)公告称,公司董事会收到公司实控人之一陈飞龙家属通知,陈飞...
高开高走!马年首日三大股指半日... 金融投资报记者 林珂 马年首个交易日大盘如期高开高走,早盘三大股指均出现超过1%的涨幅。 上证指数...
千亿市值巨头,涨停 马年首个交易日,A股主要指数早盘集体上涨。截至午盘,沪指涨1.17%,深证成指涨1.82%,创业板指...
匈牙利外长:决定向谁买能源是主... 据央视新闻报道,欧盟成员国外长2月23日未能就第20轮对俄罗斯制裁方案达成一致。匈牙利外交与对外经济...
IC外汇平台:日本经济长期疲软... 根据国际清算银行数据,今年1月日元实际有效汇率指数降至67.73,创1973年以来最低。该指数反映日...