独家 | 国内首个开源千亿参数MoE大模型来了,对标马斯克的Grok 马斯克ai大模型grok开源昆仑万维 moe模型开源
admin
2024-04-02 09:42:36
0


马斯克宣布开源大模型Grok后,国内也将迎来首个开源的千亿参数MoE(混合专家)大模型。近日,「市界」独家获悉,国内独角兽企业APUS(麒麟合盛)联合新旦智能训练的大模型APUS-xDAN 大模型4.0(MoE)将于近日宣布开源。


据「市界」了解,APUS-xDAN 大模型4.0(MoE)是国内首个千亿以上参数MoE架构的开源大模型,参数规模为1360亿,这也是目前国内参数规模最大的开源模型。此前国内开源的大模型中,参数规模最大的是阿里720亿参数的千问72B,参数规模为720亿。

此外,「市界」获悉,APUS-xDAN 大模型4.0(MoE)还是国内首个支持在4090低端算力上训练的千亿参数开源大模型,通过MoE架构和算法优化实现了对低端算力芯片的适配。

“马斯克的Grok至少要8张H100才能运行,大部分中小企业其实没有那么多资源,而4090是一个消费级显卡,成本比较低,在国内也更容易获得,大部分企业和机构都能用来训练。”APUS董事长兼CEO李涛对「市界」表示。

据《参考消息》报道,美国方面修订了五个月前出台的相关规定,旨在使中国更难进口美国的高端人工智能芯片。

针对这一现状,李涛和新旦智能创始人成一鹏均提到,对低端算力的支持,是这次APUS-xDAN大模型4.0(MoE)的最大突破,能够很大程度上应对算力卡脖子问题。

这次开源的APUS-xDAN大模型4.0(MoE)背后,站着两家企业,分别是成立十年的独角兽企业APUS和一家初创人工智能企业新旦智能,模型由双方共同训练,并且APUS投资了新旦智能。

资料显示,APUS是一家成立于2014年的人工智能企业,由360前副总裁李涛于2014年创办,2022年之前主要做出海业务。

2022年底开始,APUS正式转型人工智能和大模型,2023年4月,APUS正式发布了APUS通用大模型,据李涛向「市界」披露,目前APUS的大模型团队超过百人。李涛还提到,目前开源的APUS-xDAN大模型4.0(MoE)的综合性能已经可以实现GPT-4 的90%。


▲图源/APUS-xDAN 大模型4.0(MoE)

作为一家人工智能企业,李涛提到,APUS大模型的另一个优势是算法语料比较多元化,国内大模型玩家很多都依赖于中文语料进行训练,对于其他语言的算法语料覆盖远远不足。而APUS的产品和服务目前已经覆盖了全球200多个国家,用户数量达到24亿+,算法语料更加多元。

李涛表示,APUS目前为止是国内大模型行业商业化最好的企业之一,已经落地医疗、电商、网信大模型,除了To C领域以外,在ToG和ToB领域探索了多样化的应用场景。


而新旦智能目前成立不到一年时间,由成一鹏创立于2023年5月,成立后不久,就分别用7B、30B模型在大模型榜单MT-Bench上登顶TOP1。2024年3月初,新旦智能宣布完成千万级别天使轮融资,背后的投资方就是APUS和AI行业投资人周弘扬。

据新旦智能创始人成一鹏向「市界」介绍,目前新旦智能的团队规模为十余人,由一群来自清华、伯克利、腾讯、Meta等机构和企业的工程师组成,成员包括全球顶尖的开源AI社区知名开发者Wing (目前全球最受欢迎的AI训练系统作者), 以及开源社区最受欢迎的AI数据组织Founder Austin。

据成一鹏介绍,新旦智能的多模态智能体在LLM领域已经完成了对GPT3.5 Turbo的超越,很多指标和GPT4只有不到10%的差距,例如MMLU(74.7%)比较通用的推理分析指标, GSM 8K 数学指标(82.5%),差距大概只有 9%。然后在部分领域,他们已经超过了GPT4,例如智能体的这个拟人性指标(MT bench )已经超越GPT 4 约 3% 。

“可以简单理解为,我们现在拥有一个智商上正在逼近GPT4,同时情商还很高的大脑装配在了自己的智能体上。”成一鹏表示。

这次开源的APUS-xDAN大模型4.0(MoE)另一个突破点,是填补了国内千亿大模型在开源领域的空白,目前国内千亿规模以上的大模型基本都不开源,包括百度的文心一言、华为的盘古大模型等。而参数规模是衡量模型复杂度的重要指标,更大的参数往往可以让大模型在处理复杂任务时表现更好,具有更高的准确性和泛化能力。

作者 | 曾 广

编辑 | 董雨晴

运营 | 刘 珊

相关内容

热门资讯

上节育环后需要注意什么 一、休息与活动 上节育环后要适当休息,避免剧烈运动和重体力劳动,一般建议休息1 - 2天。因为过早进...
挖矿收益不足3美分!比特币暴跌... 来源:环球市场播报 TMG Core 展台的液体浸没式冷却矿槽中的加密货币矿机。 罗森布拉特证券公...
众机构唱多三星电子:存储巨头冲... 财联社2月25日讯(编辑 史正丞)随着三星电子周二收涨3.6%,迈上每股20万韩元的历史新高,分析师...
增值税发票数据显示:春节假期消... 新华社北京2月24日电(记者刘开雄)记者2月24日从国家税务总局获悉,增值税发票数据显示,2026年...
从“向外求索”到“向内安顿”的... 从“向外求索”到“向内安顿”的消费觉醒 当商务宴席上的茅台与书房中静静摆放的谦夫子养生露酒同时出现在...
千寻智能完成近20亿元融资 北京商报讯(记者 陶凤 王天逸)2月24日,具身智能头部企业千寻智能宣布,近日连续完成两轮融资,金额...
原创 银... 最近不少人发现,家附近的银行网点悄悄关门了,有的贴出公告终止营业,有的直接撤柜清空,就连工商银行、建...
美联储理事库克称央行可能无法应... 来源:环球市场播报 美联储理事丽莎·库克警告称,美国央行可能无法应对因采用人工智能而导致的失业率上升...
焦点访谈|这个春节假期,消费市... 来源:滚动播报 (来源:千龙网) 金马昂首,新春纳福。刚刚过去的丙午年春节假期,消费市场购销两旺持续...
亚朵节后价格“跳水”超70% 春节过后,部分热门小城的亚朵酒店房价上演“过山车”行情,房价节前飙升,节后迅速跳水,巨大的价格波动引...
原创 金... 你绝对想不到,同样一克999足金,在深圳水贝批发市场只要1334元,走进周大福门店却变成1545元,...
德兰明海冲击港交所!递表前大手... 又一家储能企业“叩响”了港交所大门。近期,港交所官网显示,中小型用户侧储能企业深圳市德兰明海新能源股...
绿茶集团、猫眼娱乐发布正面盈利... |2026年2月25日 星期三| NO.1绿茶集团发布正面盈利预告 2月24日港股收市后,绿茶集团(...
安宁市的历史文化及名人有哪些 安宁市,这座坐落在彩云之南的城市,宛如一颗璀璨明珠,散发着迷人的历史文化魅力。在这里,岁月留下了深深...
中国央行连续12个月加量续作M... 来源:中国新闻网 中新社北京2月24日电 (陶思阅)中国央行24日发布中期借贷便利(MLF)招标公告...
不是15%?特朗普10%全球关... 据美国海关及边境保卫局(CBP)发布消息,特朗普政府将实施的新全球关税为10%。 第一财经收到的CB...
2026年春节出游人次、消费金... 2026年春节,为期9天的超长假期点燃了全国消费热情,多项核心数据创下历史纪录。 经文化和旅游部数据...
美国联邦存款保险公司(FDIC... 美国联邦存款保险公司(FDIC):美国银行业存款季环比下滑2%。
2026春节AI大战深度复盘:... 主编温静导读:2026年春节,元宝、千问、豆包三大巨头以红包、免单为杠杆,发动了一场规模空前的用户争...