• 我的订阅
  • 科技

databricks推出开源ai模型dbrx

类别:科技 发布时间:2024-03-29 05:36:00 来源:浅语科技

3月28日消息,初创公司Databricks近日发布公告,推出了开源AI模型DBRX,声称是迄今为止全球最强大的开源大型语言模型,比Meta的Llama2更为强大。

databricks推出开源ai模型dbrx

DBRX采用transformer架构,包含1320亿参数,共16个专家网络组成,每次推理使用其中的4个专家网络,激活360亿参数。

Databricks在公司博客文章中介绍,在语言理解、编程、数学和逻辑方面,对比Meta公司的Llama2-70B、法国MixtralAI公司的Mixtral以及马斯克旗下xAI开发的Grok-1等主流开源模型,DBRX均优势胜出。

databricks推出开源ai模型dbrx

图1:DBRX在语言理解(MMLU)、编程(HumanEval)和数学(GSM8K)方面的表现优于已有的开源模型。

在语言理解方面,DBRX的分值为73.7%,高于GPT-3.5的70.0%、高于Llama2-70B的69.8%、Mixtral的71.4%以及Grok-1的73.0%。

模型

DBRXInstruct

MixtralInstruct

MixtralBase

LLaMA2-70BChat

LLaMA2-70BBase

Grok-11

OpenLLMLeaderboard2

(Avgofnext6rows)

74.5%

72.7%

68.4%

62.4%

67.9%

ARC-challenge25-shot

68.9%

70.1%

66.4%

64.6%

67.3%

HellaSwag10-shot

89.0%

87.6%

86.5%

85.9%

87.3%

MMLU5-shot

73.7%

71.4%

71.9%

63.9%

69.8%

73.0%

TruthfulQA0-shot

66.9%

65.0%

46.8%

52.8%

44.9%

WinoGrande5-shot

81.8%

81.1%

81.7%

80.5%

83.7%

GSM8kCoT5-shotmaj@13

66.9%

61.1%

57.6%

26.7%

54.1%

62.9%(8-shot)

Gauntletv0.34

(Avgof30+diversetasks)

66.8%

60.7%

56.8%

52.8%

56.4%

HumanEval5

0-Shot,pass@1

(Programming)

70.1%

54.8%

40.2%

32.2%

31.0%

63.2%

在编程能力方面,DBRX的得分为70.1%,远超GPT-3.5的48.1%,高于Llama2-70B的32.3%、Mixtral的54.8%以及Grok-1的63.2%。

Model

DBRX

Instruct

GPT-3.57

GPT-48

Claude3Haiku

Claude3Sonnet

Claude3Opus

Gemini1.0Pro

Gemini1.5Pro

MistralMedium

MistralLarge

MTBench(Inflectioncorrected,n=5)

8.39±0.08

8.41±0.04

8.54±0.09

9.03±0.06

8.23±0.08

8.05±0.12

8.90±0.06

MMLU5-shot

73.7%

70.0%

86.4%

75.2%

79.0%

86.8%

71.8%

81.9%

75.3%

81.2%

HellaSwag10-shot

89.0%

85.5%

95.3%

85.9%

89.0%

95.4%

84.7%

92.5%

88.0%

89.2%

HumanEval0-Shot

pass@1

(Programming)

70.1%

temp=0,N=1

48.1%

67.0%

75.9%

73.0%

84.9%

67.7%

71.9%

38.4%

45.1%

GSM8kCoTmaj@1

72.8%(5-shot)

57.1%(5-shot)

92.0%(5-shot)

88.9%

92.3%

95.0%

86.5%

(maj1@32)

91.7%(11-shot)

81.0%(5-shot)

WinoGrande5-shot

81.8%

81.6%

87.5%

88.0%

86.7%

在数学方面,DBRX的得分为66.9%,高于GPT-3.5的57.1%,也高于Llama2-70B的54.1%、Mixtral的61.1%和Grok-1的62.9%。

databricks推出开源ai模型dbrx

Databricks介绍,DBRX是一个基于MegaBlocks研究和开源项目构建的混合专家模型(MoE),因此每秒输出token的速度极快。Databricks相信,这将为MoE未来最先进的开源模型铺平道路。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-03-29 09:45:11

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

马斯克旗下人工智能大模型Grok已正式开源
...工智能初创公司 xAI 迈出了重大一步,开源了其大型语言模型 (LLM) Grok。这意味着企业家、程序员、公司和个人现在可以访问 Grok 的权重和文档
2024-03-18 09:57:00
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
继旗下xAI公司宣布正式开源大模型Grok-1后,特斯拉CEO马斯克再次在大模型市场扔下一颗重磅炸弹。当地时间8月11日晚
2024-08-13 09:50:00
马斯克 xAI 推出 Grok-1.5 大语言模型
...公司 xAI 今天在官方博客中宣布,正式推出 Grok-1.5 大语言模型。Grok-1.5 具有改进的推理能力和 128k 的上下文长度
2024-03-29 14:00:00
...名AI.comOpenAI已提交GPT-5商标申请亚马逊组建新团队开发AI模型微软计划将下架第一代“智能助手”Cortana软银成立SB Intuitions
2023-08-06 22:54:00
马斯克官宣!xAI正式推出API 允许Grok模型集成到其他应用
...旗下的xAI承诺,将通过应用程序编程接口(API)提供Grok模型。而现在,马斯克兑现了承诺,这个API接口已经出现了。Grok是该公司的旗舰生成式人工智能模型,为马斯克旗下
2024-10-22 17:24:00
周鸿祎一口气发布200多个数字人 “马斯克”“孙悟空”“诸葛亮”将把守大模型应用入口?
昨日(6月13日), 360正式发布“360智脑”大模型应用,360智脑从1.0迭代至4.0版本,包括360安全卫士、360安全浏览器
2023-06-14 13:00:00
马斯克打脸OpenAI!全球最大模型Grok-1开源
...:林志佳马斯克(Elon Musk)真的实现了他的承诺——把大模型Grok-1开源了。钛媒体App获悉,北京时间3月18日早上
2024-03-20 13:44:00
「LLM」这个名字不好,Karpathy认为不准确、马斯克怒批太愚蠢
...?你怎么看。在 AI 领域,几乎每个人都在谈论大型语言模型,其英文全称为 Large Language Models
2024-09-18 15:01:00
马斯克的AI大模型登场
...下社交媒体平台X的AI团队发布公告,正式推出Grok大语言模型。一直以来,马斯克把AI描述为“历史上最具颠覆性的力量”。他是这项技术的狂热粉丝,但又充满警惕。他称,这样的结果
2023-11-06 09:22:00
市场担忧Sora模型带来两大隐患,马斯克“坐不住”了,秀肌肉
据央视财经2月20日报道,近期,OpenAI发布的新模型Sora引发了关注,纽约时报报道称,现在OpenAI的估值或达到约800亿美元
2024-02-21 14:59:00
更多关于科技的资讯:
2026年米兰冬奥会的脚步越来越近,绍兴乾雍纺织有限公司总经理萧兴水期待着米兰来的消息。“这次咱们中国队赛时制服面料全部用数码打印而成
2026-01-19 23:33:00
河北新闻网讯(任蕊)“以前插接一根四分钢丝绳,费时费力。现在用上自制装置,效率翻番!”1月11日,在开滦股份吕家坨矿负950五采回风石门掘进现场
2026-01-19 20:15:00
一家皖企跻身胡润中国人工智能企业10强榜
大皖新闻讯 1月19日,胡润研究院发布《2025胡润中国人工智能企业50强》排行榜,中国科大校友陈天石创立的寒武纪蝉联榜首
2026-01-19 22:42:00
河北新闻网讯(田坤)近日,在开滦集团钱家营矿业公司(简称“开滦钱矿公司”)机采科检修车间,一台自主研发的“液压钻车负载敏感阀试验台装置”成功完成首次测试
2026-01-19 20:03:00
河北新闻网讯(闫丽颖、罗俊明)近日,开滦股份范各庄矿顺利完成井下排水泵房的智能化改造,传统人工巡检模式被远程集中监控替代
2026-01-19 20:04:00
安克与飞书联合发布“安克AI录音豆” 录音可在飞书中被AI调用
2026年1月19日,安克创新与飞书联合发布了最新AI硬件——安克AI录音豆,飞书提供了该产品的软件AI适配与服务。这款产品以极轻的"磁吸纽扣”形态实现无感随身佩戴
2026-01-19 17:13:00
+14!省级专精特新梯队扩容
江南时报讯 近日,江苏省工信厅公示了2025年度省级专精特新中小企业(第二批)认定和通过复核企业名单,苏州市相城区黄桥街道共有14家企业上榜
2026-01-19 17:25:00
2026年潍坊市家电国补启动,享国补到三联家电
鲁网1月19日讯2026年潍坊市家电及数码产品补贴正式上线,标志着新一轮“国补”政策在潍坊全面落地。1月16日,三联家电41周年店庆活动盛大启幕
2026-01-19 17:28:00
近日青岛大学龙云泽团队研发的自供能眼球追踪系统火了,仅凭眨眼摩擦就能发电,还能99%精准捕捉眼球运动,像普通眼镜一样轻便
2026-01-19 18:06:00
简橙钱米第三届“岁月珍藏,财智生花”线下品牌活动圆满结束
2026年1月11日,广州番禺太平木棉之家,以“岁月珍藏,财智生花”为主题的第三届简橙「理」想人生线下品牌活动温馨落幕
2026-01-19 17:32:00
为夯实业务转型升级根基,切实提升普惠金融服务质效,近日,滦州农商银行举办信贷新模式及信贷产品专题培训会。该行信贷相关条线骨干
2026-01-19 17:02:00
1月18日,由城市头条有限公司主办的融媒体平台“城市头条”宣布其官方移动应用“城市头条APP”已正式在官网及各主要应用商店上线
2026-01-19 16:55:00
肥乡联社始终践行“以客户为中心”的服务理念,聚焦网点服务提质增效,不断创新服务模式、精进服务技能、丰富厅堂服务内涵,将服务触角深度延伸至城乡末梢
2026-01-19 14:55:00
1月18日,2026华杰新品盛典暨AIX大家居智能增长引擎发布会在石家庄举办。本次活动以“格物·开悟”为内核,聚焦面向核心伙伴的 "能力交付",共同探索家居行业的智造升级与增长新
2026-01-19 15:35:00
近日,中国人寿保险股份有限公司(以下简称“中国人寿”,股票代码:601628.SH,2628.HK)凭借在保险主业、社会责任
2026-01-19 15:50:00