• 我的订阅
  • 头条热搜
中国最大开源MoE模型,255B参数无条件免费商用,元象发布
元象XVERSE发布中国最大MoE开源模型:XVERSE-MoE-A36B,该模型总参数255B,激活参数36B,达到100B模型性能的「跨级」跃升。同时训练时间减少30%,推理性能提升100%,使每token成本大幅下降。在多个权威评测中,元象MoE效果大幅超越多...……更多
腾讯发布最大开源MoE模型,3890亿参数免费可商用
...文阅读等功能里。现在这样的一个模型彻底开源,免费可商用,算是很有诚意了。这次腾讯Hunyuan-Large总共开源了三个版本:预训练模型、微调模型、FP8量化的微调模型。在开源社区掀起一阵热议,HuggingFace首席科学家Thomas Wolf墙...……更多
昆仑万维发布开源13B高质量商用大模型 领先Llama2和Baichuan2
...l in AGI与AIGC是昆仑万维的战略。4月17日,昆仑万维发布了中国第一个真正实现智能涌现的国产大语言模型——「天工3.5」,并启动邀请测试。5月19日,北京市经济和信息化局公布第一批《北京市通用人工智能产业创新伙伴计划成...……更多
专家模型不要专家并行!微软开源MoE新路径
...学和学院入学统一考试)的数学问题进行案例研究,这是中国一年一度的全国本科入学考试。 该考试以其严格的安全协议而闻名,是评估AI模型回答数学问题的能力的理想测试平台。请注意,GRIN MoE的训练于太平洋标准时间6月3...……更多
百川智能、阿里云等进入开源大模型领域,开启商业化前奏
...期第一财经记者参加的一场行业论坛上,高通AI产品技术中国区负责人万卫星谈到,AI处理的重心正向边缘端转移,大模型可根据终端侧数据提供个性化服务,且不需依赖任何网络连接,数据留在终端,可解决隐私问题。或是考...……更多
碾压所有对手?谷歌发布轻量化开源大模型,笔记本电脑就可跑
...mma依旧保持免费使用,其模型权重也一并开源,并且允许商用。谷歌共发布了两种不同权重规模的模型,分别为Gemma 2B(20亿参数)和Gemma 7B(70亿参数)。每种规模都有预训练和指令微调版本,允许所有组织(无论规模大小)负...……更多
中国电信何忠江发布千亿参数大模型
11月10日消息,今天,中国电信2023数字科技生态大会暨2023数字科技生态展在广州正式启幕,电信多个高管轮流上阵发布了多项产品、平台及技术更新。其中,中国电信人工智能科技总经理何忠江正式发布了"星辰语义"千亿参数的...……更多
智谱AI新大模型来袭:部署价格大降50%,免费商用,做应用能力逼近GPT3.5 | 最前线
文|周鑫雨编辑|邓咏仪2023年10月26日开幕的中国计算机大会(CNCC)上,最受瞩目的仍然是大模型。这场计算机领域的“春晚”汇集了百度CTO王海峰、科大讯飞副总裁刘聪、蚂蚁集团副总裁徐鹏、滴滴CTO张博等几位横跨学界和...……更多
阿里巴巴将开源720亿参数大模型
...开发者都可以使用这种最先进的云计算技术。其表示目前中国80%的科技企业,还有一半的大模型公司都跑在阿里云上面。“我们希望成为AI时代一朵最开放的云,让大家开发AI、使用AI变得更加容易、很便宜。” ……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
...开源都已成为一大趋势。海外,去年7月Llama2宣布免费可商用后,一举成为了全球开发者首选的开源大模型。不久后,谷歌也通过发布Gemma开始进入开源大模型的竞争,凭借70亿参数碾压 Llama2-13B(130亿参数);国内市场,阿里宣...……更多
高通孟樸:终端侧生成式AI无处不在 将变革广泛终端
11月5日,在2023中国国际进口博览会期间,第六届虹桥国际经济论坛——“智能科技与未来产业发展”分论坛在上海国家会展中心举行。此次论坛由工业和信息化部、商务部共同主办,聚焦以人工智能、信息技术为代表的战略性...……更多
全面开源 浪潮信息发布千亿参数基础大模型“源2.0”
...术产品,加速商业化进程。目前,业内仍没有完全开源可商用的千亿大模型,我们希望‘源2.0’能够为国内外开发者、研究机构、科技企业提供坚实的底座和成长的土壤。”浪潮信息高级副总裁刘军说。浪潮信息长期致力于人工...……更多
腾讯开源最大MoE大语言模型!3D大模型同时支持文/图生成,晒混元模型及应用全家桶
...需求,可在HuggingFace、Github等技术社区直接下载,免费可商用。腾讯云TI平台和高性能应用服务HAI也开放接入这两个模型,为模型的精调、API调用及私有化部署提供一站式服务。混元Large Hugging Face地址:https://huggingface.co/tencent……更多
大模型厂商急寻PlanB:英伟达改良版芯片已调试 华为等国产算力供应不足
...,已经月余。《IT时报》记者多方采访获悉,英伟达面向中国市场的改良版——HGX H20已与国内头部服务器厂商在进行适配测试,由于具体的性能差异和优化程度挂钩,目前还很难对其与高配版H800做性能对比,但是,预估HGX H20的8...……更多
昆仑万维宣布开源2千亿稀疏大模型Skywork-MoE
本文转自:中国新闻网6月3日,昆仑万维宣布开源2千亿稀疏大模型Skywork-MoE,性能强劲,同时推理成本更低。Skywork-MoE基于之前昆仑万维开源的Skywork-13B模型中间checkpoint扩展而来,是首个完整将MoE Upcycling技术应用并落地的开源千...……更多
马斯克打脸OpenAI!全球最大模型Grok-1开源
...挖了出来。有网友形容,马斯克对于模型技术这么大方,中国企业终于有福了。(图/钛媒体)3月17日,北京师范大学新闻传播学院教授、北京师范大学传播创新与未来媒体实验平台主任 喻国明在一场演讲中表示,别人一开源中...……更多
本文转自:中国新闻网中新网北京6月3日电 (记者 夏宾)近年来,为了追求大模型的智慧能力,各国公司不停加码投入,4月,Meta宣布追加10亿美元投资,用于其AI芯片研发和AI数据中心建设;亚马逊为了建设新数据中心投入110亿美...……更多
优刻得首个「国产千卡智算集群」落地,支持智源千亿大模型训练
...研究院成立于2018年,其推出的「智源悟道大模型」,是中国首个大模型,为中国人工智能技术发展奠定了深远的研究基础。在2024北京智源大会上,智源研究院公布了大模型全家桶。当前,智源研究院正在优刻得国产智算集群上...……更多
第一个100%开源的MoE大模型,7B的参数,1B的推理成本
... checkpoint、训练日志和训练数据都已经开源。尽管大语言模型 (LM) 在各种任务上取得了重大进展,但在训练和推理方面,性能和成本之间仍然需要权衡。对于许多学者和开发人员来说,高性能的 LM 是无法访问的,因为它们的构建...……更多
大模型新趋势之MoE:现状、挑战及研究方向
2024年,全球主流企业加快推出MoE大模型,1-5月发布千亿以上大模型均采用MoE优化架构,且数量超过近三年总和。MoE大模型架构凭借平衡大模型训推成本和计算效率等优势,更适合处理大规模数据和复杂任务,已成谷歌、OpenAI、...……更多
中国石油发布700亿参数昆仑大模型建设成果
...的700亿参数昆仑大模型建设成果发布会在京举办,标志着中国石油在人工智能领域又迈出坚实一步。发布会上,中国石油介绍了与中国移动、华为、科大讯飞联手打造的700亿参数昆仑大模型,展示了43个专业应用和通用应用创新...……更多
银泰商业算法负责人对话中科大学生:AI大模型商用前景广阔
10月11日下午,位于合肥高新区的中国科学技术大学高新校区内,百余师生参与了一场别开生面的技术交流会,关于AI大模型、人脸识别等热门技术话题被频频提及。学生们时而凝神聆听,时而用笔记录,他们的目光都聚焦在台...……更多
...国际尖端人工智能技术迭代迅速。工信部最新数据显示,中国人工智能核心产业规模达到5000亿元人民币,企业数量超过4400家。人工智能的飞速发展正在给我们的生产生活带来巨变,以大模型为代表的人工智能发展正在全方位重...……更多
最强数学大模型易主!阿里千问新模型成绩超GPT-4o
...Qwen2-Math的许可协议,该模型对大部分用户来说可以免费商用,但对于72B版本,如果每月活跃用户数超过1亿,就需要向千问团队申请许可了。项目主页:https://qwenlm.github.io/zh/blog/qwen2-math/参考链接:https://x.com/JustinLi……更多
李开复发布零一万物首款340亿参数大模型Yi
...普通股0.144美元或每股ADS现金2.88美元。点评:此事预示着中国电商和物流行业进一步整合的趋势。此事对百世来说可能带来资金注入和业务协同,对阿里巴巴和菜鸟则能增强物流能力并提升市场份额。对行业而言,这可能触发更...……更多
昆仑万维:“天工大模型3.0”将于4月17日正式发布 同步开源4000亿参数MoE超级模型
本文转自:中国新闻网2023年4月17日,昆仑万维发布自研双千亿级大语言模型“天工1.0”。即将到来的2024年4月17日,在“天工”大模型一周年之际,昆仑万维重磅宣布,“天工3.0”正式开启公测!“天工3.0”采用4千亿级参数MoE...……更多
苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...武静静编辑|邓咏仪放弃造车后的苹果,正在加速入局大模型战争。当地时间3月15日,苹果就披露了两个关键大模型动作。其中一个值得关注的是苹果的收购事件。彭博社报道称,苹果已经收购了一家加拿大AI初创公司DarwinAI。...……更多
MWC 2024观察:AI+硬件元年来了?
...头们齐聚一堂,上演了一番AI+硬件的“战国时代”。手机中国创始人于忠国对此评价称:今年会是百模大战,各种大模型、AI手机秀肌肉,会成为MWC的一次分水岭。AI+手机:竞争激烈,难分伯仲手机厂商对AI的追逐已经不能称之...……更多
英特尔AI PC半年“答卷”:三大AI引擎驱动
...除了携手行业伙伴共同推动6大AI场景的落地外,英特还与中国本土的多家ISV进行了深度合作,带来了面向教育,政务,医疗,康复养老,制造等行业AIGC的行业大语言模型应用,让AI PC全面解锁了AI行业应用,打通行业落地“最...……更多
观薇智能“玄黄大模型”发布,展示AI+健康领域创新实力
...024年7月20日北京雁栖湖国际会展中心,观薇智能CEO安凯,中国中医科学院中药所中药安全性评价中心主任、首席研究员叶祖光,全国名中医、原东直门医院院长李曰庆,北京智谱华章科技有限公司CEO张鹏,凌云光股份联合创始人...……更多
更多关于科技的资讯:
山东移动成功入选2025年度山东省中小企业服务支撑机构
近日,山东省轻工联社发布《关于公布2025年度山东省中小企业服务支撑机构名单的通知》,山东移动成功入选。作为推动中小企业数字化转型的主力军
2025-09-27 08:11:00
南报网讯(记者卫凌云通讯员建萱)9月26日,2025南京河西中央科创区生态建设推进会举行,“大厂+大学+大所”创新平台揭牌
2025-09-27 09:53:00
山东移动淄博公司织就高速信息网络,筑牢“数字淄博”智慧生命线
在数字化浪潮席卷而来的今天,信息传输网络如同城市的“神经网络”,是智慧城市运转的核心支撑。作为这一无形“生命线”的守护者
2025-09-27 12:34:00
迭代焕新“吾悦经营五步法”,新城控股再启商业新篇
9月24日-25日,新城控股“2025第八届商业年会暨吾悦商管第一届悦链计划合伙人大会”在上海西岸美高梅酒店举行,新城控股集团董事长王晓松及公司高管
2025-09-27 12:37:00
25日上午,以“上山下山·食在晋安”为主题的晋安区“一县一桌菜”云上发布会举行,12道“云端”盛宴引爆味蕾。
2025-09-27 13:53:00
产业链协同驱动 新奥加速冲刺氢硼聚变
河北新闻网讯(张新)2025年,是我国“十四五”规划收官之年,也是“双碳”目标提出五周年。在此背景下,央视《东方时空》栏目近日推出“可控核聚变专题”
2025-09-27 14:45:00
9月25日,国网山西省电力公司发布消息,该公司成功完成配电网无人机电力北斗定位服务的全面应用,标志着该公司依托电力北斗高精度定位服务
2025-09-27 19:56:00
谢志强:从金融菁英到人才“伯乐”,以产学研融合破局就业困境
谢志强,现任中科汇理信息技术研究院党支部书记、秘书长、中科产学研合作一体化人才培育开发平台项目主任。历任中国银行总行风险管理部业务经理
2025-09-27 20:20:00
聚焦数贸会 | 工匠行:机器狗能听会说还会自主巡逻
在第四届全球数字博览会上,贵州工匠行科技有限公司展出的SomaSeek具身智能平台,让机器人彻底告别了遥控器,也能听会说
2025-09-27 22:17:00
企业新市场何处寻?潍坊这场产业国际精准对接会送来“及时雨”
齐鲁晚报·齐鲁壹点 胡晓雪 李国栋9月26日,2025潍坊纺织服装产业国际精准对接活动在奎文区成功举办,本次活动以“我帮企业组主场·我为企业找订单”为主题
2025-09-27 22:22:00
生产周期缩短1/3,宇捷轴承凭核心技术领跑细分市场
齐鲁晚报·齐鲁壹点 陶春燕 山东省宇捷轴承制造有限公司是国家级专精特新重点“小巨人”企业、国内最大的调心滚子轴承生产企业
2025-09-27 20:05:00
电动车照亮小区应急通道?淄博供电验证居民V2G桩集群放电场景
当小区突发故障停电,地下车库里业主们的电动汽车,瞬间变身为一个巨大“充电宝”,为消防、通风和应急照明系统供电,守护社区安全
2025-09-27 12:35:00
数字游民在南京:我推着房间找邻居
随时“云端”办公,自由“安放”工位,数字游民社区兴起数字游民在南京:我推着房间找邻居南京首个乡村数字游民社区坐落于浦口草圣书乡景区
2025-09-26 08:14:00
三迭纪项目入选国家药监局智慧监管典型案例年产3亿片!3D打印药片,片片皆可溯源南报网讯(通讯员唐斐记者张希)近日,国家药品监督管理局信息中心正式公布“2025年药品智慧监管典型案例”
2025-09-26 08:14:00
二〇二五年中国香料香精化妆品精品博览会启幕十七个香妆产业创新转化项目签约南报网讯(记者夏思宇)9月25日上午,2025年中国香料香精化妆品精品博览会在南京扬子江国际会议中心开幕
2025-09-26 08:15:00